एक अमेरिकी इंजीनियर ने कई AI मॉडलों को असली कार का नियंत्रण सौंपा, लेकिन उनका ड्राइविंग प्रदर्शन उम्मीदों पर खरा नहीं उतरा।
एक अमेरिकी इंजीनियर ने ChatGPT, Claude और Grok को असली कार का पूरा नियंत्रण देने का फैसला किया, ताकि पता चल सके कि आज के AI मॉडल वास्तव में अपने दम पर ड्राइविंग कर सकते हैं या नहीं।
इस प्रयोग में चार AI प्रणालियों को वर्चुअल स्टीयरिंग सौंपा गया, जिनमें ChatGPT के दो अलग-अलग संस्करण शामिल थे। सभी को समस्याओं का सामना करना पड़ा, हालांकि एक मॉडल ने स्पष्ट रूप से अन्य मॉडलों से बेहतर प्रदर्शन किया।
इंजीनियर ने AI प्रणालियों को सीधे कार के स्टीयरिंग, थ्रॉटल और ब्रेक नियंत्रणों से जोड़ा और एक खाली पार्किंग स्थल में परीक्षण किया। चूंकि ये AI मॉडल अपने आसपास के परिवेश को समझने या पल भर में ब्रेक लगाने के फैसले लेने के लिए नहीं बनाए गए थे, इसलिए उन्होंने एक ऐसी प्रणाली बनाई जो कैमरा सेंसर के डेटा को हर प्रॉम्प्ट के लिए दृश्य संदर्भ में बदलती थी।
इसके बाद AI प्रणालियों ने टेक्स्ट कमांड के जरिए जवाब दिया, जिनमें स्टीयरिंग का कोण, थ्रॉटल की स्थिति और ब्रेक लगाने का बल बताया गया था।
सबसे बड़ी समस्या प्रतिक्रिया देने में लगने वाला समय था। AI अक्सर इतनी देर से फैसले लेता था कि कार की दिशा को प्रभावी ढंग से ठीक करना संभव नहीं होता था। उदाहरण के लिए, जब तक स्टीयरिंग में 15 डिग्री का सुधार करने का निर्देश आता, कार अपने रास्ते से काफी भटक चुकी होती थी।
प्रणालियों को आसपास की चीजों की स्थिति और दूरी समझने में भी कठिनाई हुई। अपने परिवेश की वास्तविक त्रि-आयामी समझ न होने के कारण वे बाधाओं की दूरी का आकलन करने में संघर्ष करती रहीं।
कई बार AI मॉडलों ने परस्पर विरोधी निर्देश भी दिए। एक उदाहरण में, एक प्रणाली ने इंजन की 100 प्रतिशत शक्ति इस्तेमाल करने को कहा और उसी समय पूरी ताकत से ब्रेक लगाने का आदेश भी दिया।
इंजीनियर के अनुसार, नवीनतम GPT-6 Astra मॉडल ने कुल मिलाकर सबसे अच्छा प्रदर्शन किया, हालांकि उसका प्रतिक्रिया समय अब भी एक बड़ी सीमा बना रहा।
Grok ने कहीं अधिक तेजी से प्रतिक्रिया दी, लेकिन उसके फैसले पर्याप्त रूप से सटीक या सुरक्षित नहीं थे। Claude का प्रदर्शन ChatGPT से अधिक मिलता-जुलता रहा: उसने संभावित खतरों को पहचानने की मजबूत क्षमता दिखाई, लेकिन जरूरत से ज्यादा सावधानी के साथ प्रतिक्रिया दी।
पहली कोशिश में नाकाम रहने के बावजूद, इंजीनियर ने अंततः ChatGPT-6 Astra को विजेता घोषित किया। अपनी पिछली गलतियों से सीखने के बाद प्रणाली ने दूसरी कोशिश में 5 मिनट 22 सेकंड में मार्ग पूरा किया।
Claude Fable 5.1 ने मार्ग का 45 प्रतिशत पूरा किया, जबकि Grok 4.6 11 प्रतिशत पर रुक गया। GPT-5.6 Sol परीक्षण मार्ग का केवल 6 प्रतिशत ही पूरा कर सका।