Америкалық инженер бірнеше ЖИ моделіне нақты автокөлікті басқаруды тапсырды, бірақ олардың жүргізу нәтижелері күткен деңгейге жетпеді.
Америкалық инженер қазіргі ЖИ модельдерінің көлікті шынымен өздігінен жүргізе алатынын тексеру үшін ChatGPT, Claude және Grok жүйелеріне нақты автокөлікті толық басқаруды беруге шешім қабылдады.
Тәжірибеде төрт ЖИ жүйесі виртуалды рульге отырды, олардың арасында ChatGPT-дің екі түрлі нұсқасы болды. Барлығы қиындықтарға тап болды, дегенмен бір модель басқаларынан айқын жақсы нәтиже көрсетті.
Инженер ЖИ жүйелерін автокөліктің руль, акселератор және тежегіш басқару тетіктеріне тікелей қосып, сынақты бос тұрақта өткізді. Бұл ЖИ модельдері айналадағы жағдайды түсіндіруге немесе секундтың үлестерінде тежеу туралы шешім қабылдауға арналмағандықтан, ол камера сенсорларының деректерін әрбір сұрау үшін визуалды контекске айналдыратын жүйе құрды.
Содан кейін ЖИ жүйелері рульдің бұрылу бұрышын, акселератордың қалпын және тежеу күшін көрсететін мәтіндік пәрмендермен жауап берді.
Ең үлкен мәселе жауап беру уақыты болды. ЖИ көбіне автокөліктің траекториясын тиімді түзету үшін шешімді тым кеш қабылдады. Мысалы, рульді 15 градусқа бұрып түзету пәрмені берілген сәтте көлік бағытынан едәуір ауытқып кеткен болатын.
Жүйелер кеңістікті қабылдауда да қиналды. Айналадағы ортаны толыққанды үш өлшемді түрде түсінбегендіктен, оларға кедергілерге дейінгі қашықтықты бағалау қиын болды.
Кейде ЖИ модельдері тіпті бір-біріне қайшы пәрмендер берді. Бір жағдайда жүйе қозғалтқыш қуатын 100 пайызға жеткізуді талап етіп, сонымен қатар барынша тежеуді бұйырды.
Инженердің айтуынша, ең жаңа GPT-6 Astra моделі жалпы ең жақсы нәтиже көрсетті, бірақ оның жауап беру уақыты әлі де елеулі шектеу болып қалды.
Grok әлдеқайда жылдам жауап берді, бірақ оның шешімдері жеткілікті дәл әрі қауіпсіз болмады. Claude көбіне ChatGPT сияқты жұмыс істеді: ықтимал қауіптерді жақсы анықтады, бірақ тым сақ әрекет етті.
Ақырында инженер алғашқы сәтсіздігіне қарамастан, ChatGPT-6 Astra жүйесін жеңімпаз деп атады. Екінші әрекетінде жүйе бұрынғы қателерінен сабақ алып, бағытты 5 минут 22 секундта толық жүріп өтті.
Claude Fable 5.1 бағыттың 45 пайызын жүріп өтті, ал Grok 4.6 11 пайызға жеткенде тоқтады. GPT-5.6 Sol жолдың небәрі 6 пайызын ғана еңсере алды.