Amerikalik muhandis bir nechta sun’iy intellekt modeliga haqiqiy avtomobil boshqaruvini topshirdi, ammo ularning haydash natijalari kutilgan darajaga yetmadi.
Amerikalik muhandis bugungi sun’iy intellekt modellari avtomobilni mustaqil boshqara olishini tekshirish uchun ChatGPT, Claude va Grok’ka haqiqiy avtomobil ustidan to‘liq boshqaruvni berishga qaror qildi.
Tajribada to‘rtta sun’iy intellekt tizimi, jumladan ChatGPT’ning ikki xil versiyasi virtual rulga o‘tirdi. Ularning barchasi muammolarga duch keldi, biroq bitta model boshqalarga qaraganda ancha yaxshi natija ko‘rsatdi.
Muhandis sun’iy intellekt tizimlarini avtomobilning rul, gaz va tormoz boshqaruviga bevosita ulab, sinovni bo‘sh avtoturargohda o‘tkazdi. Ushbu modellar atrofdagi vaziyatni talqin qilish yoki soniyaning ulushida tormozlash qarorini qabul qilish uchun yaratilmagani sababli, u kamera sensorlari ma’lumotlarini har bir so‘rov uchun vizual kontekstga aylantiradigan tizim yaratdi.
Sun’iy intellekt tizimlari bunga javoban rul burilish burchagi, gaz pedali holati va tormozlash kuchini belgilovchi matnli buyruqlar yubordi.
Eng katta muammo javob berish vaqti bo‘ldi. Sun’iy intellekt ko‘pincha avtomobil yo‘nalishini samarali to‘g‘rilash uchun juda kech qaror qabul qildi. Masalan, rulni 15 darajaga burish buyrug‘i berilgan paytga kelib, avtomobil belgilangan yo‘nalishdan ancha og‘ib ketgan edi.
Tizimlar fazoviy idrokda ham qiynaldi. Atrofdagi muhitni haqiqiy uch o‘lchamli tarzda tushunmagani sababli, ular to‘siqlargacha bo‘lgan masofani baholashda qiyinchilikka duch keldi.
Ba’zan sun’iy intellekt modellari hatto bir-biriga zid buyruqlar ham berdi. Bir holatda tizim dvigatelning 100 foiz quvvatini talab qilish bilan bir vaqtda to‘liq tormozlashni buyurdi.
Muhandisning aytishicha, eng yangi GPT-6 Astra modeli umumiy hisobda eng yaxshi natijani ko‘rsatgan, biroq uning javob berish vaqti hamon jiddiy cheklov bo‘lib qolgan.
Grok ancha tez javob berdi, ammo uning qarorlari yetarlicha aniq va xavfsiz emas edi. Claude ko‘proq ChatGPT kabi ishladi: ehtimoliy xavflarni aniqlashda yuqori qobiliyat ko‘rsatdi, ammo haddan tashqari ehtiyotkorlik bilan harakat qildi.
Muhandis dastlabki muvaffaqiyatsizlikka qaramay, yakunda ChatGPT-6 Astra’ni g‘olib deb topdi. Tizim avvalgi xatolaridan saboq olib, ikkinchi urinishida yo‘nalishni 5 daqiqa 22 soniyada bosib o‘tdi.
Claude Fable 5.1 yo‘nalishning 45 foizini bosib o‘tdi, Grok 4.6 esa 11 foizda to‘xtadi. GPT-5.6 Sol yo‘nalishning atigi 6 foizini bosib o‘tishga muvaffaq bo‘ldi.