এক মার্কিন প্রকৌশলী কয়েকটি AI মডেলের হাতে একটি আসল গাড়ির নিয়ন্ত্রণ তুলে দিয়েছিলেন, কিন্তু তাদের গাড়ি চালানোর দক্ষতা প্রত্যাশা পূরণ করতে পারেনি।
আজকের AI মডেলগুলো সত্যিই নিজেরা গাড়ি চালাতে পারে কি না, তা দেখতে এক মার্কিন প্রকৌশলী ChatGPT, Claude এবং Grok-কে একটি আসল গাড়ির সম্পূর্ণ নিয়ন্ত্রণ দেওয়ার সিদ্ধান্ত নেন।
পরীক্ষায় চারটি AI ব্যবস্থাকে ভার্চুয়াল স্টিয়ারিংয়ের দায়িত্ব দেওয়া হয়, যার মধ্যে ছিল ChatGPT-এর দুটি ভিন্ন সংস্করণ। সবগুলোই সমস্যায় পড়ে, যদিও একটি মডেল অন্যগুলোর তুলনায় স্পষ্টতই ভালো পারফর্ম করে।
প্রকৌশলী AI ব্যবস্থাগুলোকে সরাসরি গাড়ির স্টিয়ারিং, থ্রটল ও ব্রেকের নিয়ন্ত্রণের সঙ্গে যুক্ত করেন এবং একটি খালি পার্কিং এলাকায় পরীক্ষা চালান। এই AI মডেলগুলো আশপাশের পরিবেশ বুঝতে বা মুহূর্তের মধ্যে ব্রেক করার সিদ্ধান্ত নিতে তৈরি করা হয়নি বলে তিনি এমন একটি ব্যবস্থা তৈরি করেন, যা ক্যামেরা সেন্সরের তথ্যকে প্রতিটি প্রম্পটের জন্য দৃশ্যগত প্রেক্ষাপটে রূপান্তর করে।
এরপর AI ব্যবস্থাগুলো লিখিত নির্দেশের মাধ্যমে উত্তর দেয়, যাতে স্টিয়ারিংয়ের কোণ, থ্রটলের অবস্থান এবং ব্রেক করার বল নির্দিষ্ট করা ছিল।
সবচেয়ে বড় সমস্যা ছিল সাড়া দেওয়ার সময়। AI প্রায়ই এত দেরিতে সিদ্ধান্ত নিত যে গাড়ির গতিপথ কার্যকরভাবে ঠিক করা যেত না। উদাহরণস্বরূপ, স্টিয়ারিং ১৫ ডিগ্রি ঘুরিয়ে সংশোধনের নির্দেশ আসতে আসতে গাড়ি ইতিমধ্যেই নির্ধারিত পথ থেকে অনেকটা সরে যেত।
ব্যবস্থাগুলো আশপাশের বস্তুর অবস্থান ও দূরত্ব বোঝার ক্ষেত্রেও সমস্যায় পড়ে। পরিবেশের প্রকৃত ত্রিমাত্রিক ধারণা না থাকায় বাধার দূরত্ব বিচার করা তাদের জন্য কঠিন হয়ে পড়ে।
কখনো কখনো AI মডেলগুলো পরস্পরবিরোধী নির্দেশও দেয়। একটি ক্ষেত্রে একটি ব্যবস্থা ইঞ্জিনের ১০০ শতাংশ শক্তি ব্যবহারের নির্দেশ দেওয়ার পাশাপাশি একই সময়ে পুরো শক্তিতে ব্রেক করার নির্দেশ দেয়।
প্রকৌশলীর মতে, সর্বশেষ GPT-6 Astra মডেল সামগ্রিকভাবে সেরা পারফর্ম করেছে, যদিও এর সাড়া দেওয়ার সময় একটি বড় সীমাবদ্ধতা হয়েই থেকেছে।
Grok অনেক দ্রুত সাড়া দিয়েছে, কিন্তু এর সিদ্ধান্তগুলো যথেষ্ট নির্ভুল বা নিরাপদ ছিল না। Claude-এর পারফরম্যান্স অনেকটা ChatGPT-এর মতো ছিল; এটি সম্ভাব্য বিপদ শনাক্ত করার জোরালো সক্ষমতা দেখালেও প্রতিক্রিয়া জানিয়েছে অতিরিক্ত সতর্কতার সঙ্গে।
প্রথম চেষ্টায় ব্যর্থ হওয়া সত্ত্বেও প্রকৌশলী শেষ পর্যন্ত ChatGPT-6 Astra-কে বিজয়ী ঘোষণা করেন। আগের ভুল থেকে শিখে দ্বিতীয় চেষ্টায় ব্যবস্থাটি ৫ মিনিট ২২ সেকেন্ডে পথটি সম্পূর্ণ করে।
Claude Fable 5.1 পথের ৪৫ শতাংশ সম্পূর্ণ করেছে, আর Grok 4.6 থেমেছে ১১ শতাংশে। GPT-5.6 Sol পরীক্ষার পথের মাত্র ৬ শতাংশ সম্পূর্ণ করতে পেরেছে।