Американський інженер передав чотирьом моделям штучного інтелекту контроль над справжньою Toyota Corolla, щоб перевірити, чи здатні вони самостійно керувати автомобілем. У тесті брали участь дві версії ChatGPT, Claude та Grok, але більшість із них не змогли пройти навіть половини маршруту.
Інженер, який веде сторінку DrivingBench у соцмережі X, підключив моделі ШІ безпосередньо до систем керування кермом, дросельною заслінкою та гальмами Toyota Corolla.
Випробування проводили на порожній парковці, щоб зменшити ризики.
Оскільки звичайні мовні моделі не призначені для керування автомобілем у реальному часі, інженер створив окрему систему передачі інформації.
Камери надсилали моделям зображення навколишнього середовища у вигляді частини запиту. У відповідь нейромережі повертали текстові команди з кутом повороту керма, рівнем відкриття дросельної заслінки та силою гальмування.
Однією з головних проблем стала затримка реакції. Поки модель визначала, на скільки градусів потрібно повернути кермо, автомобіль уже встигав помітно відхилитися від потрібної траєкторії.
Ще одним слабким місцем виявилося просторове сприйняття. Без повноцінного 3D-розуміння ситуації моделі погано оцінювали відстань до перешкод.
Іноді штучний інтелект видавав взаємовиключні команди. Наприклад, система могла одночасно наказати повністю відкрити дросель і максимально натиснути на гальма.
Найкращий результат, за словами автора експерименту, показала GPT-6 Astra.
З першої спроби модель не впоралася, але під час повторного заїзду змогла пройти весь маршрут за 5 хвилин 22 секунди.
Claude Fable 5.1 подолала 45% дистанції.
Grok 4.6 припинила заїзд після 11% маршруту. Інженер зазначив, що модель реагувала швидко, але їй бракувало точності та безпечності.
GPT-5.6 Sol змогла пройти лише 6% дистанції.
🌟 Читайте «Експерт» у своєму смартфоні — додайте нас в Google Discover
