Нейромережі впоралися із завданням гірше, ніж передбачав американець.
Інженер із США вирішив передати нейромережам ChatGPT, Claude та Grok повний контроль над справжньою Toyota Corolla, щоб перевірити, чи здатні вони впоратися з керуванням. Про це пише Supercar Blondie.
Користувач із ніком DrivingBench на своїй сторінці в соцмережі X показав результати експерименту з нейромережами ChatGPT, Claude та Grok, які отримали повний контроль над Toyota Corolla. У всіх трьох моделей ШІ були свої проблеми, але одна модель явно справлялася з керуванням автомобілем краще за інші.
У більшості сценаріїв усі чотири моделі ШІ (в експерименті брали участь дві різні версії ChatGPT) поводилися хаотично. У кожної з них були свої індивідуальні проблеми під час керування автомобілем.
Інженер підключив моделі ШІ безпосередньо до систем керування кермом, дросельною заслінкою та гальмами справжньої Toyota Corolla на порожній парковці. Ці моделі ШІ не призначені для аналізу навколишнього середовища або прийняття рішень про гальмування за частки секунди, через що чоловік вирішив створити систему, в якій датчики камери передають візуальні дані у вигляді контексту запиту. У свою чергу, нейромережі повертали текстові команди, що вказували кути повороту керма, відсоток відкриття дросельної заслінки та силу гальмування.
Головна проблема полягала в тому, що моделі штучного інтелекту занадто пізно приймали рішення. Наприклад, коли кермо потрібно було повернути на 15 градусів, автомобіль уже значно відхилився від курсу. Також великим недоліком стала відсутність 3D-просторового сприйняття, через що нейромережі погано оцінювали відстані до перешкод.
Іноді моделі ШІ видавали суперечливі команди, наприклад, передавали 100-відсоткову потужність двигуна й одночасно давали команду на повне гальмування.
За словами інженера, новітня модель GPT-6 Astra показала себе краще за всіх. Однак їй все ще бракує швидкості реакції.
Grok же реагував дуже швидко, але не був достатньо безпечним і точним. Інженер додав, що Claude був схожий на ChatGPT, чудово розпізнаючи потенційні небезпеки, але діяв надто нерішуче.
Інженер визнав переможцем модель штучного інтелекту ChatGPT-6 Astra, яка зазнала невдачі, але з другої спроби подолала маршрут за 5 хвилин і 22 секунди, витягуючи уроки з попередніх помилок. Друге місце посіла модель Claude Fable 5.1, яка подолала 45% маршруту, а модель Grok 4.6 зійшла з дистанції на позначці 11%. Модель GPT-5.6 Sol змогла подолати лише 6% маршруту.
Раніше автор YouTube-каналу Drive Electric Today перевірив, чи зможе його електромобіль Tesla з увімкненою системою напівавтономного керування FSD самостійно проїхати майже 2000 км уздовж Східного узбережжя Америки.
Поїздка мала тривати 19 годин, протягом яких блогер взагалі не мав керувати автомобілем. Поки система FSD керувала автомобілем, американець насолоджувався краєвидами та займався своїми справами. Однак під час дощу виникли проблеми.