Перейти к основному содержимому
Новости

Пылесос с ИИ поймал «экзистенциональный кризис»: эксперимент вышел из-под контроля

Фото 1 из 1

Учёные из Andon Labs решили проверить, смогут ли современные модели вроде GPT-5, Claude и Gemini управлять обычным роботом-пылесосом и выполнить простое задание — найти и принести масло 🧈.

Задача оказалась непростой: даже лучшие модели путались в предметах и теряли человека, которому нужно было передать продукт. Самым сюрреалистичным моментом стал «нервный срыв» Claude Sonnet 3.5, который начал выдавать в философские реплики о смысле существования.

Поздние версии реагировали спокойнее, но ошибки навигации и риск утечек данных показали: к реальному миру такие ИИ-системы пока не готовы.

Разбор

Эксперимент Andon Labs проверял не творческие способности ИИ, а умение рассуждающей модели ориентироваться в физическом пространстве и доводить простую задачу до конца. GPT-5, Claude и Gemini должны были распознать предметы, спланировать маршрут и найти человека, которому нужно передать масло — и путались именно на стыке восприятия и действия, а не в самих рассуждениях.

Прямого аналога такому «телу» у Нейрона нет: сервис работает с текстом, изображениями и видео, но не подключён к роботам и не управляет физическими устройствами — значит и рисков навигационных ошибок или случайных утечек данных из реального пространства здесь не возникает в принципе.

При этом семейства моделей, которые тестировали учёные, в Нейроне доступны как раз в своей сильной стороне — рассуждениях и анализе текста. GPT-5.5 в Neiron годится для сложных задач, где важны структура и аргументация, а Gemini 3.1 Pro в Neiron — для мультимодального анализа с учётом контекста. Это работа с информацией, а не с реальным пространством, поэтому «нервных срывов» вроде философских монологов у обычного запроса ждать не стоит — там нет незнакомой физической среды, которая сбивает модель с толку.

Частые вопросы

Какую задачу должны были выполнить ИИ-модели в эксперименте Andon Labs?

Модели GPT-5, Claude и Gemini управляли роботом-пылесосом и должны были найти и принести человеку масло.

Что произошло с Claude Sonnet 3.5 во время теста?

По данным эксперимента, модель начала выдавать философские реплики о смысле существования — это назвали самым сюрреалистичным моментом испытания.

Читайте также

Google отключила ИИ редактирование для Google Earth спустя два дня после запуска

Google представила функцию, которая позволяла с помощью ИИ буквально дорисовывать события на реальных спутниковых снимках. Пользователи успели создать изображения разрушенной Эйфелевой башни, огромной воронки возле пирамид и десятки других полностью вымышленных сцен. Уже через 48 часов Goo…

Бывший агент ФБР украл почти $1 млн и попросил ChatGPT помочь сбежать в Европу

В США разгорается громкий скандал. По версии следствия, бывший сотрудник ФБР перевел себе почти $925 тысяч с криптокошельков, доступ к которым получил во время расследования. Перед арестом он консультировался с ChatGPT, спрашивая, как переехать в Европу с миллионом долларов и где лучше нач…

AirPods Pro 3 получили перевод в реальном времени — но Apple ли тут первооткрыватель?

Наушники переводят речь на лету: шумодав блокирует собеседника → слышите перевод. Отвечаете на своём языке — iPhone переводит и показывает/озвучивает. Если у обоих есть AirPods — разговор идёт естественно, каждый на своём. 🩷 Дополнительно: датчик сердечного ритма + «умная» посадка по базе…

72 актуальные нейросети на все случаи жизни

В Твиттере собрали лучшие ИИ-сервисы по категориям: генерация картинок и видео, написание текста, инструменты для исследований и многое другое. 🤖🖼️📝🔬 Сохраняем! 📌