Opus 5 написал 5500 строк кода за два часа, но пока не умеет «играть» в собственные игры

Opus 5 написал 5500 строк кода за два часа, но пока не умеет «играть» в собственные игры
 

Разработчик и исследователь ИИ Андрей Карпати показал эксперимент, который хорошо иллюстрирует нынешние возможности и ограничения передовых языковых моделей. Он поручил Claude Opus 5 превратить фрагмент первой главы «Властелина колец» в трёхмерную сцену на Three.js, выделив модели бюджет в один миллион токенов — по его оценке, около 10 долларов.

Модель работала примерно два часа и сгенерировала около 5500 строк кода. В результате появился запускаемый в браузере 3D-ролик: с домами, дорогами, растительностью, персонажами, движением камеры и анимацией, следующей за развитием сюжета. Карпати назвал работу довольно грубой, но впечатляющей: модель самостоятельно решила, какие объекты нужны сцене, где их расположить и как связать их действия во времени.

Главное отличие этого подхода от генерации видео — в том, что Opus 5 не просто создаёт последовательность пикселей. Он формирует явную программную модель мира: объекты имеют координаты, геометрию, материалы, правила движения и поведения. Такой результат можно открыть, отредактировать и развивать как обычный игровой проект.

Подобные эксперименты уже стали неформальным стресс-тестом для новых моделей. Разработчики показывали созданные с помощью Opus 5 шутеры, симуляторы сноуборда, процедурные миры в духе Minecraft и физические сцены с разрушаемыми объектами. Однако эти демонстрации пока нельзя считать строгими бенчмарками: они используют разные запросы, бюджеты токенов, условия запуска и критерии оценки.

При этом эксперимент Карпати выявил важное ограничение. Модель может написать игру, запустить её и анализировать отдельные скриншоты, но она не способна полноценно сыграть в собственный проект. Она не воспринимает непрерывное видео так же, как человек, не управляет персонажем, не чувствует задержки управления и не отслеживает ошибки, возникающие только в движении. Поэтому ей трудно заметить, что герой через несколько секунд проваливается под землю, камера резко поворачивается или физика столкновений работает неправильно.

Именно здесь проходит граница между генерацией кода и полноценным пониманием созданного мира. Современные модели уже могут долго работать над сложной задачей, координировать тысячи строк кода и собирать временные интерактивные пространства почти по одному описанию. Но для полноценного цикла «создать — запустить — наблюдать — исправить» им пока не хватает развитого видео-восприятия, понимания непрерывного состояния и способности взаимодействовать с результатом своей работы.

Эксперимент важен не только качеством 3D-сцены, но и экономикой производства. Раньше даже небольшая персональная игровая визуализация требовала работы сценариста, художника и программиста, поэтому многие узкоспециализированные идеи просто не доходили до реализации. Теперь часть таких проектов может появляться по запросу — за относительно небольшой вычислительный бюджет.

Следующий шаг для ИИ, вероятно, будет связан не столько с написанием ещё большего объёма кода, сколько со способностью действительно видеть, проверять и понимать миры, которые он сам создаёт.

БОЛЬШЕ ИНФОРМАЦИИ

Email

sms_systems@inbox.ru

Телефон

+ 7 (985) 982-70-55

Если у вас есть инновационная идея, мы будем рады реализовать ее для Вас!

Специалисты нашей кампании и наши разработки для вас!