«Неуклюже, но интересно»: соучредитель OpenAI показал, как ИИ сгенерировал 3D-мир за 2 часа
«Неуклюже, но интересно»: соучредитель OpenAI показал, как ИИ сгенерировал 3D-мир за 2 часа

«Неуклюже, но интересно»: соучредитель OpenAI показал, как ИИ сгенерировал 3D-мир за 2 часа

«Неуклюже, но интересно»: соучредитель OpenAI показал, как ИИ сгенерировал 3D-мир за 2 часа

Компания Anthropic создала интерактивную визуализацию начала «Властелина колец» на JavaScript.

Соучредитель OpenAI и исследователь в области искусственного интеллекта Андрей Карпаты считает, что крупные языковые модели (large language models, LLM) выходят за пределы привычных тестов, таких как генерация отдельных изображений или написание короткого кода, и переходят на новый этап развития. К такому выводу он пришёл после эксперимента, в котором Claude Opus 5 за два часа создал интерактивную визуализацию начала романа «Властелин колец».

Чтобы проверить возможности модели компании Anthropic, Карпаты предоставил ей первый абзац романа «Властелин колец», бюджет в один миллион токенов (около 10 долларов) и попросил создать три JavaScript-версии текста. Claude Opus 5 работал примерно два часа и написал более 5500 строк кода, которые процедурно воспроизводили историю в виде трехмерной анимированной сцены.

«Получилось немного неуклюже, но интересно. Однако немного поражает то, что LLM должен размещать и координировать различные полигональные объекты по координатам (x, y, z) и писать код, который всё это анимирует, и что он вообще что-то делает», — написал Карпати в социальной сети X.

По мнению исследователя, подобные эксперименты демонстрируют новый класс применений ИИ. Если раньше создание столь узкоспециализированных проектов было слишком дорогостоящим и длительным, то теперь LLM способны выполнять такую работу практически без дополнительных затрат времени.

Карпаты считает, что следующим шагом может стать создание полностью персонализированных интерактивных миров. Он предположил, что пользователи смогут погружаться в истории вроде «Властелина колец» в качестве полноценных персонажей или сторонних наблюдателей. Исследователь сравнил это с возможностью создавать эфемерные игровые миры, подобные GTA, но сгенерированные ИИ под конкретного пользователя.

В то же время эксперимент выявил и слабые стороны современных LLM. По словам Карпаты, Claude Opus 5 не способен естественно взаимодействовать с видео или игровой средой, поэтому ему приходилось проверять результаты своей работы с помощью большого количества скриншотов, из-за чего в итоговой визуализации остались ошибки.

«(Opus 5) несколько раз допустил ошибки, что привело к появлению немалого количества неровностей. Это пример нереализованных возможностей (мультимодальность, игровой процесс), которых, на мой взгляд, все еще явно не хватает», — подытожил исследователь.

Карпат провёл эксперимент вскоре после того, как Anthropic заявила, что её ИИ-модели во время испытаний по кибербезопасности в среде компании Irregular вышли за пределы изолированного пространства и взломали реальные системы трёх внешних организаций. Инцидент произошел из-за того, что модели восприняли реальную инфраструктуру в интернете как часть учебного задания типа «захват флага», использовав для проникновения базовые хакерские методы, такие как подбор слабых паролей.

Источник материала
loader
loader