Текст в 3D-сцену нейросетью: повторяем эксперимент Карпаты на Claude Opus 5 (2026)
Андрей Карпаты скормил Claude Opus 5 первый абзац «Властелина колец» и получил 3D-мир в браузере: 5500 строк кода, два часа, 10 долларов. Разбираем, как повторить это без навыков программирования, с готовыми промптами, ценами в рублях и своим тестом моделей.
15 мин чтения
Нейросеть умеет превратить абзац текста в трёхмерную сцену, которая крутится в браузере. Работает это так: модель не рисует 3D напрямую, она пишет код на Three.js, а код уже строит ландшафт, объекты, свет и движение камеры. Ты даёшь описание словами, получаешь один HTML-файл и открываешь его двойным кликом.
2 августа 2026 Андрей Карпаты, сооснователь OpenAI, показал самый громкий пример такого подхода. Он дал Claude Opus 5 первый абзац «Властелина колец», бюджет в миллион токенов и просьбу отрендерить это через Three.js. Модель работала около двух часов и написала 5500 строк кода, которые процедурно построили Шир. Счёт вышел примерно на 10 долларов. Ниже разберём, как повторить такое без единой строки кода, сколько это стоит в рублях и как заодно сравнить между собой Claude, ChatGPT и Qwen на одной задаче.
Чтобы получить 3D-сцену из текста, не нужны 3D-редакторы и навыки программирования: ты описываешь мир словами, модель пишет код на Three.js, браузер показывает результат. Эксперимент Карпаты с абзацем Толкина обошёлся примерно в 10 долларов и занял два часа машинного времени. Из России нужен VPN и подписка Claude Pro или Max, платить проще через посредника за рубли. Главное ограничение сидит в проверке: фантазии у модели хватает, но смотреть собственное видео она пока не умеет и правит сцену по скриншотам вслепую.
Коротко: пять слов, без которых дальше непонятно
- Three.js - библиотека 3D-графики для браузера. Подключается одной строкой и умеет рисовать сцену, камеру, свет и объекты силами видеокарты.
- Процедурная генерация - когда объект считают формулой прямо в коде, вместо того чтобы грузить готовым файлом. Холм, трава, туман, звук ветра: всё это математика.
- Вайб-тест (vibe check) - простая задача с наглядным результатом, по которой на глаз сравнивают модели. Строгим бенчмарком не считается, зато разницу видно сразу.
- Токен-бюджет - потолок, который ты ставишь модели заранее: «работай, пока не потратишь миллион токенов». Так задача перестаёт быть одним ответом и становится долгой сессией.
- Ваншот (one-shot) - результат с первого запроса, без правок и уточнений.
Что именно сделал Карпаты
Промпт был устроен предельно скупо. На вход пошёл первый абзац первой главы «Братства кольца», та самая «A Long-expected Party». Дальше три условия: рендерить через Three.js, расставлять полигональные объекты по координатам самостоятельно, укладываться в бюджет одного миллиона токенов.
Opus went off for ~2 hours and wrote 5500 lines of code that (procedurally) rendered the story.
- Андрей Карпаты, по материалам The Decoder
Никаких готовых 3D-моделей, текстур и звуков модель не получала. Всё, что видно на сцене, посчитано кодом: рельеф, деревья, домики, свет, движение камеры. Озвучку Карпаты добавил отдельно через Eleven Labs, само видео и исходники он выложил на karpathy.ai/lotr-movie.
Собственная оценка автора звучит трезво: «It’s kind of janky but fun», грубовато, но занятно. И это честная планка ожиданий. Речь про наглядную демонстрацию возможностей, до кинематографа тут далеко.
написала модель за одну сессию по одному абзацу текста
непрерывной автономной работы без участия человека
стоил миллион токенов бюджета, это около 900-1000 рублей
Почему «пеликан на велосипеде» отправился на пенсию
У сообщества давно есть традиция проверять новые модели на одной наглядной задачке. В 2023 году исследователи Microsoft в работе Sparks of AGI просили GPT-4 нарисовать единорога на языке TikZ: получались кривые кляксы, но по ним было видно, что модель хоть как-то представляет себе пространство. Потом эстафету перехватил разработчик Саймон Уиллисон со своим пеликаном на велосипеде в формате SVG. Каждый релиз он прогонял через один и тот же запрос и выкладывал картинку, а читатели сравнивали.
Карпаты говорит, что эта эпоха заканчивается.
We’re starting to leave the territory where you’d test an LLM by e.g. ‘create an svg of pelican on a bicycle’.
- Андрей Карпаты, по материалам The Decoder
Логика простая. Пеликан проверяет один рывок: что модель выдаст за один ответ. Современные модели тянут другое, и вторая цитата Карпаты объясняет что именно: «LLMs have all the stamina and patience in the world». У них бесконечный запас усидчивости. Поэтому осмысленный тест теперь измеряет длинную работу: держит ли модель задачу два часа, укладывается ли в бюджет, замечает ли собственные косяки и чинит ли их сама.
Это ровно та же история, что и с играми: мы разбирали её в гайде про 3D-игры одним промптом на Claude Opus 5. Разница в том, что игра проверяет управление и физику, а сцена по литературному тексту проверяет понимание описания.
Что проверял пеликан
- один ответ, одна попытка
- секунды работы
- копейки по деньгам
- есть ли у модели пространственное чутьё
Что проверяет сцена по абзацу
- часы автономной работы
- сотни правок в одной сессии
- дисциплина по бюджету токенов
- умение заметить и починить свой косяк
Такие эксперименты выглядят магией ровно до момента, когда ты один раз сам провёл сессию от начала до конца. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.
Пройти мини-курс →Как повторить эксперимент без навыков программирования
Разберём по шагам. Программировать не придётся ни на одном из них: код ты вообще не открываешь, все правки просишь словами.
Выбрать текст ≈ 2 мин
- абзац на 60-150 слов с описанием места
- подойдёт классика, свой рассказ, описание города детства
- чем больше конкретики про рельеф, свет и погоду, тем лучше
Отправить промпт ≈ 1 мин
- открыть чат Claude, выбрать модель Opus 5
- вставить промпт из блока ниже, подставив свой абзац
- дальше просто ждать
Дождаться сборки от 5 мин до 2 часов
- простая сцена собирается за один длинный ответ
- богатая сцена требует долгой сессии с правками
- артефакт в чате запускается сразу, кликать можно на ходу
Довести правками ≈ 20 мин
- «туман гуще», «камера медленнее», «добавь рассвет»
- каждую правку смотреть глазами в артефакте
- удачную версию сохранить отдельным файлом
Сохранить и выложить ≈ 5 мин
- скачать HTML-файл из артефакта
- открыть двойным кликом, проверить в браузере
- залить на бесплатный хостинг, чтобы скинуть ссылку
Базовый промпт: абзац текста в 3D-сцену
Это рабочая заготовка. Меняешь только текст в квадратных скобках.
Ты собираешь трёхмерную сцену по литературному описанию. Текст-источник: "[ВСТАВЬ СВОЙ АБЗАЦ, 60-150 СЛОВ]" Задача: отрендерить это описание как анимированную 3D-сцену в браузере через Three.js. Правила: 1. Один самодостаточный HTML-файл. Никаких внешних картинок, моделей и звуков: всё генерируй процедурно кодом. 2. Внимательно прочитай текст и вытащи из него: рельеф, время суток, погоду, ключевые объекты, настроение. Каждую деталь из текста отрази на сцене. 3. Расставь объекты по координатам x, y, z сам. Продумай композицию: передний план, средний, дальний. 4. Свет и туман подбери под настроение текста, не под техническую задачу. 5. Камера двигается плавно по заранее заданному пути и показывает сцену за 40-60 секунд. 6. Внизу экрана - строка текста-источника, которая меняется по ходу пролёта камеры. Работай долго и обстоятельно. После каждого крупного блока проверяй себя вопросом: похоже ли это на то, что описано в тексте. Если нет - переделывай сразу. В конце выведи список того, что из текста ты отразил, и что решил опустить.
Последний пункт про список отражённого и опущенного стоит держать всегда. Он превращает ответ в отчёт: сразу видно, где модель прочитала текст внимательно, а где отделалась общей картинкой. По этому списку и правишь дальше.
Промпты для доводки
Первый результат почти всегда выглядит бледно. Три коротких запроса вытаскивают его на приличный уровень.
Сцена собрана, но выглядит плоско. Переработай только освещение и атмосферу: - добавь дальний туман, который сгущается с расстоянием - поставь один главный источник света под углом, как низкое солнце - добавь мягкие тени от объектов на землю - подбери цветовую гамму под настроение текста, максимум три основных цвета Геометрию и расстановку объектов не трогай.
Добавь жизни в сцену. Всё считай кодом, внешние файлы не подключай: - лёгкое покачивание растительности от ветра - медленное движение облаков или тумана - 2-3 мелкие детали, которые двигаются сами по себе - звук фона через Web Audio: синтезируй шум ветра прямо в коде Скорость всех анимаций сделай спокойной, без дёрганья.
Проверь сцену как придирчивый зритель и перечисли 5 самых заметных проблем: объекты, висящие в воздухе, пересекающиеся модели, слишком быстрая камера, пустые куски кадра, нечитаемая композиция. Сначала выведи список проблем, потом почини их по порядку. После каждой правки коротко пиши, что изменилось.
Свой вайб-тест: как честно сравнить Claude, ChatGPT и Qwen
Самое интересное начинается, когда один и тот же абзац уходит в разные модели. Тут важно не обмануть себя: если менять текст, промпт или количество правок, сравнение превращается в лотерею.
Правила чистого теста простые. Один и тот же абзац, один и тот же промпт слово в слово, ноль правок (только ваншот), одинаковое время ожидания. Смотришь результат в браузере и заполняешь табличку.
| Критерий | Что смотреть | Балл |
|---|---|---|
| Запускается ли | файл открылся, ничего не упало, экран не чёрный | 0-2 |
| Верность тексту | сколько деталей из абзаца реально видно на сцене | 0-5 |
| Композиция | есть передний и дальний план, кадр не пустой | 0-3 |
| Свет и атмосфера | сцена читается как место с настроением | 0-3 |
| Анимация | камера движется плавно, объекты живут | 0-3 |
| Косяки | висящие в воздухе объекты, пересечения, дыры в земле | минус 1 за штуку |
Что ожидаемо всплывёт по ходу. Claude Opus 5 сейчас сильнее всех в длинной автономной работе: именно на нём построен эксперимент Карпаты, и именно он держит задачу часами. GPT-5.6 быстрее выдаёт первый рабочий результат, но на длинной дистанции чаще упрощает. Qwen в этой лиге слабее по коду, зато открывается из России без VPN и не стоит ни копейки, поэтому как точка отсчёта годится отлично.
Не выкладывай результат такого теста как объективный рейтинг моделей. Одна задача, один прогон и субъективная оценка глазами - это вайб-чек, никакой не бенчмарк. Об этом честно предупреждает и сам Карпаты. Показывай это как личное впечатление, иначе в комментариях справедливо разнесут.
Если хочется системного подхода к выбору модели под код, у нас есть отдельный разбор: какой ИИ лучше для вайб-кодинга.
Где всё ломается: модель не видит, что нарисовала
Это главный вывод эксперимента, и он важнее самой картинки. Claude писал код для видео, которое сам посмотреть не мог. У модели нет возможности запустить сцену и глазами оценить результат. Ей приходится делать скриншоты в отдельных точках, разглядывать их по одному и достраивать в голове, как это выглядит в движении.
Отсюда типовые ошибки таких сцен: дерево, растущее из воздуха, камера, проезжающая сквозь холм, объект, который в статике смотрится нормально, а в движении улетает за кадр. Модель не ленится, она просто работает вслепую.
Формула: узкое место сейчас в проверке, генерация давно перестала быть проблемой. Модель напишет сколько угодно кода, но пока она не умеет смотреть на результат так, как смотришь ты, твои глаза остаются обязательной частью пайплайна.
Практический вывод для тебя простой. Не жди готового результата с первого раза и не заказывай сразу сложную сцену на десять минут пролёта. Собирай короткими кусками, смотри каждый и говори, что не так. Тот же принцип разбирали в гайде про агента, который говорит «готово», когда ничего не работает.
Эта же слепота объясняет, почему Карпаты ищет новый вайб-тест именно среди длинных задач. Короткий пеликан не показывает, умеет ли модель себя проверять. Двухчасовая сцена показывает это сразу и очень наглядно.
Сколько это стоит и как платить из России
По API Opus 5 стоит 5 долларов за миллион входных токенов и 25 за миллион выходных. Бюджет в миллион токенов, как у Карпаты, обходится примерно в 10 долларов, это около 900-1000 рублей по курсу на август 2026. Через подписку выходит спокойнее: Claude Pro стоит 20 долларов в месяц, и сцена средней сложности укладывается в обычные лимиты без отдельного счёта.
| Способ | Цена | Кому подходит |
|---|---|---|
| Claude Pro | 20 долларов в месяц | одна-две сцены в неделю, спокойный темп |
| Claude Max | от 100 долларов в месяц | долгие сессии на часы, десятки итераций |
| API по токенам | 5 и 25 долларов за миллион | разовый эксперимент с жёстким бюджетом |
| Российский агрегатор | от 990 рублей в месяц | тест без VPN и зарубежной карты |
Из России Anthropic блокирует IP-адреса, так что первым шагом нужен рабочий VPN с зарубежным адресом. Дальше два пути с оплатой. Можно взять сервис оплаты подписок, который оплатит Pro зарубежной картой за рубли (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Можно зайти через российский агрегатор нейросетей вроде BotHub или MashaGPT, там модели Claude доступны за рубли и без VPN, правда без артефактов и долгих автономных сессий. Подробности по обоим путям разобраны в гайде как оплатить Claude из России.
Если запускаешь эксперимент через API, обязательно поставь лимит расходов в личном кабинете. Формулировка «работай долго и обстоятельно» в промпте означает ровно то, что написано: модель будет жечь токены, пока не упрётся в потолок. Без потолка десятиминутный порыв вдохновения превращается в трёхзначный счёт.
Готовый HTML-файл после генерации живёт своей жизнью и никакого VPN уже не требует. Открывается на любом компьютере, работает офлайн, весит обычно меньше мегабайта.
Куда выложить готовую сцену
Файл получается один, поэтому выкладывается он в пару кликов. Бесплатного статического хостинга вроде GitHub Pages или Netlify хватает с запасом: залил, получил ссылку, скинул кому угодно. Пошагово это разобрано в гайде как выложить сайт бесплатно.
Пара вещей, о которых стоит подумать заранее. Сцена по чужому литературному тексту годится для личного эксперимента и показа друзьям, но публичная публикация с длинными цитатами из книги под защитой авторского права уже требует осторожности. Свой текст в этом смысле спокойнее, а заодно интереснее: описание бабушкиного двора превращается в 3D-мир ничуть не хуже Шира.
И второе: тяжёлые сцены на слабом ноутбуке или телефоне будут тормозить. Перед публикацией попроси модель добавить переключатель качества и урезать количество объектов в дальнем плане.
Чек-лист: что у тебя теперь есть
- Понимание, как текст превращается в 3D: модель пишет код на Three.js, браузер его исполняет.
- Готовый базовый промпт, куда подставляется твой абзац.
- Три промпта на доводку: свет, движение, поиск косяков.
- Схема честного сравнения моделей с таблицей баллов.
- Реальные цифры по стоимости: 10 долларов за миллион токенов бюджета, 20 долларов в месяц за подписку.
- Понимание главного ограничения: модель не видит свою работу и правит вслепую, поэтому проверяешь глазами ты.
- Способ выложить результат ссылкой за пять минут.
Начни с малого. Возьми любимый абзац, прогони базовый промпт без правок и посмотри, что получится с первой попытки. Даже кривой результат объясняет про текущее состояние моделей больше, чем десяток статей с бенчмарками.
Хочешь копать глубже в сторону кода без программирования, начни с вайб-кодинга для новичков, а если интересна экономика вопроса, посмотри разбор цены Claude Opus 5 и оплаты из России.
По материалам The Decoder: https://the-decoder.com/unicorn-pelican-middle-earth-openai-co-founder-karpathy-is-looking-for-the-next-ai-vibe-test/
Частые вопросы
Может ли нейросеть сделать 3D-сцену из текста?
Да. Модель не рисует 3D напрямую, она пишет код на Three.js, который строит сцену в браузере. Ты даёшь абзац описания, получаешь HTML-файл: ландшафт, объекты, свет, движение камеры. Андрей Карпаты так превратил первый абзац «Властелина колец» в анимированный мир, модель написала 5500 строк кода примерно за два часа.
Сколько стоит сгенерировать 3D-сцену через Claude?
У Карпаты миллион токенов бюджета обошёлся примерно в 10 долларов по API, это около 900-1000 рублей. Через подписку Claude Pro за 20 долларов в месяц сцена попроще выйдет в рамках обычных лимитов. Дорого получается только тогда, когда гоняешь десятки итераций с правками.
Что такое вайб-тест нейросети?
Вайб-тест (vibe check) - это простая задача с наглядным результатом, по которой на глаз сравнивают модели. Классика: нарисовать единорога в TikZ (GPT-4, 2023) и пеликана на велосипеде в SVG (тест Саймона Уиллисона). Строгим бенчмарком это не считается, зато разница между моделями видна за секунду.
Нужно ли уметь программировать, чтобы повторить эксперимент?
Нет. Ты пишешь описание сцены обычными словами, модель выдаёт готовый HTML-файл. Его сохраняешь на компьютер и открываешь двойным кликом в браузере. Код читать не нужно, правки тоже просишь словами: «сделай туман гуще», «замедли камеру».
Работает ли это из России?
Claude блокирует российские IP, поэтому нужен VPN с зарубежным адресом и подписка Pro или Max. Оплатить можно через сервис-посредник за рубли или зайти через российский агрегатор нейросетей без VPN. Готовый HTML-файл потом открывается где угодно, без всякого VPN.