Реалистичное AI-видео с первого раза и при чём тут Claude Code

Ты открыл пятую вкладку со сравнением нейросетей для видео. Прочитал, как запустить Claude Code в терминале, прикинул, чем платить из России, а ни одного кадра так и не сгенерировал. Знакомо? Реалистичное AI-видео получается не у того, кто нашёл «лучший» сервис, а у того, кто знает порядок действий. Ниже этот порядок, его можно пройти сегодня вечером.

Картинку делает не нейросеть, а то, что ты ей даёшь

Ролики, под которыми пишут «это же снято на камеру», выглядят так не из-за модели. Генераторы видео умеют примерно одно и то же. Разница в том, насколько точно автор объяснил, чего хочет.

Новичок пишет «девушка идёт по ночному городу, кинематографично» и получает тот самый AI-look: гладкие лица, пластиковый свет, камера плывёт без причины. Модель не угадала, потому что угадывать было не из чего.

Поэтому первый шаг вообще не про нейросеть. Пока ты не знаешь, как должен выглядеть кадр, любой сервис выдаст тебе среднее арифметическое всего интернета. И ты решишь, что выбрал не тот инструмент, и пойдёшь сравнивать дальше.

Собери доску, пока она не сузится до одного стиля

Открой Pinterest и сохраняй картинки под один конкретный вид. Не «красиво» и не «атмосферно», а конкретно: например, плёночный снимок кухни в утреннем свете, зерно, тёплые тени, чашка на подоконнике.

Сохраняй до тех пор, пока доска не перестанет быть десятью разными эстетиками и не станет одной. Проверка простая: листаешь её, и кажется, что всё снял один фотограф в один день.

Пока листаешь, выпиши, что именно объединяет картинки. Это потом станет словами промпта:

  • свет: откуда падает, тёплый или холодный, жёсткий или рассеянный;
  • цвет: какие оттенки повторяются, насколько приглушены;
  • фактуры и одежда: лён, шерсть, мокрый асфальт, потёртое дерево;
  • камера: с какого расстояния снято, на уровне глаз или сверху;
  • зерно и резкость: чистая цифра или плёнка с шумом.

В генератор потом отдаёшь несколько сильных референсов, а не один. С единственной картинкой модель смягчает образ: берёт общее настроение и теряет детали, ради которых ты эту картинку выбрал. Три-четыре похожих референса подтверждают друг друга, и модель понимает, что именно в них главное.

Сначала неподвижный кадр в низком разрешении

Не прыгай сразу в видео. Сначала сделай из референсов один статичный кадр. С первого раза он, скорее всего, не получится, и это нормально: у автора поста, на который мы опирались, этот этап тоже занял несколько попыток.

Пока подбираешь формулировки, генерируй в низком разрешении. Так каждая попытка идёт быстрее, и ты не жалеешь выбросить неудачную. Полное разрешение включай только тогда, когда кадр уже выглядит как надо.

Кадр готов, когда ты кладёшь его рядом с доской и он не выбивается. Если выбивается, не переписывай промпт целиком. Меняй что-то одно, например только описание света, и смотри, что изменилось. Так ты учишься понимать, какое слово за что отвечает, и в следующий раз попадаешь быстрее.

Один длинный промпт по секундам вместо слова «кинематографично»

Когда кадр совпал с задумкой, превращаешь его в видео. Здесь главный приём: один длинный подробный промпт, где расписано всё. Движение камеры, свет, одежда и само действие по таймкодам, шаг за шагом.

Вот как это может выглядеть для той самой кухни, ролик на 8 секунд:

  • Камера: медленный наезд с уровня стола, без тряски, без резких поворотов.
  • Свет: низкое утреннее солнце слева через окно, тёплое, длинные мягкие тени, пылинки в луче.
  • Одежда: светлый льняной свитер с закатанными рукавами, на запястье тонкий браслет.
  • 0-2 с: рука ставит чашку на подоконник, от кофе поднимается пар.
  • 2-5 с: рука отодвигает занавеску, свет в кадре становится ярче.
  • 5-8 с: камера останавливается на чашке, пар уходит вверх, фон слегка размыт.

Почему это работает. Каждое решение, которое ты не принял, модель принимает за тебя, и принимает самым средним способом. Среднее и есть тот самый generic AI-look. Когда расписано по секундам, модели почти нечего додумывать, и ролик держит стиль от начала до конца.

Слова «кинематографично», «реалистично» и «4K» из такого промпта можно смело убрать. Они ничего не описывают, а описание по секундам уже делает всю работу.

Как запустить Claude Code в терминале и отдать ему эти промпты

Писать такие промпты руками долго, особенно первые разы. Тут и пригодится Claude Code: ты описываешь сцену обычными словами, а он раскладывает её по камере, свету и секундам.

Запуск короче, чем кажется, когда читаешь форумы:

  • поставь Node.js с официального сайта, если его ещё нет;
  • в терминале выполни npm install -g @anthropic-ai/claude-code (другие способы установки описаны в официальной документации Anthropic, сверься с ней, если что-то не встаёт);
  • создай папку под проект, например video, и перейди в неё командой cd video;
  • набери claude и войди в аккаунт, когда он попросит.

Дальше пишешь ему прямо в терминале: «Вот описание кадра и что общего у моих референсов. Составь промпт для генерации видео из картинки на 8 секунд: камера, свет, одежда, действие по секундам. Без слов кинематографично и реалистично. Сохрани в файл prompt-kuhnya.md».

Последняя фраза важнее, чем кажется. Промпт остаётся файлом в твоей папке, а не пропадает в истории чата. В следующий раз ты открываешь его, меняешь сцену и получаешь новый промпт за пару минут, а не собираешь всё с нуля.

Разовый приём закрывает один ролик. Если собрать из таких шагов свою систему, то есть папку с референсами, шаблоны промптов и команды, которые лежат у тебя, а не в чужом сервисе по подписке, то каждый следующий ролик собирается по той же структуре, быстрее, и вся эта система остаётся твоей.

Бесплатно · Открывается сразу

ИИ для создания контента, который приводит клиентов для твоего бизнеса

Первая фраза, которая держит зрителя, — пять типов крючков с готовыми промптами. Вставляешь свою нишу и тему в любой чат с ИИ — получаешь три варианта за 30 секунд. Бесплатно, без регистрации.

✦ Работает в любой нише ✦ Готовый промпт — работает в любом чате с ИИ ✦ 5 минут — и крючок готов ✦ Открывается сразу
Top