Сценарий и раскадровка в ChatGPT и DeepSeek: как превратить идею в готовый пайплайн для AI-видео
Большинство авторов видео застревают на одном и том же месте: идея есть, а на выходе получается рыхлый текст, который невозможно передать в генератор. Проблема не в нейросети, а в том, как сформулирован запрос. Ниже — рабочий подход: сначала сценарий, потом раскадровка, потом промты для каждого кадра. Всё связано и передаётся по цепочке без ручной правки.

Почему ChatGPT и DeepSeek — идеальная пара для препродакшна
Запрос вида «напиши сценарий» даёт общий текст без структуры. Его нельзя нарезать на кадры, в нём нет хронометража и полей для генератора. Чтобы двигаться дальше, вывод нужно сразу проектировать как машиночитаемый документ: с блоками, тегами и полями.
ChatGPT сильнее в креативе: придумывает неожиданные повороты, пишет живые диалоги, чувствует жанровые конвенции. DeepSeek быстрее держит длинный контекст, аккуратно собирает таблицы и JSON, отдаёт данные через API. В связке они закрывают весь этап подготовки: идея и текст — на одном, структура и автоматизация — на другом.
Работает это так: в ChatGPT вы генерируете и отбираете сценарий, в DeepSeek превращаете его в раскадровку и промты. Разделение экономит время и снижает количество правок.
Этап 1. Как превратить идею в сценарий, а не в общий текст
Хороший промт для сценария состоит из пяти частей. Без каждой из них результат теряет конкретику.
- Роль. «Ты — сценарист с опытом в рекламе для FMCG».
- Контекст. Тема, продукт, аудитория, платформа, длительность.
- Задача. «Напиши сценарий для вертикального видео на 20 секунд».
- Формат. Блоки по 5 секунд: визуал, диалог, звук.
- Ограничения. Число персонажей, локаций, реализуемость в AI.
Пример рабочего запроса: «Напиши 10 вариантов сценария рекламного ролика на 20 секунд, где рыжий кот в фартуке шеф-повара готовит суши на современной кухне. Разбей ролик на блоки по 5 секунд, для каждой сцены укажи визуал, диалог и звук. Предложи, какие нейросети подойдут для генерации каждого блока».
Из десяти вариантов выбирайте по трём критериям: попадание в бренд, реализуемость в видеогенераторе, эмоциональный отклик. Обычно два-три варианта отсеиваются сразу — в них есть сцены, которые модель не потянет (например, точная моторика рук или сложные отражения).

Этап 2. Раскадровка, которую поймёт видеогенератор
Раскадровка для AI-видео — это не набор картинок, а таблица с полями. Каждый кадр описывается однозначно, чтобы его можно было передать в следующий инструмент без пояснений.
Минимальный набор полей выглядит так: shot_number, duration, shot_size, camera_movement, visual_description, dialogue, sound, on_screen_text. В DeepSeek удобно запросить вывод сразу в JSON — тогда данные подхватит любой скрипт или плагин.
Промт для раскадровки строится по той же логике, что и для сценария. Роль: «Ты — режиссёр-раскадровщик, работающий с AI-видеогенераторами». Контекст: утверждённый сценарий и референсы по стилю. Задача: разбить сценарий на кадры с заполнением всех полей. Ограничения: соответствие хронометражу и техническая реализуемость.

Продвинутый вариант — трёхслойная система. Первый слой превращает текст в сценарий с тегами [Сцена], [Диалог], [Действие], [Закадровый голос]. Второй слой разбивает его на раскадровку с девятью колонками: номер кадра, длительность, план, движение камеры, описание, локация, звук, заметки, нарратив. Третий слой генерирует image prompt и video prompt для каждого кадра.
Пошаговая цепочка из шести промтов
Эту последовательность можно использовать как шаблон под любой проект. Меняются только тема, продукт и длительность.
- Сгенерируй 5-10 идей с кратким описанием каждой.
- Выбери лучшую идею и напиши логлайн в одном предложении.
- Напиши полный сценарий с разбивкой по блокам по 5 секунд.
- Преобразуй сценарий в раскадровку — таблица с полями shot_number, duration, shot_size, camera_movement, visual_description, dialogue, sound, on_screen_text.
- Для каждого кадра напиши image prompt.
- Для каждого кадра напиши video prompt с указанием движения камеры.
Каждый следующий промт опирается на результат предыдущего. Так вы не теряете детали и не переписываете заново весь текст, если что-то не подошло.
Кейс: реклама кофе для Telegram за 15 секунд
Разберём реальный сценарий работы. Задача — вертикальное видео для Telegram-канала, аудитория — офисные сотрудники 25-35 лет.

Промт 1: «Сгенерируй 5 идей для 15-секундного вертикального видео о кофе для Telegram-канала. Аудитория — офисные работники 25-35 лет». Промт 2: «Выбери лучшую идею и напиши логлайн». Промт 3: «Напиши сценарий по блокам: 0-5, 5-10, 10-15 секунд. Укажи визуал, диалог и звук». Промт 4: «Разбей сценарий на раскадровку: номер кадра, длительность, план, движение камеры, описание, текст на экране».
Промт 5: «Для каждого кадра напиши image prompt на русском для генератора изображений». Промт 6: «Для каждого кадра напиши video prompt для PixVerse с указанием движения камеры». На выходе — три-четыре кадра, готовых к загрузке в генераторы. Ни один не требует ручной переработки.
Автоматизация через DeepSeek и JSON
DeepSeek хорошо держит структуру и отдаёт данные в формате JSON без лишних пояснений. Это значит, что раскадровку можно сразу передать в следующий инструмент — например, в ComfyUI-плагин для сборки сторибордов. Никакой ручной перекладки из таблицы в таблицу.
Для быстрых проектов достаточно младших моделей. Для сложных сценариев с большим количеством персонажей и локаций берите старшие версии — они лучше держат причинно-следственные связи между кадрами.
Ошибки, которые ломают весь пайплайн
- Слишком общий промт — на выходе шаблонный сценарий без изюминки.
- Нет ограничения по хронометражу — сценарий не влезает в формат.
- Игнорирование возможностей видеогенератора — в кадре появляются сцены, которые модель не воспроизведёт.
- Пропуск раскадровки — переход сразу к генерации видео без плана.
- Попытка решить всё одной моделью — ChatGPT и DeepSeek сильны в разном.
Отдельно стоит сказать о хронометраже. Большинство современных видеогенераторов выдают клипы длиной от 4 до 10 секунд. Если сценарий написан блоками по 15 секунд, придётся либо резать, либо склеивать — и это лучше продумать на этапе сценария, а не после генерации.
Что делать дальше
ChatGPT и DeepSeek — не «генераторы текста», а полноценные инструменты препродакшна. Секрет в том, чтобы каждый этап выдавал машиночитаемый результат: сценарий с тегами, раскадровку с полями, промты с параметрами. Тогда цепочка работает без ручной правки.
Создайте свой шаблон промтов — шесть шагов из этой статьи подойдут как основа. Прогоните через него одно видео, потом второе. Через пару проектов вы заметите, что подготовка занимает не часы, а десятки минут. Начните с простого ролика на 15 секунд — и сразу увидите, где ваша цепочка требует доработки.
Добавить комментарий