Для кого этот гайд

Операторы-постановщики, продюсеры, режиссёры — все, кто планирует съёмки

Этот гайд рассчитан на специалистов, которые перед съёмочным днём обязаны ответить на вопрос: «Что именно лежит в кадре?» Оператор-постановщик, составляющий раскадровку от руки, продюсер, готовящий превиз для съёмочной группы, и режиссёр, собирающий animatic для тестовых просмотров — все они работают с одним pipeline: сценарий → раскадровка → аниматик → видео. Разница лишь в том, что AI-сервисы Suin.AI сжимают этот цикл с нескольких дней до двух часов.

Сквозной pipeline выглядит так: текстовый shot list из сценария генерируется через GPT-5.5, визуальные кадры раскадровки создаются в Nano Banana, видео-превиз собирается в Kling 3.0 или Seedance, а финальный animatic с narration и temp-музыкой собирается в CinemaDrop. Все инструменты доступны внутри воркспейса Suin.AI, нейроны расходуются по факту генерации — тариф Standard (2 690 руб/мес, 750 нейронов) покрывает полный цикл раскадровки для короткометражного проекта.


Шаблон 1: Текстовая раскадровка из сценария

Пайплайн Image → Video: раскадровки и превизы через Seedance и Kling
Пайплайн Image → Video: раскадровки и превизы через Seedance и Kling

Промпт для GPT-5.5: shot list

Первый шаг любой раскадровки — текстовый shot list, то есть перечень всех кадров сцены с указанием типа плана, движения камеры и длительности. GPT-5.5 превращает блок сценария в структурированную таблицу за один запрос. Важное правило: в промпте указывайте нотацию планов (WS/MS/MCU/CU/ECU/OTS/POV/LA/HA), которую понимает вся съёмочная группа.

Преобразуй эту сцену в shot list:

[ВСТАВЬТЕ БЛОК СЦЕНЫ ИЗ СЦЕНАРИЯ]

Для каждого кадра укажи:
- Номер кадра
- Тип плана (WS/MS/MCU/CU/ECU/OTS/POV/LA/HA)
- Описание кадра
- Движение камеры
- Длительность в секундах

Формат: таблица. Следи за драматургической логикой: 
начинай с установочного кадра, переходи к средним и 
крупным планам в моменты эмоционального нарастания.

Таблица нотации планов, которую GPT-5.5 встраивает в shot list:

ОбозначениеРасшифровкаКогда использовать
WSWide ShotУстановочный кадр, показ локации и позиции персонажа в пространстве
MSMedium ShotДиалог, поясной план — видны жесты и мимика
MCUMedium Close-UpЭмоциональная реакция, грудной план — акцент на лице
CUClose-UpКрупный план лица, детальное выражение эмоции
ECUExtreme Close-UpДеталь глаза, губ, предмета — максимальное напряжение
OTSOver-the-ShoulderПлечо одного персонажа, через него виден второй — диалоговая сцена
POVPoint of ViewТо, что видит персонаж — погружение в его восприятие
LALow AngleСъёмка снизу — героизация, власть, угроза
HAHigh AngleСъёмка сверху — уязвимость, одиночество, контроль

Пример: сцена диалога → 8 кадров с нотацией

Возьмём типичную сцену диалога из сценария: «Интерьер. Кафе. Вечер. Маша и Дима сидят за столиком у окна. Маша нервно крутит кольцо. Дима говорит что-то важное. Маша встаёт и уходит.» GPT-5.5 превращает это в восемь кадров: WS — интерьер кафе с посетителями, MS — Маша и Дима за столиком, OTS — через плечо Маши на Диму, CU — руки Маши, крутящие кольцо, MCU — лицо Димы в напряжении, MCU — лицо Маши, CU — Маша встаёт, HA — Маша уходит между столиками. Каждый кадр получает длительность 3-5 секунд, итого — 28 секунд сцены. Shot list экспортируется в таблицу и передаётся в Nano Banana для генерации визуальных кадров.


Шаблон 2: Визуальная раскадровка через Nano Banana

Промпт для 3x3 contact sheet

После текстового shot list следующий шаг — визуальные кадры. Nano Banana генерирует contact sheet сеткой 3×3, где один персонаж показан в девяти типах планов. Этот приём называется «2×2 grid hack» в профессиональной терминологии: генерация нескольких вариантов в одном запросе блокирует освещение, стиль и внешность персонажа, обеспечивая консистентность между кадрами.

Create a 3x3 cinematic storyboard contact sheet showing the SAME 
subject in the SAME environment across 9 standard film shot types. 
Strict consistency of clothing, lighting, and environment 
across ALL panels.

Row 1 (Establishing):
- Panel 1: Extreme long shot, wide establishing view
- Panel 2: Long shot, full figure visible  
- Panel 3: Medium long shot, knees up

Row 2 (Character/Core):
- Panel 4: Medium shot, waist up
- Panel 5: Medium close-up, chest up
- Panel 6: Close-up, face fills frame

Row 3 (Details & Texture):
- Panel 7: Extreme close-up, eyes only
- Panel 8: Low angle shot, heroic perspective
- Panel 9: High angle shot, vulnerable perspective

Subject: [описание персонажа — возраст, внешность, одежда]
Environment: [описание локации]
Lighting: [освещение — направление, качество, цветовая температура]
Style: Cinematic film still, [стилевой референс — например, 
"Roger Deakins cinematography"] --ar 16:9

Contact sheet даёт оператору мгновенное представление о том, как персонаж выглядит в разных планах. После этого отдельные панели кадрируются и используются как ключевые кадры раскадровки. Генерация одного contact sheet в Nano Banana расходует ~40-60 нейронов.

Итерация shot-by-shot: lock рабочие кадры, регенерируйте только проблемные

Главное правило рабочего процесса с AI-раскадровкой: никогда не перегенерировать все кадры из-за одного неудачного. После генерации contact sheet оцените каждую панель отдельно. Рабочие кадры — где композиция, освещение и персонаж соответствуют задумке — фиксируются (lock). Проблемные кадры регенерируются индивидуально с уточнённым промптом. Nano Banana поддерживает разговорное редактирование: можно указать «Keep the subject but change lighting to golden hour» — и модель сохранит персонажа, заменив только свет. Этот подход экономит до 70% нейронов по сравнению с перегенерацией всей сетки.


Шаблон 3: Видео-превиз через Kling 3.0

Промпт для видео-превиз

Kling 3.0 работает по формуле: Subject + Action/Motion + Camera Movement + Environment/Lighting + Technical Direction. Оптимальная длительность одного клипа — 5-8 секунд, на кадр приходится одно плавное движение камеры. Попытка впихнуть несколько действий или смену ракурса в один клип приводит к артефактам.

[Детальное описание субъекта и действия],
[движение камеры с модификатором скорости],
[освещение — направление, качество, цвет],
cinematic, photorealistic, 4K quality

Пример заполненного промпта:
A woman in her 30s with dark hair pulled back, wearing a 
worn navy coat, walking through a rainy city street at night, 
neon signs reflecting in puddles, slow tracking shot following 
from behind at waist level, moody blue and purple lighting 
with volumetric fog, cinematic, photorealistic, 4K quality

Генерация одного 5-секундного клипа в Kling 3.0 расходует ~80-120 нейронов. Для превиза трёх ключевых сцен (по 3-4 кадра в каждой) потребуется около 400 нейронов — укладывается в лимит тарифа Standard.

Таблица: 8 типовых камерных движений

Камерное движениеОписаниеКогда использовать в превизе
Dolly inМедленное приближение камеры к объектуЭмоциональные моменты, раскрытие персонажа, напряжение
Dolly outМедленное отдаление от объектаПоказ контекста, эпические масштабы, завершение сцены
TrackingДвижение камеры вместе с объектомСцены погони, переходы персонажа между точками
CraneВертикальное движение крана вверх/внизЭпические раскрытия пейзажа, смена перспективы
StaticСтатичная камера без движенияУстановочные кадры, диалоги, акцент на актёрской игре
PanПоворот камеры влево/вправоОбзор пространства, панорама локации, следование за объектом
HandheldРучная камера с лёгкой тряскойДокументальный стиль, экшен, хаос, присутствие в сцене
DroneВид сверху, движение беспилотникаЭпические масштабы, пейзажи, установочные кадры города/природы
Rack focusПерефокусировка с одного объекта на другойПеревод внимания между персонажами, деталью и общим планом

Золотое правило превиза: одно движение камеры на один клип. Если сцена требует dolly in, затем rack focus, затем pan — разбейте её на три отдельных 5-секундных клипа и соберите в animatic на монтаже.

Image-to-video: загрузка кадра раскадровки как start frame

Kling 3.0 поддерживает режим Image-to-Video (I2V): загружаете статичный кадр из Nano Banana как стартовый фрейм, и модель анимирует его, сохраняя композицию и стиль. Этот режим решает главную проблему AI-видео — консистентность внешности персонажа и локации между кадрами.

Рабочий процесс: сгенерируйте ключевой кадр в Nano Banana (например, «Wide shot of a lone astronaut on Mars surface, two suns setting»), загрузите его в Kling как start frame, добавьте текстовый промпт движения («camera slowly drifting from side profile to front-facing cinematic reveal, warm golden light, mountain winds»). Результат — видео, которое начинается с точной копии вашего кадра раскадровки и плавно анимирует его. Расход нейронов в I2V-режиме — на 15-20% выше стандартной генерации, но экономия на консистентности ощутима: не нужно подбирать seed или перегенерировать кадры для совпадения стиля.


Шаблон 4: Анимация заставки через Seedance

Timeline prompting: разбивка по времени для драматургии

Seedance отличается от Kling поддержкой timeline prompting — временной разбивки промпта по секундам. Вместо одного описания на весь клип вы указываете, что происходит в каждый момент времени. Это даёт режиссёрский контроль над драматургией заставки.

[0s] Wide shot: A figure in a long coat stands at the end of 
an empty rain-slicked city street at night. Camera is static, 
framed from behind the figure. Neon signs reflect in puddles. 
High-contrast, low-key lighting.

[3s] Slow dolly forward begins, camera closing in on the figure 
from behind. Rain falls in foreground, shallow depth of field 
with bokeh streetlights.

[6s] Camera continues push in, now at medium shot. The figure 
turns their head slightly — profile barely visible. Tension holds.

[8s] Rack focus: background city blur sharpens briefly, then 
returns to subject.

Cinematic, 35mm film grain, desaturated with cold blue tones, 
anamorphic lens flare from streetlights.

Timeline prompting работает для клипов длительностью 8-12 секунд. Каждая временная метка [Ns] привязана к конкретному кадру и движению, что позволяет собирать многошотовые заставки с кинематографической драматургией. Seedance также поддерживает начальный и конечный кадр — можно загрузить первый кадр из Nano Banana и указать, к какому финальному кадру должно прийти видео.

Пример: заставка с актёрами в главной роли — анимация фото в кинематографичное видео

Типичная задача для продакшена — заставка, где актёры проекта показаны в кинематографичном формате. Рабочий процесс: фотография актёра (кастинговый снимок или кадр из тестовой съёмки) загружается в Seedance как start frame, timeline prompting задаёт движение от статичного портрета к драматичному раскрытию.

Start frame: [фотография актёра — крупный план]

[0s] Close-up of actor's face, static camera, soft Rembrandt 
lighting, neutral expression.

[2s] Slow dolly in, eyes begin to show emotion — intensity builds.

[4s] Slight pan to the right as actor turns head toward light 
source, golden hour rim lighting catches hair and cheekbone.

[6s] Rack focus from eyes to background — soft bokeh reveals 
city skyline at dusk.

Cinematic portrait, 85mm lens, shallow depth of field, 
Kodak Vision3 500T film look, subtle grain, warm amber 
and cool blue contrast.

Такой подход превращает статичные фотографии в живые вступительные кадры. Несколько таких клипов (по одному на каждого актёра) собираются в единую заставку в CinemaDrop с добавлением temp-музыки и титров. Seedance генерирует органичное движение волос, ткани одежды и воды — это его ключевое преимущество перед другими видеомоделями.

Таблица: параметры для разных форматов

ФорматСоотношениеМодельДлительностьПрименение
Кино / ТВ16:9Kling 3.0 / Seedance5-12 сек/клипПолнометражное кино, сериалы, рекламные ролики
Анаморфотное21:9Seedance8-15 сек/клипЭпические заставки, трейлеры, широкий формат
Reels / Stories9:16Kling 3.03-5 сек/клипПромо в соцсетях, вертикальный контент
Квадрат1:1Kling 3.03-5 сек/клипInstagram-посты, превью, миниатюры

При выборе формата учитывайте, что Kling 3.0 показывает лучшие результаты в вертикальных и стандартных форматах при работе с человеческой мимикой и движением, тогда как Seedance выигрывает в широкоформатных кинематографических заставках с timeline prompting. Для кино-превиза используйте 16:9 — это стандарт, который понимает вся съёмочная группа без дополнительных пояснений.


Быстрый старт: раскадровка за 2 часа

Шаг 1: Текстовый shot list из сценария (20 минут)

Откройте чат с GPT-5.5 в Suin.AI, вставьте блок сцены из сценария и запустите шаблонный промпт из раздела 5.2.1. Модель вернёт таблицу с 6-12 кадрами. Проверьте драматургическую логику: установочный кадр должен идти первым, крупные планы — в моменты эмоционального пика, последний кадр должен давать визуальное завершение сцене. Если shot list требует корректировки — уточните в том же чате: «Добавь OTS после кадра 3» или «Удлини dolly in в кадре 7 до 4 секунд». GPT-5.5 перестроит таблицу в контексте предыдущего запроса.

Шаг 2: Визуальные кадры для ключевых сцен (40 минут)

Перейдите в MediaLab, выберите Nano Banana. Сгенерируйте 3×3 contact sheet для главного персонажа (промпт из раздела 5.3.1). Оцените панели, зафиксируйте рабочие, регенерируйте проблемные. Затем для каждого кадра из shot list сгенерируйте отдельный кадр раскадровки, используя нотацию из таблицы: «WS: abandoned warehouse exterior at night, wet pavement, single streetlamp» или «MCU: character chest-up, emotional reaction, tears forming, shallow depth of field». Генерируйте кадры пакетно по 3-4 за раз с единым системным промптом, фиксирующим стиль — это сохранит консистентность освещения и палитры.

Шаг 3: Видео-превиз для 3 ключевых сцен (40 минут)

Выберите три самых важных кадра раскадровки (обычно это установочный кадр, эмоциональный пик и финальный аккорд сцены). Для каждого кадра создайте 5-8 секундный видеоклип в Kling 3.0, используя шаблонный промпт из раздела 5.4.1 с указанием конкретного камерного движения из таблицы. Для максимальной консистентности используйте режим Image-to-Video: загрузите кадр из Nano Banana как start frame. Не пытайтесь уместить всю сцену в один клип — один кадр, одно движение, одна эмоция.

Шаг 4: Сборка animatic с narration (20 минут)

Загрузите кадры раскадровки и видеоклипы в CinemaDrop в правильной последовательности согласно shot list. Добавьте временные метки длительности из таблицы GPT-5.5. Для narration используйте VibeVoice TTS: вставьте текст сценария, выберите голос, экспортируйте аудиодорожку. CinemaDrop синхронизирует кадры с narration и temp-музыкой, создавая полноценный animatic — черновую версию сцены, которую можно показать режиссёру, продюсеру или клиенту для согласования.

Полный цикл — от сценария до animatic — занимает ровно два часа. Сравните: традиционный процесс с ручной раскадровкой художника занимает 2-3 дня и стоит от 15 000 руб за сцену. AI-раскадровка в Suin.AI сокращает время в 12 раз и укладывается в 300-500 нейронов на полноценный превиз одной сцены.