Для кого этот гайд
Операторы-постановщики, продюсеры, режиссёры — все, кто планирует съёмки
Этот гайд рассчитан на специалистов, которые перед съёмочным днём обязаны ответить на вопрос: «Что именно лежит в кадре?» Оператор-постановщик, составляющий раскадровку от руки, продюсер, готовящий превиз для съёмочной группы, и режиссёр, собирающий animatic для тестовых просмотров — все они работают с одним pipeline: сценарий → раскадровка → аниматик → видео. Разница лишь в том, что AI-сервисы Suin.AI сжимают этот цикл с нескольких дней до двух часов.
Сквозной pipeline выглядит так: текстовый shot list из сценария генерируется через GPT-5.5, визуальные кадры раскадровки создаются в Nano Banana, видео-превиз собирается в Kling 3.0 или Seedance, а финальный animatic с narration и temp-музыкой собирается в CinemaDrop. Все инструменты доступны внутри воркспейса Suin.AI, нейроны расходуются по факту генерации — тариф Standard (2 690 руб/мес, 750 нейронов) покрывает полный цикл раскадровки для короткометражного проекта.
Шаблон 1: Текстовая раскадровка из сценария

Промпт для GPT-5.5: shot list
Первый шаг любой раскадровки — текстовый shot list, то есть перечень всех кадров сцены с указанием типа плана, движения камеры и длительности. GPT-5.5 превращает блок сценария в структурированную таблицу за один запрос. Важное правило: в промпте указывайте нотацию планов (WS/MS/MCU/CU/ECU/OTS/POV/LA/HA), которую понимает вся съёмочная группа.
Преобразуй эту сцену в shot list:
[ВСТАВЬТЕ БЛОК СЦЕНЫ ИЗ СЦЕНАРИЯ]
Для каждого кадра укажи:
- Номер кадра
- Тип плана (WS/MS/MCU/CU/ECU/OTS/POV/LA/HA)
- Описание кадра
- Движение камеры
- Длительность в секундах
Формат: таблица. Следи за драматургической логикой:
начинай с установочного кадра, переходи к средним и
крупным планам в моменты эмоционального нарастания.Таблица нотации планов, которую GPT-5.5 встраивает в shot list:
| Обозначение | Расшифровка | Когда использовать |
|---|---|---|
| WS | Wide Shot | Установочный кадр, показ локации и позиции персонажа в пространстве |
| MS | Medium Shot | Диалог, поясной план — видны жесты и мимика |
| MCU | Medium Close-Up | Эмоциональная реакция, грудной план — акцент на лице |
| CU | Close-Up | Крупный план лица, детальное выражение эмоции |
| ECU | Extreme Close-Up | Деталь глаза, губ, предмета — максимальное напряжение |
| OTS | Over-the-Shoulder | Плечо одного персонажа, через него виден второй — диалоговая сцена |
| POV | Point of View | То, что видит персонаж — погружение в его восприятие |
| LA | Low Angle | Съёмка снизу — героизация, власть, угроза |
| HA | High Angle | Съёмка сверху — уязвимость, одиночество, контроль |
Пример: сцена диалога → 8 кадров с нотацией
Возьмём типичную сцену диалога из сценария: «Интерьер. Кафе. Вечер. Маша и Дима сидят за столиком у окна. Маша нервно крутит кольцо. Дима говорит что-то важное. Маша встаёт и уходит.» GPT-5.5 превращает это в восемь кадров: WS — интерьер кафе с посетителями, MS — Маша и Дима за столиком, OTS — через плечо Маши на Диму, CU — руки Маши, крутящие кольцо, MCU — лицо Димы в напряжении, MCU — лицо Маши, CU — Маша встаёт, HA — Маша уходит между столиками. Каждый кадр получает длительность 3-5 секунд, итого — 28 секунд сцены. Shot list экспортируется в таблицу и передаётся в Nano Banana для генерации визуальных кадров.
Шаблон 2: Визуальная раскадровка через Nano Banana
Промпт для 3x3 contact sheet
После текстового shot list следующий шаг — визуальные кадры. Nano Banana генерирует contact sheet сеткой 3×3, где один персонаж показан в девяти типах планов. Этот приём называется «2×2 grid hack» в профессиональной терминологии: генерация нескольких вариантов в одном запросе блокирует освещение, стиль и внешность персонажа, обеспечивая консистентность между кадрами.
Create a 3x3 cinematic storyboard contact sheet showing the SAME
subject in the SAME environment across 9 standard film shot types.
Strict consistency of clothing, lighting, and environment
across ALL panels.
Row 1 (Establishing):
- Panel 1: Extreme long shot, wide establishing view
- Panel 2: Long shot, full figure visible
- Panel 3: Medium long shot, knees up
Row 2 (Character/Core):
- Panel 4: Medium shot, waist up
- Panel 5: Medium close-up, chest up
- Panel 6: Close-up, face fills frame
Row 3 (Details & Texture):
- Panel 7: Extreme close-up, eyes only
- Panel 8: Low angle shot, heroic perspective
- Panel 9: High angle shot, vulnerable perspective
Subject: [описание персонажа — возраст, внешность, одежда]
Environment: [описание локации]
Lighting: [освещение — направление, качество, цветовая температура]
Style: Cinematic film still, [стилевой референс — например,
"Roger Deakins cinematography"] --ar 16:9Contact sheet даёт оператору мгновенное представление о том, как персонаж выглядит в разных планах. После этого отдельные панели кадрируются и используются как ключевые кадры раскадровки. Генерация одного contact sheet в Nano Banana расходует ~40-60 нейронов.
Итерация shot-by-shot: lock рабочие кадры, регенерируйте только проблемные
Главное правило рабочего процесса с AI-раскадровкой: никогда не перегенерировать все кадры из-за одного неудачного. После генерации contact sheet оцените каждую панель отдельно. Рабочие кадры — где композиция, освещение и персонаж соответствуют задумке — фиксируются (lock). Проблемные кадры регенерируются индивидуально с уточнённым промптом. Nano Banana поддерживает разговорное редактирование: можно указать «Keep the subject but change lighting to golden hour» — и модель сохранит персонажа, заменив только свет. Этот подход экономит до 70% нейронов по сравнению с перегенерацией всей сетки.
Шаблон 3: Видео-превиз через Kling 3.0
Промпт для видео-превиз
Kling 3.0 работает по формуле: Subject + Action/Motion + Camera Movement + Environment/Lighting + Technical Direction. Оптимальная длительность одного клипа — 5-8 секунд, на кадр приходится одно плавное движение камеры. Попытка впихнуть несколько действий или смену ракурса в один клип приводит к артефактам.
[Детальное описание субъекта и действия],
[движение камеры с модификатором скорости],
[освещение — направление, качество, цвет],
cinematic, photorealistic, 4K quality
Пример заполненного промпта:
A woman in her 30s with dark hair pulled back, wearing a
worn navy coat, walking through a rainy city street at night,
neon signs reflecting in puddles, slow tracking shot following
from behind at waist level, moody blue and purple lighting
with volumetric fog, cinematic, photorealistic, 4K qualityГенерация одного 5-секундного клипа в Kling 3.0 расходует ~80-120 нейронов. Для превиза трёх ключевых сцен (по 3-4 кадра в каждой) потребуется около 400 нейронов — укладывается в лимит тарифа Standard.
Таблица: 8 типовых камерных движений
| Камерное движение | Описание | Когда использовать в превизе |
|---|---|---|
| Dolly in | Медленное приближение камеры к объекту | Эмоциональные моменты, раскрытие персонажа, напряжение |
| Dolly out | Медленное отдаление от объекта | Показ контекста, эпические масштабы, завершение сцены |
| Tracking | Движение камеры вместе с объектом | Сцены погони, переходы персонажа между точками |
| Crane | Вертикальное движение крана вверх/вниз | Эпические раскрытия пейзажа, смена перспективы |
| Static | Статичная камера без движения | Установочные кадры, диалоги, акцент на актёрской игре |
| Pan | Поворот камеры влево/вправо | Обзор пространства, панорама локации, следование за объектом |
| Handheld | Ручная камера с лёгкой тряской | Документальный стиль, экшен, хаос, присутствие в сцене |
| Drone | Вид сверху, движение беспилотника | Эпические масштабы, пейзажи, установочные кадры города/природы |
| Rack focus | Перефокусировка с одного объекта на другой | Перевод внимания между персонажами, деталью и общим планом |
Золотое правило превиза: одно движение камеры на один клип. Если сцена требует dolly in, затем rack focus, затем pan — разбейте её на три отдельных 5-секундных клипа и соберите в animatic на монтаже.
Image-to-video: загрузка кадра раскадровки как start frame
Kling 3.0 поддерживает режим Image-to-Video (I2V): загружаете статичный кадр из Nano Banana как стартовый фрейм, и модель анимирует его, сохраняя композицию и стиль. Этот режим решает главную проблему AI-видео — консистентность внешности персонажа и локации между кадрами.
Рабочий процесс: сгенерируйте ключевой кадр в Nano Banana (например, «Wide shot of a lone astronaut on Mars surface, two suns setting»), загрузите его в Kling как start frame, добавьте текстовый промпт движения («camera slowly drifting from side profile to front-facing cinematic reveal, warm golden light, mountain winds»). Результат — видео, которое начинается с точной копии вашего кадра раскадровки и плавно анимирует его. Расход нейронов в I2V-режиме — на 15-20% выше стандартной генерации, но экономия на консистентности ощутима: не нужно подбирать seed или перегенерировать кадры для совпадения стиля.
Шаблон 4: Анимация заставки через Seedance
Timeline prompting: разбивка по времени для драматургии
Seedance отличается от Kling поддержкой timeline prompting — временной разбивки промпта по секундам. Вместо одного описания на весь клип вы указываете, что происходит в каждый момент времени. Это даёт режиссёрский контроль над драматургией заставки.
[0s] Wide shot: A figure in a long coat stands at the end of
an empty rain-slicked city street at night. Camera is static,
framed from behind the figure. Neon signs reflect in puddles.
High-contrast, low-key lighting.
[3s] Slow dolly forward begins, camera closing in on the figure
from behind. Rain falls in foreground, shallow depth of field
with bokeh streetlights.
[6s] Camera continues push in, now at medium shot. The figure
turns their head slightly — profile barely visible. Tension holds.
[8s] Rack focus: background city blur sharpens briefly, then
returns to subject.
Cinematic, 35mm film grain, desaturated with cold blue tones,
anamorphic lens flare from streetlights.Timeline prompting работает для клипов длительностью 8-12 секунд. Каждая временная метка [Ns] привязана к конкретному кадру и движению, что позволяет собирать многошотовые заставки с кинематографической драматургией. Seedance также поддерживает начальный и конечный кадр — можно загрузить первый кадр из Nano Banana и указать, к какому финальному кадру должно прийти видео.
Пример: заставка с актёрами в главной роли — анимация фото в кинематографичное видео
Типичная задача для продакшена — заставка, где актёры проекта показаны в кинематографичном формате. Рабочий процесс: фотография актёра (кастинговый снимок или кадр из тестовой съёмки) загружается в Seedance как start frame, timeline prompting задаёт движение от статичного портрета к драматичному раскрытию.
Start frame: [фотография актёра — крупный план]
[0s] Close-up of actor's face, static camera, soft Rembrandt
lighting, neutral expression.
[2s] Slow dolly in, eyes begin to show emotion — intensity builds.
[4s] Slight pan to the right as actor turns head toward light
source, golden hour rim lighting catches hair and cheekbone.
[6s] Rack focus from eyes to background — soft bokeh reveals
city skyline at dusk.
Cinematic portrait, 85mm lens, shallow depth of field,
Kodak Vision3 500T film look, subtle grain, warm amber
and cool blue contrast.Такой подход превращает статичные фотографии в живые вступительные кадры. Несколько таких клипов (по одному на каждого актёра) собираются в единую заставку в CinemaDrop с добавлением temp-музыки и титров. Seedance генерирует органичное движение волос, ткани одежды и воды — это его ключевое преимущество перед другими видеомоделями.
Таблица: параметры для разных форматов
| Формат | Соотношение | Модель | Длительность | Применение |
|---|---|---|---|---|
| Кино / ТВ | 16:9 | Kling 3.0 / Seedance | 5-12 сек/клип | Полнометражное кино, сериалы, рекламные ролики |
| Анаморфотное | 21:9 | Seedance | 8-15 сек/клип | Эпические заставки, трейлеры, широкий формат |
| Reels / Stories | 9:16 | Kling 3.0 | 3-5 сек/клип | Промо в соцсетях, вертикальный контент |
| Квадрат | 1:1 | Kling 3.0 | 3-5 сек/клип | Instagram-посты, превью, миниатюры |
При выборе формата учитывайте, что Kling 3.0 показывает лучшие результаты в вертикальных и стандартных форматах при работе с человеческой мимикой и движением, тогда как Seedance выигрывает в широкоформатных кинематографических заставках с timeline prompting. Для кино-превиза используйте 16:9 — это стандарт, который понимает вся съёмочная группа без дополнительных пояснений.
Быстрый старт: раскадровка за 2 часа
Шаг 1: Текстовый shot list из сценария (20 минут)
Откройте чат с GPT-5.5 в Suin.AI, вставьте блок сцены из сценария и запустите шаблонный промпт из раздела 5.2.1. Модель вернёт таблицу с 6-12 кадрами. Проверьте драматургическую логику: установочный кадр должен идти первым, крупные планы — в моменты эмоционального пика, последний кадр должен давать визуальное завершение сцене. Если shot list требует корректировки — уточните в том же чате: «Добавь OTS после кадра 3» или «Удлини dolly in в кадре 7 до 4 секунд». GPT-5.5 перестроит таблицу в контексте предыдущего запроса.
Шаг 2: Визуальные кадры для ключевых сцен (40 минут)
Перейдите в MediaLab, выберите Nano Banana. Сгенерируйте 3×3 contact sheet для главного персонажа (промпт из раздела 5.3.1). Оцените панели, зафиксируйте рабочие, регенерируйте проблемные. Затем для каждого кадра из shot list сгенерируйте отдельный кадр раскадровки, используя нотацию из таблицы: «WS: abandoned warehouse exterior at night, wet pavement, single streetlamp» или «MCU: character chest-up, emotional reaction, tears forming, shallow depth of field». Генерируйте кадры пакетно по 3-4 за раз с единым системным промптом, фиксирующим стиль — это сохранит консистентность освещения и палитры.
Шаг 3: Видео-превиз для 3 ключевых сцен (40 минут)
Выберите три самых важных кадра раскадровки (обычно это установочный кадр, эмоциональный пик и финальный аккорд сцены). Для каждого кадра создайте 5-8 секундный видеоклип в Kling 3.0, используя шаблонный промпт из раздела 5.4.1 с указанием конкретного камерного движения из таблицы. Для максимальной консистентности используйте режим Image-to-Video: загрузите кадр из Nano Banana как start frame. Не пытайтесь уместить всю сцену в один клип — один кадр, одно движение, одна эмоция.
Шаг 4: Сборка animatic с narration (20 минут)
Загрузите кадры раскадровки и видеоклипы в CinemaDrop в правильной последовательности согласно shot list. Добавьте временные метки длительности из таблицы GPT-5.5. Для narration используйте VibeVoice TTS: вставьте текст сценария, выберите голос, экспортируйте аудиодорожку. CinemaDrop синхронизирует кадры с narration и temp-музыкой, создавая полноценный animatic — черновую версию сцены, которую можно показать режиссёру, продюсеру или клиенту для согласования.
Полный цикл — от сценария до animatic — занимает ровно два часа. Сравните: традиционный процесс с ручной раскадровкой художника занимает 2-3 дня и стоит от 15 000 руб за сцену. AI-раскадровка в Suin.AI сокращает время в 12 раз и укладывается в 300-500 нейронов на полноценный превиз одной сцены.



