Ролик не собрался, а вместо него — сухая строчка про модерацию. Причём сцена была рабочая: инструктаж по технике безопасности, кулинарный рецепт, спарринг в зале, отработка удара по мешку. Ниже — как устроены фильтры Sora, что они ловят на самом деле и как переписать сцену, чтобы система прочитала ваше намерение правильно. Общая механика фильтров у всех генераторов похожа, она разобрана в отдельном материале — разбор модерации целиком; здесь речь именно про Sora, доступную из России без VPN в каталоге СуперИнтеллекта.
Где именно вас останавливают
Проверка идёт не один раз, а как минимум трижды: до генерации, во время неё и на готовых кадрах. Третий слой объясняет самое обидное — модель отработала, вы дождались прогресса, а на выдаче пришёл отказ. В API это видно по двум разным кодам: sentinel_block прилетает мгновенно, ещё до запуска, а moderation_blocked — уже после того, как задача ушла в работу, и приходит в ответе как ошибка создания видео. Первый означает «не понравился запрос», второй — «не понравилось то, что получилось».
| Слой | Когда срабатывает | Как выглядит |
|---|---|---|
| Текст промпта | до запуска, за доли секунды | sentinel_block — отказ приходит почти мгновенно, с общей формулировкой про нарушение правил, без указания категории |
| Входное изображение | при загрузке референса | отказ с указанием на людей или защищённые правами объекты в кадре |
| Кадры готового видео и звук | во время генерации и после неё | moderation_blocked — задача долго висит в работе и завершается ошибкой |
Реальные люди — главное ограничение Sora
Правило OpenAI формулируется не как «нельзя показывать лицо», а как «нельзя без согласия». Внешность и голос живого человека используются только по явному согласию, через механику cameo: человек сам записывает подтверждающий образец, сам выбирает, кому доступна его внешность, видит ролики со своим участием и может отозвать доступ. Осенью 2025 года, после публичной истории с использованием внешности актёра Брайана Крэнстона, OpenAI ужесточила эти правила совместно с профсоюзом SAG-AFTRA и агентствами — общая траектория здесь в сторону строгости, а не послаблений.
На уровне API ограничения жёстче, чем в приложении: реальные люди, включая публичных персон, не генерируются; входные изображения с человеческими лицами отклоняются; защищённые правами персонажи и музыка отклоняются. Практический вывод неприятный, но его лучше принять сразу: сценарий «загружу фотографию сотрудника и оживлю» через Sora не работает в принципе — даже если на фото вы сами и вы согласны. Переформулировкой это не лечится, лечится только другим маршрутом (о нём ниже).
Отдельная категория отказов — когда вы никого не называли, а модель дорисовала похожесть сама. Разработчики в сообществе OpenAI описывают это так: в кадре человек со спины, в промпте написано «режиссёр», модель решает, что он похож на известного режиссёра, и выходной фильтр рубит уже готовое видео. Лечится тем, что вы забираете у модели свободу выбора: задаёте возраст, телосложение, одежду, освещение — и прямо пишете, что персонаж вымышленный и не должен напоминать реальных людей.
Бренды, персонажи и музыка
Здесь фильтр работает не по списку слов. Описательный обход ловится не хуже прямого имени: «остроносый жёлтый грызун, бьющий молниями» опознаётся так же, как названный персонаж. Логотипы на загруженных референсах вычитываются отдельно, вплоть до текста на упаковке. Рабочая стратегия одна — обобщать: убрать имя, оставить функцию и внешний признак.
| Бытовая формулировка | Что писать вместо |
|---|---|
| «человек пьёт кока-колу» | «человек пьёт газировку из красной жестяной банки без надписей» |
| «на столе MacBook» | «на столе тонкий серебристый ноутбук, логотип не в кадре» |
| «кроссовки Nike, крупный план» | «беговые кроссовки без брендинга, крупный план подошвы» |
| «футболист в форме мадридского клуба» | «футболист в белой форме без клубной символики» |
| «фоном играет известный трек» | «без музыки» — звук накладываете отдельно, из лицензированной библиотеки |
| «знаменитый мультяшный мышонок машет рукой» | «мультяшный персонаж собственного дизайна: круглые уши, синий комбинезон, стиль плоской анимации» |
Насилие, эмоции и ложные срабатывания
Фильтр насилия и самоповреждения смотрит на комбинацию слов, а не на каждое по отдельности. Хрестоматийный пример: «человек стоит один на крыше ночью и смотрит вниз» — все слова безобидны, а вместе складываются в сценарий риска. Та же арифметика с эмоциональной лексикой: отчаяние, страдание, слёзы, одиночество суммируются. И помните, что Sora 2 генерирует видео со звуком: реплики персонажей проверяются наравне с картинкой, фраза в диалоге способна зарубить ролик так же, как действие в кадре.
| Бытовая формулировка | Что прочитал фильтр | Режиссёрская формулировка |
|---|---|---|
| «мужчина один на крыше ночью, смотрит вниз» | одиночество + высота + темнота + взгляд вниз = риск самоповреждения | «фотограф на смотровой площадке снимает огни города в сумерках, средний план со спины, камера медленно отъезжает» |
| «боевая сцена, драка в баре» | насилие между людьми | «постановочный трюк, каскадёры, хореография схватки, широкий план, замедленная съёмка» |
| «врач делает укол, кровь на марле» | медицинская травма, кровь | «учебная демонстрация на медицинском тренажёре, крупный план рук в перчатках, ровный студийный свет» |
| «повар режет мясо большим ножом» | нож + резать + плоть | «крупный план разделочной доски, шеф нарезает филе, съёмка сверху, кулинарная студия» |
| «ребёнок один идёт домой по тёмной улице» | несовершеннолетний в опасном контексте | «утренняя улица, группа школьников идёт по тротуару, общий план, солнечный свет» — или убрать детей из кадра |
| «kill the lights, drop dead gorgeous» | буквальные kill и dead | «свет гаснет, героиня в вечернем платье выходит в пятно софита» |
| «портрет известного предпринимателя за столом» | реальный человек, узнаваемое лицо | «вымышленный предприниматель, мужчина около 40 лет, тёмный свитер, не должен напоминать реальных людей» |
Режиссёрский язык вместо бытового
Режиссёрская лексика — не заклинание, а способ снять двусмысленность. В рекомендациях по промптам Sora прямо сказано: описывайте тип плана, субъект, действие, место, свет и движение камеры и держите сцену односоставной. Фильтр читает намерение по контексту, а контекст съёмочной площадки читается как постановка, а не как происшествие. «Удар» без контекста — насилие; «отработка удара по мешку, спортзал, дневной свет, камера по дуге» — тренировка.
Шаблон описания сцены
[Тип плана]. [Субъект без имён и брендов]. [Действие]. [Место и время суток].
[Свет]. [Движение камеры]. [Съёмочные обстоятельства: постановка / демонстрация / студия].
Средний план. Женщина-инструктор в спортивной форме без логотипов отрабатывает
удар по боксёрскому мешку. Зал с высокими окнами, утро. Мягкий дневной свет.
Камера медленно движется по дуге слева направо. Постановочная демонстрация
техники, спокойный темп, контакта с человеком нет.Та же сцена, но медицинская: было и стало
Было: Медсестра делает пациенту укол, видна кровь, пациент морщится от боли.
Стало: Крупный план рук в нитриловых перчатках. Учебная демонстрация техники
инъекции на медицинском тренажёре-руке. Кабинет доклинической практики,
ровный студийный свет, камера статична. Обучающий видеоролик, спокойный
темп, без крови и без реакции пациента.- Называйте съёмочные обстоятельства словами: постановка, каскадёры, тренажёр, манекен, студия, учебная демонстрация, реконструкция.
- Убирайте имена и бренды, оставляйте функцию и внешний признак: не «айфон», а «смартфон без логотипа в тёмном корпусе».
- Одна сцена — одно действие. Длинный многособытийный промпт чаще ловит отказ на выходе: у модели больше поводов дорисовать лишнее.
- Проговаривайте возраст и вымышленность персонажей: «взрослые, около тридцати, вымышленные, не напоминают реальных людей».
Чего в этом гайде нет
По сети ходят приёмы, которые ломают детектор лиц на входной фотографии. Мы их не приводим и не пересказываем, и причина простая: этот фильтр стоит ровно затем, чтобы нельзя было оживить чужое лицо без спроса, а любой такой приём не отличает вашу собственную фотографию от фотографии постороннего человека. Плюс систематические обходы заканчиваются перманентной блокировкой доступа к API без восстановления. Подробнее эта оговорка разобрана в общем разборе модерации. Джейлбрейк-промптов и способов протащить через фильтр откровенный контент, жестокость или реальных людей без прав здесь тоже не будет.
Законный маршрут при этом рабочий и вовсе не узкий. Снимайте своё или берите материал с оформленными правами и релизом модели. Стилизованные и нарисованные лица проходят там, где не проходит живая фотография, — это официальное поведение фильтров, а не лазейка. Персонажа проще сгенерировать с нуля, чем загружать чужой портрет. Если блокируют законную съёмку с людьми — пишите в поддержку сервиса, на корпоративных тарифах случай разбирают вручную. И меняйте модель: пороги у семейств разные, а в каталоге СуперИнтеллекта их больше 250 в одном месте.
Водяные знаки и что можно делать с результатом
OpenAI помечает то, что выходит из Sora, двумя способами: видимым движущимся водяным знаком на скачиваемых роликах и метаданными C2PA — криптографической подписью происхождения, которую читают проверочные сервисы. Заявлено, что подпись есть у всех роликов, но независимые проверки находили файлы без неё, так что относиться к метаданным как к гарантии не стоит — ни в ту, ни в другую сторону. Плюс у OpenAI есть внутренние средства детекции, которые вы со стороны не увидите.
Отсюда два практических правила. Первое: снятие водяного знака и правка метаданных нарушают условия использования, а если цель — скрыть ИИ-происхождение, добавляется уже правовой риск. Второе: площадки всё чаще требуют помечать сгенерированное видео, и метка может остаться в файле, даже если кадр вы обрежете. Планируйте проект так, чтобы маркировка не мешала: под рекламные обещания и «реальные отзывы» — своя съёмка, под графику, абстракцию, заставки и раскадровки — генерация.
Когда переформулировка не поможет
Есть категории, где переписывать промпт бессмысленно: там отказ не ошибка фильтра, а его прямая задача. Проще сразу перестроить задачу, чем потратить вечер на двадцать вариантов формулировки.
- Сексуальный контент, а тем более любые сюжеты с сексуализацией несовершеннолетних.
- Интимные изображения без согласия изображённого человека.
- Узнаваемые реальные люди без оформленного согласия — включая политиков, умерших публичных персон и исторические фигуры.
- Инструкции по изготовлению оружия и веществ, призывы к насилию.
- Точное воспроизведение чужого персонажа или музыкального трека, даже если вы описали его без имени.
- Оживление загруженной фотографии реального лица — в Sora это закрыто на уровне входного фильтра, вне зависимости от того, чьё это фото.
Если же сцена законная, а Sora всё равно упирается, самый дешёвый ход — не двадцатая переформулировка, а другая модель. В MediaLab рядом лежат Sora 2, Kling v3, Seedance 2.5, Grok Imagine и другие семейства: одну и ту же сцену можно прогнать по трём моделям и оставить ту, что прошла. Запуск видео стоит 14–67 нейронов, при курсе около 3 ₽ за нейрон перебор обходится в сотню-другую рублей, а не в потерянный день. Как запускать генерацию прямо из диалога — в материале видео в чате, а общий обзор возможностей — в что умеет чат.



