Ролик не собрался, а вместо него — сухая строчка про модерацию. Причём сцена была рабочая: инструктаж по технике безопасности, кулинарный рецепт, спарринг в зале, отработка удара по мешку. Ниже — как устроены фильтры Sora, что они ловят на самом деле и как переписать сцену, чтобы система прочитала ваше намерение правильно. Общая механика фильтров у всех генераторов похожа, она разобрана в отдельном материале — разбор модерации целиком; здесь речь именно про Sora, доступную из России без VPN в каталоге СуперИнтеллекта.

Где именно вас останавливают

Проверка идёт не один раз, а как минимум трижды: до генерации, во время неё и на готовых кадрах. Третий слой объясняет самое обидное — модель отработала, вы дождались прогресса, а на выдаче пришёл отказ. В API это видно по двум разным кодам: sentinel_block прилетает мгновенно, ещё до запуска, а moderation_blocked — уже после того, как задача ушла в работу, и приходит в ответе как ошибка создания видео. Первый означает «не понравился запрос», второй — «не понравилось то, что получилось».

СлойКогда срабатываетКак выглядит
Текст промптадо запуска, за доли секундыsentinel_block — отказ приходит почти мгновенно, с общей формулировкой про нарушение правил, без указания категории
Входное изображениепри загрузке референсаотказ с указанием на людей или защищённые правами объекты в кадре
Кадры готового видео и звукво время генерации и после неёmoderation_blocked — задача долго висит в работе и завершается ошибкой
Три слоя проверки в Sora

Реальные люди — главное ограничение Sora

Правило OpenAI формулируется не как «нельзя показывать лицо», а как «нельзя без согласия». Внешность и голос живого человека используются только по явному согласию, через механику cameo: человек сам записывает подтверждающий образец, сам выбирает, кому доступна его внешность, видит ролики со своим участием и может отозвать доступ. Осенью 2025 года, после публичной истории с использованием внешности актёра Брайана Крэнстона, OpenAI ужесточила эти правила совместно с профсоюзом SAG-AFTRA и агентствами — общая траектория здесь в сторону строгости, а не послаблений.

На уровне API ограничения жёстче, чем в приложении: реальные люди, включая публичных персон, не генерируются; входные изображения с человеческими лицами отклоняются; защищённые правами персонажи и музыка отклоняются. Практический вывод неприятный, но его лучше принять сразу: сценарий «загружу фотографию сотрудника и оживлю» через Sora не работает в принципе — даже если на фото вы сами и вы согласны. Переформулировкой это не лечится, лечится только другим маршрутом (о нём ниже).

Отдельная категория отказов — когда вы никого не называли, а модель дорисовала похожесть сама. Разработчики в сообществе OpenAI описывают это так: в кадре человек со спины, в промпте написано «режиссёр», модель решает, что он похож на известного режиссёра, и выходной фильтр рубит уже готовое видео. Лечится тем, что вы забираете у модели свободу выбора: задаёте возраст, телосложение, одежду, освещение — и прямо пишете, что персонаж вымышленный и не должен напоминать реальных людей.

Бренды, персонажи и музыка

Здесь фильтр работает не по списку слов. Описательный обход ловится не хуже прямого имени: «остроносый жёлтый грызун, бьющий молниями» опознаётся так же, как названный персонаж. Логотипы на загруженных референсах вычитываются отдельно, вплоть до текста на упаковке. Рабочая стратегия одна — обобщать: убрать имя, оставить функцию и внешний признак.

Бытовая формулировкаЧто писать вместо
«человек пьёт кока-колу»«человек пьёт газировку из красной жестяной банки без надписей»
«на столе MacBook»«на столе тонкий серебристый ноутбук, логотип не в кадре»
«кроссовки Nike, крупный план»«беговые кроссовки без брендинга, крупный план подошвы»
«футболист в форме мадридского клуба»«футболист в белой форме без клубной символики»
«фоном играет известный трек»«без музыки» — звук накладываете отдельно, из лицензированной библиотеки
«знаменитый мультяшный мышонок машет рукой»«мультяшный персонаж собственного дизайна: круглые уши, синий комбинезон, стиль плоской анимации»
Бренд в кадре: как обобщить формулировку

Насилие, эмоции и ложные срабатывания

Фильтр насилия и самоповреждения смотрит на комбинацию слов, а не на каждое по отдельности. Хрестоматийный пример: «человек стоит один на крыше ночью и смотрит вниз» — все слова безобидны, а вместе складываются в сценарий риска. Та же арифметика с эмоциональной лексикой: отчаяние, страдание, слёзы, одиночество суммируются. И помните, что Sora 2 генерирует видео со звуком: реплики персонажей проверяются наравне с картинкой, фраза в диалоге способна зарубить ролик так же, как действие в кадре.

Бытовая формулировкаЧто прочитал фильтрРежиссёрская формулировка
«мужчина один на крыше ночью, смотрит вниз»одиночество + высота + темнота + взгляд вниз = риск самоповреждения«фотограф на смотровой площадке снимает огни города в сумерках, средний план со спины, камера медленно отъезжает»
«боевая сцена, драка в баре»насилие между людьми«постановочный трюк, каскадёры, хореография схватки, широкий план, замедленная съёмка»
«врач делает укол, кровь на марле»медицинская травма, кровь«учебная демонстрация на медицинском тренажёре, крупный план рук в перчатках, ровный студийный свет»
«повар режет мясо большим ножом»нож + резать + плоть«крупный план разделочной доски, шеф нарезает филе, съёмка сверху, кулинарная студия»
«ребёнок один идёт домой по тёмной улице»несовершеннолетний в опасном контексте«утренняя улица, группа школьников идёт по тротуару, общий план, солнечный свет» — или убрать детей из кадра
«kill the lights, drop dead gorgeous»буквальные kill и dead«свет гаснет, героиня в вечернем платье выходит в пятно софита»
«портрет известного предпринимателя за столом»реальный человек, узнаваемое лицо«вымышленный предприниматель, мужчина около 40 лет, тёмный свитер, не должен напоминать реальных людей»
Что написали → почему зарубило → что написать вместо

Режиссёрский язык вместо бытового

Режиссёрская лексика — не заклинание, а способ снять двусмысленность. В рекомендациях по промптам Sora прямо сказано: описывайте тип плана, субъект, действие, место, свет и движение камеры и держите сцену односоставной. Фильтр читает намерение по контексту, а контекст съёмочной площадки читается как постановка, а не как происшествие. «Удар» без контекста — насилие; «отработка удара по мешку, спортзал, дневной свет, камера по дуге» — тренировка.

Шаблон описания сцены

[Тип плана]. [Субъект без имён и брендов]. [Действие]. [Место и время суток].
[Свет]. [Движение камеры]. [Съёмочные обстоятельства: постановка / демонстрация / студия].

Средний план. Женщина-инструктор в спортивной форме без логотипов отрабатывает
удар по боксёрскому мешку. Зал с высокими окнами, утро. Мягкий дневной свет.
Камера медленно движется по дуге слева направо. Постановочная демонстрация
техники, спокойный темп, контакта с человеком нет.

Та же сцена, но медицинская: было и стало

Было:  Медсестра делает пациенту укол, видна кровь, пациент морщится от боли.

Стало: Крупный план рук в нитриловых перчатках. Учебная демонстрация техники
       инъекции на медицинском тренажёре-руке. Кабинет доклинической практики,
       ровный студийный свет, камера статична. Обучающий видеоролик, спокойный
       темп, без крови и без реакции пациента.
  1. Называйте съёмочные обстоятельства словами: постановка, каскадёры, тренажёр, манекен, студия, учебная демонстрация, реконструкция.
  2. Убирайте имена и бренды, оставляйте функцию и внешний признак: не «айфон», а «смартфон без логотипа в тёмном корпусе».
  3. Одна сцена — одно действие. Длинный многособытийный промпт чаще ловит отказ на выходе: у модели больше поводов дорисовать лишнее.
  4. Проговаривайте возраст и вымышленность персонажей: «взрослые, около тридцати, вымышленные, не напоминают реальных людей».

Чего в этом гайде нет

По сети ходят приёмы, которые ломают детектор лиц на входной фотографии. Мы их не приводим и не пересказываем, и причина простая: этот фильтр стоит ровно затем, чтобы нельзя было оживить чужое лицо без спроса, а любой такой приём не отличает вашу собственную фотографию от фотографии постороннего человека. Плюс систематические обходы заканчиваются перманентной блокировкой доступа к API без восстановления. Подробнее эта оговорка разобрана в общем разборе модерации. Джейлбрейк-промптов и способов протащить через фильтр откровенный контент, жестокость или реальных людей без прав здесь тоже не будет.

Законный маршрут при этом рабочий и вовсе не узкий. Снимайте своё или берите материал с оформленными правами и релизом модели. Стилизованные и нарисованные лица проходят там, где не проходит живая фотография, — это официальное поведение фильтров, а не лазейка. Персонажа проще сгенерировать с нуля, чем загружать чужой портрет. Если блокируют законную съёмку с людьми — пишите в поддержку сервиса, на корпоративных тарифах случай разбирают вручную. И меняйте модель: пороги у семейств разные, а в каталоге СуперИнтеллекта их больше 250 в одном месте.

Водяные знаки и что можно делать с результатом

OpenAI помечает то, что выходит из Sora, двумя способами: видимым движущимся водяным знаком на скачиваемых роликах и метаданными C2PA — криптографической подписью происхождения, которую читают проверочные сервисы. Заявлено, что подпись есть у всех роликов, но независимые проверки находили файлы без неё, так что относиться к метаданным как к гарантии не стоит — ни в ту, ни в другую сторону. Плюс у OpenAI есть внутренние средства детекции, которые вы со стороны не увидите.

Отсюда два практических правила. Первое: снятие водяного знака и правка метаданных нарушают условия использования, а если цель — скрыть ИИ-происхождение, добавляется уже правовой риск. Второе: площадки всё чаще требуют помечать сгенерированное видео, и метка может остаться в файле, даже если кадр вы обрежете. Планируйте проект так, чтобы маркировка не мешала: под рекламные обещания и «реальные отзывы» — своя съёмка, под графику, абстракцию, заставки и раскадровки — генерация.

Когда переформулировка не поможет

Есть категории, где переписывать промпт бессмысленно: там отказ не ошибка фильтра, а его прямая задача. Проще сразу перестроить задачу, чем потратить вечер на двадцать вариантов формулировки.

  • Сексуальный контент, а тем более любые сюжеты с сексуализацией несовершеннолетних.
  • Интимные изображения без согласия изображённого человека.
  • Узнаваемые реальные люди без оформленного согласия — включая политиков, умерших публичных персон и исторические фигуры.
  • Инструкции по изготовлению оружия и веществ, призывы к насилию.
  • Точное воспроизведение чужого персонажа или музыкального трека, даже если вы описали его без имени.
  • Оживление загруженной фотографии реального лица — в Sora это закрыто на уровне входного фильтра, вне зависимости от того, чьё это фото.

Если же сцена законная, а Sora всё равно упирается, самый дешёвый ход — не двадцатая переформулировка, а другая модель. В MediaLab рядом лежат Sora 2, Kling v3, Seedance 2.5, Grok Imagine и другие семейства: одну и ту же сцену можно прогнать по трём моделям и оставить ту, что прошла. Запуск видео стоит 14–67 нейронов, при курсе около 3 ₽ за нейрон перебор обходится в сотню-другую рублей, а не в потерянный день. Как запускать генерацию прямо из диалога — в материале видео в чате, а общий обзор возможностей — в что умеет чат.