GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
ИИ видеогенератор с реальными людьми: что работает
2026/08/09

ИИ видеогенератор с реальными людьми: что работает

Видеогенератор ИИ с реальными людьми: согласие, документированные референсы, встроенный диалог, проверка материалов и полный возврат при отказе.

Можно ли использовать генератор видео ИИ с реальными людьми? Да, если испытуемый дал согласие и выбранный маршрут документирует поддержку референсов реальных людей. На практике встают вопросы: будет ли входные данные приняты, генерирует ли модель речь, как работает проверка и сколько это стоит.

Полезное разделение зависит не от инструмента, а от того, чьё это лицо. Фотография согласившегося испытуемого, синтетический персонаж и названная знаменитость — это три юридически и технически разных вещи. В этом руководстве описана документированная схема для каждого случая, что требуется для диалога и на какие проверки обратить внимание, если референс отклоняется.

TL;DR

  • Справочные фотографии и видеоклипы реальных людей поддерживаются. Справочник параметров Seedance 2.5 явно указывает, что "справочные изображения/видео могут содержать реальных людей".[1]
  • Отклоненный справочный материал возмещается полностью. Материал проходит автоматическую проверку перед генерацией, и все, что отклонено, завершается ошибкой и полным возмещением зарезервированной суммы.[2]
  • Речь — это отдельная возможность. Seedance 2.5 генерирует "синхронизированную речь, звуковые эффекты и фоновую музыку" с generate_audio, включено по умолчанию.[1] Kling 3.0 явно документирует синхронизацию губ.[3]
  • Названные знаменитости отклоняются на всех маршрутах. Это решение самой модели, а не политика платформы, и никакой параметр его не изменит.
  • Согласие остается вашей ответственностью. API, который принимает загрузку, не получал разрешение от вашего имени.

Четыре разных запроса под одним поисковым запросом

Ваш собственный материал или согласившийся испытуемый. Это наиболее крупный законный случай: основатели в своих собственных демонстрациях продуктов, создатели UGC, актеры, подписавшие соглашение об отказе, клиент, для которого вы создаете видео бренда. Это поддерживается, и остальная часть статьи в основном посвящена этому.

Синтетический персонаж, чей референс отклоняется. Сообщение об ошибке само по себе не раскрывает, как система проверки классифицировала изображение или какая проверка вызвала отказ. Сначала убедитесь, что требования к входным данным соответствуют документированным параметрам и результату проверки, прежде чем решать, что явилось причиной.

Названная государственная фигура. Отклонено. Не как политика reAPI, а на уровне модели всеми хостами, которые её перепродают. Любая платформа, утверждающая обратное, либо ошибается, либо продает вам проблему с правами на изображение.

Люди разговаривают. Это вопрос не о разрешении, а о возможности, и ответ зависит от выбора модели, а не платформы.

Разделите эти случаи при решении проблем. Поддерживаемый референс реального человека, отклоненный синтетический референс и запрос на названную персону — это не один и тот же путь решения.

Использование согласившегося человека в качестве референса

Поддерживаемый путь — справочный материал, а не подсказка в виде описания. Seedance 2.5 принимает до 30 справочных изображений, 10 справочных видеоклипов и 10 аудиодорожек в одной генерации.[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

Ограничения, которые стоит учитывать перед сборкой набора референсов:[1]

ПолеОграничениеФорматы
image_urlsдо 30, каждый менее 30 МБjpeg, png, webp, bmp, tiff, gif, heic, heif
video_urlsдо 10, каждый 2–30 сек, менее 200 МБ, всего 30 секmp4, mov, 480p to 4K
audio_urlsдо 10, каждый 2–30 сек, менее 15 МБwav, mp3

Два правила часто упускаются. Каждый референс должен быть публичным URL HTTP(S); полезные нагрузки base64 и data: отклоняются по всей платформе, а не только для этой модели.[1] И image_urls нельзя комбинировать с image_with_roles, поэтому ссылки персонажей и привязка первого/последнего кадра — это отдельные режимы.[1]

Справочный материал проходит автоматическую проверку перед запуском генерации. Если его отклонят, задача завершится ошибкой, а зарезервированная сумма будет полностью возвращена,[2] поэтому отклоненный референс стоит вам времени, а не зарезервированной суммы.

Заставить их говорить

Здесь выбор модели имеет большее значение, чем выбор платформы, и два документированных варианта ведут себя по-разному.

Seedance 2.5 генерирует аудио нативно. generate_audio по умолчанию true и производит "синхронизированную речь, звуковые эффекты и фоновую музыку (моно)".[1] Речь генерируется вместе с видео, а не дублируется, поэтому движение рта и аудио поступают из одного прохода. Вы управляете этим через подсказку.

Kling 3.0 более специфично документирует возможность, описывая синхронизированное нативное аудио как "диалог, синхронизацию губ, окружающий звук".[3] Если точность синхронизации губ в диалоге — это то, на что вас будут судить, то это явное утверждение для тестирования.

Ни один не предлагает режим дублирования, когда вы предоставляете готовую голосовую дорожку и получаете точное совпадение формы рта. audio_urls Seedance 2.5 документируются как справочные аудиодорожки,[1] что отличается от управления синхронизацией губ. Если ваш конвейер уже имеет записанный VO, протестируйте это предположение на коротком видеоклипе, прежде чем строить вокруг него.

Практическое замечание для работы говорящей головы: аудио не пережить сегментацию. Каждая генерация синтезирует свою собственную дорожку, поэтому последовательность, собранная из нескольких видеоклипов, дает вам несколько независимых аудиокроватей. Для диалога длиннее одной генерации запишите или синтезируйте голос отдельно и рассматривайте видео как только изображение.

Линия, которая не движется

Названные живые люди отклоняются. Каждый честный маршрут это применяет, и это остается на уровне модели, а не параметров платформы. Если хост утверждает иное, правильный ответ — сомнение, а не регистрация.

Персонажи третьих сторон также отклоняются. Та же проверка выявляет узнаваемых персонажей, защищенных авторским правом, что является постоянным разочарованием для аниме и фанатского творчества и не имеет опубликованного решения.

Согласие не передается через форму загрузки. API, принимающий вашу справочную фотографию, — это не разрешение от человека на ней. Отказы, права на изображение и в нескольких юрисдикциях биометрические правила данных — это ваша ответственность и не становятся ответственностью платформы, потому что запрос вернул 200.

Последнее — не просто юридический шаблон. Это причина, по которой поддерживаемый путь вообще существует: проверка предназначена для остановки случая без согласия, и она работает лучше, когда законный случай имеет место для поворота.

Когда синтетический референс отклоняется

Сообщение об отказе не раскрывает, был ли референс отклонен из-за его содержимого, формата или другого правила проверки. Не выводите внутренний механизм только из формулировки. Сначала убедитесь, что URL, тип файла, размер, длительность и комбинация полей соответствуют опубликованной справке параметров.[1]

Если входные данные валидны, но автоматическая проверка всё равно их отклоняет, трактуйте результат как решение модерации, а не доказательство происхождения изображения. Попробуйте другой поддерживаемый референс или модель, чья документированная политика входных данных подходит для задачи. Руководство по решению проблем обнаружения лица отделяет валидацию входных данных от проверки содержимого без предположений о внутренних системах.

Что это стоит

Генерация с референсами оплачивается как обычная работа Seedance 2.5, но с одним исключением. Справочные изображения и аудио не меняют ставку; только справочное видео включает пониженную ставку. Тогда reAPI считает оплачиваемые секунды по формуле max(результат + ceil(общая длительность справочных видео), ceil(5 / 3 × результат)).[2]

Работа, 720pСтоимость
8 сек из справочных изображений$2.135
30 сек из справочных изображений$8.005
Справочное видео 10 сек на результат 5 сек$2.402

Тарифы из опубликованного диапазона в секунду.[2] Неудача проверки модерации возмещается полностью, поэтому исследовательские наборы референсов стоят вам времени, а не кредитов.

FAQ

Могу ли я использовать генератор видео ИИ с реальными людьми?

Да, со справочным материалом согласившегося испытуемого. Справочник параметров Seedance 2.5 указывает, что справочные изображения и видео могут содержать реальных людей.[1]

Могу ли я сгенерировать знаменитость?

Нет. Названные государственные деятели отклоняются на уровне модели на каждом маршруте, и никакой параметр это не изменит.

Какая модель справляется с говорящими людьми?

Seedance 2.5 генерирует синхронизированную речь рядом с видео с generate_audio.[1] Kling 3.0 явно документирует диалог и синхронизацию губ.[3]

Могу ли я предоставить собственную голосовую запись и получить синхронизацию губ к ней?

Не как документированный режим. audio_urls Seedance 2.5 — это справочные дорожки, а не драйвер синхронизации губ.[1] Протестируйте это на коротком видеоклипе перед проектированием конвейера вокруг него.

Почему мой персонаж, созданный ИИ, был отклонен как реальный человек?

Сообщение не раскрывает внутреннюю причину. Сначала убедитесь, что URL справки, формат, размер и комбинация полей соответствуют опубликованным параметрам; если всё верно, трактуйте результат как решение модерации. Руководство по диагностике ошибок обнаружения лица предоставляет документированный список проверок.

Мне будут взимать плату, если референс будет отклонен?

Нет на reAPI. Задача, которая не прошла проверку, возмещает зарезервированную сумму полностью.[2]

Могу ли я загрузить файл справки напрямую?

Нет. Каждый референс должен быть публичным URL HTTP(S). Полезные нагрузки base64 и data: отклоняются по всей платформе.[1]

Сколько справочных изображений может вместить одна генерация?

До 30, плюс 10 видеоклипов и 10 аудиодорожек.[1]

Работа с лицами вместо их обхода

До выбора инструмента определите, какой из четырёх запросов вам нужен. Для материала согласившегося человека опубликованы параметры референсов и возврат при отказе проверки. Если отклонён синтетический персонаж, не приписывайте результат его происхождению или скрытому механизму без данных: сначала проверьте входные условия и полученную ошибку. Для диалога нужно выбирать модель с документированными аудиовозможностями.

Только четвертый запрос, названный человек, который не согласился, не имеет маршрута, и это стоит защищать, а не объезжать. ИИ видеогенератор с реальными людьми — это обычный инструмент, когда люди сказали да, и причина, по которой поддерживаемый путь остается открытым, заключается в том, что неподдерживаемый остается закрытым.

Полная справка по параметрам на reapi.ai/docs/seedance-2-5; текущие тарифы на странице модели Seedance 2.5.

References

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0

Further reading