Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 за секунду
ИИ видеогенератор с реальными людьми: Что работает
2026/08/09

ИИ видеогенератор с реальными людьми: Что работает

Видеогенератор ИИ с реальными людьми: согласованные справки работают, синтетические лица дают ложные срабатывания, а знаменитости везде отклоняются безвозвратно.

Поищите ИИ видеогенератор с реальными людьми, и автодополнение подскажет вам, что все действительно спрашивают: с говорящими людьми, со знаменитостями, реальные люди, бесплатно. Это четыре разных запроса с четырьмя разными ответами, и ровно один из них везде отклоняется, независимо от платформы.

Полезное разделение зависит не от инструмента, а от того, чей это лицо. Фотография согласившегося испытуемого, синтетический персонаж, который выглядит фотореалистично, и названная знаменитость - это три юридически и технически разных вещи. Большая часть разочарования в этой области возникает из-за того, что платформы рассматривают все три как одну категорию блокировки. В статье описывается, что каждый из них действительно делает в современном видео API, что дополнительно требуется для разговора и где линия действительно не сдвигается.

TL;DR

  • Справочные фотографии и видеоклипы реальных людей поддерживаются. Справочник параметров Seedance 2.5 явно гласит, что "справочные изображения/видео могут содержать реальных людей."[1]
  • Отклоненный справочный материал возмещается полностью. Материал проходит автоматическую проверку перед созданием, и все, что отклонено, заканчивается ошибкой и полным возмещением зарезервированной суммы.[2]
  • Разговор - это отдельная возможность. Seedance 2.5 генерирует "синхронизированную речь, звуковые эффекты и фоновую музыку" с generate_audio, включено по умолчанию.[1] Kling 3.0 явно документирует синхронизацию губ.[3]
  • Названные знаменитости отклоняются на всех маршрутах. Это решение самой модели, а не политика платформы, и никакой параметр его не изменит.
  • Согласие остается вашей ответственностью. API, который принимает загрузку, не получал разрешение от вашего имени.

Четыре разных запроса под одним поисковым запросом

Ваш собственный материал или согласившийся испытуемый. Это наиболее крупный законный случай: основатели в своих собственных демонстрациях продуктов, создатели UGC, актеры, подписавшие соглашение об отказе, клиент, для которого вы создаете видео бренда. Это поддерживается, и остальная часть статьи в основном посвящена этому.

Синтетический персонаж, который выглядит фотореалистично. Ваш персонаж не существует, но ваш генератор изображений стал настолько хорошим, что классификаторы лиц оценивают его как фотографию. Это вызывает наибольшее количество жалоб, потому что отклонение является ложным срабатыванием, а не политикой.

Названный государственный деятель. Отклонено. Не как политика reAPI, а моделью на каждом хосте, который ее перепродает. Любая платформа, утверждающая обратное, либо ошибается, либо продает вам проблему с правами на изображение.

Люди разговаривают. Это вопрос не о разрешении, а о возможности, и ответ зависит от выбора модели, а не платформы.

Смешивание этих понятий объясняет, почему советы, найденные в Интернете, противоречивы. И тот, чей рабочий процесс с согласившимся испытуемым работает хорошо, и тот, чей синтетический персонаж продолжает отскакивать, оба точно сообщают о разных запросах.

Использование согласившегося человека в качестве справки

Поддерживаемый путь - справочный материал, а не подсказка описания. Seedance 2.5 принимает до 30 справочных изображений, 10 справочных видеоклипов и 10 аудиодорожек в одном поколении.[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

Ограничения, которые необходимо учитывать перед сборкой набора ссылок:[1]

ПолеОграничениеФорматы
image_urlsдо 30, каждый менее 30 МБjpeg, png, webp, bmp, tiff, gif, heic, heif
video_urlsдо 10, каждый 2–30 сек, менее 200 МБ, всего 30 секmp4, mov, 480p to 4K
audio_urlsдо 10, каждый 2–30 сек, менее 15 МБwav, mp3

Два правила удивляют людей. Каждая справка должна быть общедоступным URL-адресом HTTP(S). Полезные нагрузки base64 и data: отклоняются по всей платформе, а не только для этой модели.[1] И image_urls нельзя комбинировать с image_with_roles, поэтому ссылки персонажей и привязка первого/последнего кадра - это отдельные режимы.[1]

Справочный материал проходит автоматическую проверку перед выполнением поколения. Если его отклонят, задача завершится ошибкой, и зарезервированная сумма будет полностью возмещена,[2] что означает, что ложное срабатывание стоит вам повторной попытки, а не денег.

Заставить их говорить

Здесь выбор модели имеет большее значение, чем выбор платформы, и два документированных варианта ведут себя по-разному.

Seedance 2.5 генерирует аудио нативно. generate_audio по умолчанию true и производит "синхронизированную речь, звуковые эффекты и фоновую музыку (моно)."[1] Речь генерируется вместе с видео, а не дублируется, поэтому движение рта и аудио поступают из одного и того же прохода. Вы управляете этим через подсказку.

Kling 3.0 более специфично документирует возможность, описывая синхронизированное нативное аудио как "диалог, синхронизацию губ, окружающий звук."[3] Если точность синхронизации губ в диалоге - это то, за что вас судят, это явное утверждение для тестирования.

Ни один не предлагает режим дублирования, когда вы предоставляете готовую голосовую дорожку и получаете точное совпадение формы рта. audio_urls Seedance 2.5 документируются как справочные аудиодорожки,[1] что отличается от управления синхронизацией губ. Если ваш конвейер уже имеет записанный VO, протестируйте это предположение на коротком видеоклипе, прежде чем строить вокруг него.

Практическое замечание для работы говорящей головы: аудио не пережить сегментацию. Каждое поколение синтезирует свою собственную дорожку, поэтому последовательность, собранная из нескольких видеоклипов, дает вам несколько независимых аудиокроватей. Для диалога длиннее одного поколения запишите или синтезируйте голос отдельно и рассматривайте видео как только изображение.

Линия, которая не движется

Названные живые люди отклоняются. Каждый честный маршрут это применяет, и это остается с моделью, а не с параметрами платформы. Если хост утверждает иное, правильный ответ - сомнение, а не регистрация.

Персонажи третьих сторон также отклоняются. Та же проверка выявляет узнаваемых персонажей, защищенных авторским правом, что является постоянным разочарованием для аниме и фанатского творчества и не имеет опубликованного решения.

Согласие не передается через форму загрузки. API, принимающий вашу справочную фотографию, - это не разрешение от человека на ней. Отказы, права на изображение и в нескольких юрисдикциях биометрические правила данных - это ваша ответственность и не становятся ответственностью платформы, потому что запрос вернул 200.

Последнее - не просто юридический шаблон. Это причина, по которой поддерживаемый путь вообще существует: проверка предназначена для остановки случая без согласия, и она работает лучше, когда законный случай имеет место для поворота.

Когда несуществующий человек отклоняется

Самая распространенная ошибка в этом пространстве - полностью синтетический персонаж блокируется как реальный человек, потому что классификатор оценивает фотореализм, а не происхождение. Невозможно узнать, что ваш персонаж был сгенерирован. Пользователи сообщали о той же категории отклонений с ошибками, такими как "Input image may contain real person" на других платформах.[4]

Механика, точные строки ошибок и то, как отличить детектор лиц на уровне платформы от проверки на уровне модели, рассмотрены в reapi.ai/blog/seedance-face-detected-real-person-error. Краткая версия: время отклонения. Отказ, который происходит менее чем за секунду, никогда не достигал графического процессора.

Что это стоит

Работа, основанная на справках, оценивается так же, как любое другое поколение на Seedance 2.5, с одним исключением. Справочные изображения и аудио не изменяют тариф. Справочное видео переводит вас на более низкий тариф в секунду, который взимается за входной и выходной секунды.[2]

Работа, 720pСтоимость
8 сек из справочных изображений$2.13
30 сек из справочных изображений$8.01
10 сек справочного видеоклипа на 5 сек вывода$2.40

Тарифы из опубликованной диапазона в секунду.[2] Неудача проверки модерации возмещается полностью, поэтому исследовательские наборы ссылок стоят вам времени, а не кредитов.

FAQ

Могу ли я использовать ИИ видеогенератор с реальными людьми?

Да, со справочным материалом согласившегося испытуемого. Справочник параметров Seedance 2.5 указывает, что справочные изображения и видео могут содержать реальных людей.[1]

Могу ли я сгенерировать знаменитость?

Нет. Названные государственные деятели отклоняются на уровне модели на каждом маршруте, и никакой параметр это не изменит.

Какая модель справляется с говорящими людьми?

Seedance 2.5 генерирует синхронизированную речь рядом с видео с generate_audio.[1] Kling 3.0 явно документирует диалог и синхронизацию губ.[3]

Могу ли я предоставить собственную голосовую запись и получить синхронизацию губ к ней?

Не как документированный режим. audio_urls Seedance 2.5 - это справочные дорожки, а не драйвер синхронизации губ.[1] Протестируйте это на коротком видеоклипе перед проектированием конвейера вокруг него.

Почему мой персонаж, созданный ИИ, был отклонен как реальный человек?

Потому что проверка оценивает фотореализм, а не происхождение. Смотрите объяснение обнаруженного лица для того, как определить, какой уровень вас отклонил.

Мне будут взимать плату, если ссылка будет отклонена?

Не на reAPI. Задача, которая не прошла проверку, возмещает зарезервированную сумму полностью.[2]

Могу ли я загрузить файл справки напрямую?

Нет. Каждая справка должна быть общедоступным URL-адресом HTTP(S). Полезные нагрузки base64 и data: отклоняются по всей платформе.[1]

Сколько справочных изображений может вместить одно поколение?

До 30, плюс 10 видеоклипов и 10 аудиодорожек.[1]

Работа с лицами вместо их обхода

Решите, какой из четырех запросов вам действительно нужен, прежде чем выбирать инструмент, потому что три из них - это обычные решения по продукту, а одно не доступно нигде. Согласившийся испытуемый и хороший набор ссылок - это поддерживаемый рабочий процесс с опубликованной поверхностью параметров и возмещением, когда проверка говорит нет. Фотореалистичный синтетический персонаж - это тот же рабочий процесс плюс проблема с ложным срабатыванием, которую вы можете диагностировать за тридцать секунд. Диалог - это вопрос выбора модели с двумя документированными ответами.

Только четвертый запрос, названный человек, который не согласился, не имеет маршрута, и это стоит защищать, а не объезжать. ИИ видеогенератор с реальными людьми - это обычный инструмент, когда люди сказали да, и причина, по которой поддерживаемый путь остается открытым, заключается в том, что неподдерживаемый остается закрытым.

Полная справка по параметрам на reapi.ai/docs/seedance-2-5; текущие тарифы на странице модели Seedance 2.5.

Справки

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0
  4. r/generativeAI. Seedance keeps rejecting my AI images as "real person"; any fix? Posted 22 May 2026, retrieved August 2026 from reddit.com/r/generativeAI/comments/1tkkxjq

Дополнительное чтение