GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
実人による AI ビデオ生成:何が実装されているのか
2026/08/09

実人による AI ビデオ生成:何が実装されているのか

実人参照の使い方、音声生成オプション、ドキュメント化された制限、実装方法、審査プロセス、費用計算を理解してAIビデオジェネレータを使う方法。

AI ビデオジェネレータで実人を使えますか?はい、本人が同意していて選択したルートが実人参照をドキュメント化している場合は使えます。実用的な問題は、入力が受け入れられるかどうか、モデルが音声を生成するかどうか、レビューがどう機能するか、そしてジョブにいくらかかるかです。

重要な区別は、ツールではなく、顔の所有者で判断することです。同意した被写体の写真、合成キャラクター、著名人の顔は、法的にも技術的にも異なる入力です。本記事では各ケースの公開パスを説明し、どの音声が必要か、参照が拒否された場合の確認事項を解説します。

TL;DR

  • 実人の参照写真とクリップがサポートされています。 Seedance 2.5 のパラメータリファレンスは、「参照画像 / ビデオは実人を含むことができます」と明記しています[1]
  • 拒否された参照素材は全額返金されます。 素材は生成前に自動レビューを通過し、拒否されたものはエラーで失敗し、予約金全額が返金されます[2]
  • 音声生成は別の機能です。 Seedance 2.5 は generate_audio でデフォルトオンの「同期音声、効果音、背景音楽」を生成します[1]。Kling 3.0 はリップシンクを明示的にドキュメント化しています[3]
  • 著名人は全ルートで拒否されます。 これはプラットフォームポリシー設定ではなく、モデル自体の基準です。どのパラメータも到達しません。
  • 同意の取得はあなたの責任です。 API がアップロードを受け入れることは、あなたの代わりに権限を取得したわけではありません。

同じキーワードで異なる 4 つの質問

自分の映像、または同意した被写体。 これは最大の正当な事例です:創業者が自分の製品デモ、UGC クリエイター、契約署名したアクター、ブランド動画を作成するクライアント。サポートされており、この記事の大部分はこれについています。

合成人物の参照が拒否される。 エラーだけでは、レビューシステムが画像をどう分類したか、どの内部チェックが決定を下したかが証明されません。ドキュメント化された入力要件とレビュー結果を確認してから、原因を判断してください。

著名な公人。 拒否されます。これは reAPI のポリシー問題ではなく、すべてのホストで再販されるモデルの基準です。そうでないと宣伝しているプラットフォームは間違っているか、肖像権の問題を販売しています。

人が話す。 パーミッション問題ではなく、機能問題であり、プラットフォームではなくモデルの選択で決まります。

トラブルシューティング時にこれらを分け、対応させてください。サポートされた実人参照、拒否された合成参照、および著名人リクエストには同じ次のステップがありません。

同意した人を参照として使用する

サポートされるパスは、説明をプロンプトすることではなく、参照素材です。Seedance 2.5 は、1 つの生成で最大 30 の参照画像、10 の参照クリップ、10 のオーディオトラックを受け入れます[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

参照セットを構成する前に知っておくべき制約:[1]

フィールド制限フォーマット
image_urls最大 30 個、各 30 MB 未満jpeg、png、webp、bmp、tiff、gif、heic、heif
video_urls最大 10 個、各 2~30 秒、200 MB 未満、合計 30 秒mp4、mov、480p~4K
audio_urls最大 10 個、各 2~30 秒、15 MB 未満wav、mp3

2 つのルールが人を困らせます。すべての参照は 公開 HTTP(S) URL である必要があります。base64 と data: ペイロードはプラットフォーム全体で拒否されます[1]image_urlsimage_with_roles と組み合わせることはできないため、キャラクター参照と最初/最後フレーム チェーンは別モードです[1]

参照素材は、生成が実行される前に自動レビューを通過します。拒否された場合、タスクはエラーで失敗し、予約金は全額返金されます[2]。拒否された試みは、予約額ではなく時間の代価を払います。

彼らを話させる

これはプラットフォーム選択よりもモデル選択が重要で、2 つのドキュメント化されたオプションは異なる動作をします。

Seedance 2.5 はネイティブにオーディオを生成します。generate_audio はデフォルト true で、「同期音声、効果音、背景音楽 (モノラル)」を生成します[1]。音声はビデオにダブしたのではなく、ビデオと共に生成されるため、口の動きと音声は同じパスから来ます。プロンプトを通じてそれを指示します。

Kling 3.0 はより具体的に機能を説明し、ネイティブオーディオを「ダイアログ、リップシンク、環境音」として同期させます[3]。リップシンク精度がダイアログで判断されるなら、それはテストする明示的な要求です。

どちらも、完成した音声トラックを提供して正確な口の形のマッチングを取得するダビングモードは提供しません。Seedance 2.5 の audio_urls はドキュメント化された参照オーディオトラックです[1]。これはリップシンク駆動とは別の仕事です。パイプラインにすでに録音 VO がある場合は、短いクリップでそれを仮定してからテストして、その周りにビルドしてください。

トーキングヘッド作業の実用的な注意:オーディオはセグメンテーションを生き残りません。各生成は独自のトラックを合成するため、複数のクリップから組み立てられたシーケンスは複数の独立したオーディオベッドを与えます。1 つの生成より長いダイアログの場合、音声を個別に記録または合成し、ビデオを画像のみとして扱ってください。

動かないラインはどこか

著名人は拒否されます。 すべての正直なルートはこれを実施します。モデルに関連しており、プラットフォームの設定ではありません。ホストがそう主張する場合、正しい返答は疑念です。サインアップではなく。

サードパーティのキャラクターも拒否されます。 同じチェックが認識可能な著作権キャラクターをキャッチします。これはアニメとファン作品の定期的なイライラであり、公開に値するワークアラウンドはありません。

同意はアップロードフォームで転送されません。 API が参照写真を受け入れることは、それにいる人からの許可ではありません。リリース、肖像権、および複数の管轄区域でのバイオメトリック データルールはあなたの責任であり、リクエストが 200 を返したからプラットフォームの責任になるわけではありません。

これは法的な定型文ではありません。これはサポートされるパスが存在する理由です。チェックは非合意ケースを停止するように設計されており、正当なケースが行く場所があるときにより良く機能します。

合成参照が拒否された場合

拒否メッセージは、参照がコンテンツ、形式、または別のレビュールールのため拒否されたかどうかを確立しません。単語使いから内部メカニズムを推論しないでください。最初に、URL、ファイルタイプ、サイズ、期間、およびフィールド組み合わせが公開パラメータリファレンスと一致することを確認してください[1]

入力が有効ですが、自動レビューがまだ拒否する場合、その結果を画像の起源についての証明ではなく、審査結果として扱ってください。別の準拠参照を試すか、ドキュメント化された入力ポリシーがジョブに適合するモデルを試してください。face-detected トラブルシューティング ガイドは、どの内部システムがメッセージを生成したかを推測せずに入力検証からレビューを分離します。

コスト

参照駆動型の作業は Seedance 2.5 の他の生成と同じ価格で設定されており、1 つの留意点があります。参照画像とオーディオはレートを変更しません。参照 ビデオ はより低い秒単位のレートに移動します。reAPI は max(output + ceil(total source-video duration), ceil(5 / 3 × output)) 秒で請求します[2]

ジョブ、720pコスト
参照画像から 8 秒$2.135
参照画像から 30 秒$8.005
10 秒参照クリップから 5 秒出力$2.402

公開秒数バンドのレート[2]。失敗した審査チェックは全額返金されるため、探索的な参照セットは、クレジットではなく時間の代価を払います。

FAQ

AI ビデオジェネレータで実人を使えますか?

はい、同意した被写体の参照素材でも。Seedance 2.5 のパラメータリファレンスは、参照画像とビデオが実人を含むことができると述べています[1]

有名人を生成できますか?

いいえ。著名人はモデルレベルですべてのルートで拒否され、パラメータはそれを変更しません。

どのモデルが人を話させますか?

Seedance 2.5 は generate_audio でビデオと共に同期音声を生成します[1]。Kling 3.0 はダイアログとリップシンクを明示的にドキュメント化しています[3]

自分の音声記録を提供して、それにリップシンクを取得できますか?

ドキュメント化されたモードではありません。Seedance 2.5 の audio_urls はリップシンク ドライバーではなく参照トラックです[1]。1 つの短いクリップでテストしてから、それを設計してください。

AI 生成キャラクターが実人として拒否されたのはなぜですか?

メッセージは内部理由を明かしません。最初に参照 URL、形式、サイズ、フィールド組み合わせを確認してください。有効な場合、結果をレビュー拒否として処理してください。face-detected エクスプレイナーはドキュメント化されたチェックリストを提供します。

参照が拒否されたときに料金が発生しますか?

reAPI ではありません。レビュー失敗のタスクは予約金を全額返金します[2]

参照ファイルを直接アップロードできますか?

いいえ。すべての参照は公開 HTTP(S) URL である必要があります。Base64 と data: ペイロードはプラットフォーム全体で拒否されます[1]

1 つの生成で何個の参照画像を取ることができますか?

最大 30 個、プラス 10 個のクリップと 10 個のオーディオトラック[1]

顔を中心に、回避ではなく作成する

実際に持っている 4 つの質問のうち、ツールを選択する前に決めてください。同意した被写体と有効な参照セットは、公開されたパラメータと、レビューが「ノー」と言うときの返金で、サポートされたワークフローを形成します。拒否された合成参照には、隠れた分類器の推測ではなく、入力とレビューチェックが必要です。ダイアログは、2 つのドキュメント化された回答で、モデル選択の問題のままです。

第 4 の質問だけ、同意しなかった著名人には、ルートがなく、それは防御する価値があり、回避するのではなく。AI ビデオジェネレータと実人は、人々が「はい」と言ったときの通常のツールであり、サポートされるパスが開いている理由は、サポートされないパスが閉じているからです。

完全なパラメータリファレンスを reapi.ai/docs/seedance-2-5 で、現在のレートを Seedance 2.5 モデルページ で確認してください。

References

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0

Further reading