
ストーリーボードでAI動画の動きをコントロール:初心者ガイド
AI動画生成のストーリーボード活用法。散文だけでなく、視覚的な場面構成で複雑な動きを指示。キーフレーム、遷移説明、動きレビューのワークフロー。
ストーリーボード優先のAI動画ワークフローは、モデルに視覚的な状態の連続を示すことで動きを制御します。 複雑なダンスや動作、商品デモンストレーション全体をひとつの段落で説明する代わりに、対象が複数の重要な瞬間にどのように見えるべきかを決定します。プロンプトは、その瞬間と瞬間の間をどう動くかを説明するだけです。
これは企画書用の従来のストーリーボーディングではありません。生成のための制御レイヤーです。有効なモーションボードは、ポーズ、方向、接触、フレーミング、次のイメージに受け継ぐべき状態を定義します。
TL;DR
- 動作を、開始状態、変化、終了状態として書く。
- 6~12の重要な瞬間を選び、すべてのフレームを描かない。
- ボード全体を通して、カメラ、キャラクター、環境、アスペクト比を安定させる。
- 各パネルが1つの動き質問に答える。
- 順序通りにパネルを参照し、その間の遷移を説明する。
- 完全なシーケンスをレンダリングする前に、短いセクションをテストする。
- 接触、方向、タイミング、アイデンティティ、終了状態を個別に確認する。

ストーリーボードが長いプロンプトより効果的な場合
ストーリーボードは、動作が視覚的な中間状態を持つ場合に最も有効です。例えば、ダンサーがポーズを変える、人が物を拾って使用する、乗り物が空間を通して回転する、商品が段階的に開く、またはキャラクターがセットの片側から別の側に移動する場合が該当します。
テキストは順序を説明できますが、視覚的な参照は、何度も書くのが厄介な詳細を解決します:
- どちらの腕が上がっているか;
- どちらの足に体重がかかっているか;
- 小道具がどこで手に接触しているか;
- 体がどの方向を向いているか;
- フレーム内で対象がどの程度大きいか;
- 動作の終わりに変わらずに保つべき状態。
ByteDanceはSeedanceがテキストストーリーボードとマルチモーダルリファレンスを、構図、モーションリズム、カメラ言語、ビジュアル要素に使用できることを文書化しています。[1]ストーリーボードは正確な補間を保証しません。ただし、密集した段落だけよりも、モデルにより良い証拠を提供します。
ステップ1:境界を持つアクション文を書く
開始と終了を名付ける文から始めます。
弱い例:
ダンサーはエネルギッシュなルーチンを実行する。有効な例:
ダンサーは両足を地面に付けた状態で直立して始まり、左に踏み出して低い姿勢に入り、右腕が上がりながら時計回りに回転し、カメラに向かって着地し、その後両手が見えている最終的なポーズを保持する。2番目のバージョンは、開始状態、方向、3つの変化、終了状態を持っています。これらはストーリーボードパネルになります。
物体インタラクションでは、接触を追加します:
プレゼンターは両手がボトルから離れた状態で始まり、右手で到達し、ボトルの中央をつかみ、方向を変えずに持ち上げ、マークされた円に置き、離し、両手が見えている状態で終わる。接触状態は、オブジェクトが手に出現したり、グリップが確立される前に移動したりするのを防ぎます。
ステップ2:等間隔ではなく、重要な瞬間を選ぶ
デフォルトで2秒ごとにパネルを作成しないでください。動作が状態を変更するたびにパネルを作成します。
| パネル | 目的 | 見える必要があること |
|---|---|---|
| 1 | スタートアンカー | アイデンティティ、衣装、姿勢、フレーミング |
| 2 | 準備 | 体重移動または物体に近づく手 |
| 3 | 接触 | クリアなグリップ、足の植え方、または体と物の関係 |
| 4 | メイン動き | 方向と最大のポーズ変化 |
| 5 | 回復 | バランス、減速、物体の落ち着き |
| 6 | エンドアンカー | 安定したポーズと編集可能な構図 |
短い動きの多くには6パネルで十分です。相互作用に複数の接触または反転がある場合はさらに使用します。動きが単純なカメラプッシュまたはヘッドターンの場合は少なく使用します。
ステップ3:パネルを描く前に連続性シートを作成する
ストーリーボードは、すべてのイメージで対象を再設計すべきではありません。まずこれらの詳細をロックします:
{
"character": "同じ顔、体の比例、ヘアスタイル、黒いジャケット",
"environment": "同じリハーサルルーム、灰色の床、青い背面の壁",
"camera": "目の高さ、50mmの見た目、固定された中幅のフレーミング",
"screen_direction": "キャラクターは左から右に移動する",
"light": "カメラ左から大きなソフト光源",
"aspect_ratio": "16:9",
"prop": "1つの赤いボトル、キャップは取り付けられたままです"
}最初のパネルを生成または描きます。残りのパネルのアイデンティティとスタイルアンカーとして使用します。後のイメージはポーズと位置を変更できますが、衣装、レンズの感覚、部屋のレイアウト、または光の方向を変更しないでください。
画像モデルを使用してパネルを作成する場合は、一度に1つの画像を要求してください。密集したグリッドは、矛盾した顔と小さくて読めない動作を導入できます。個々のイメージが安定した後、承認されたフレームをボードに組み立てます。
ステップ4:各パネルをモーション指示として設計する
すべてのパネルは短いキャプションが必要です。キャプションはフレームが存在する理由と、次の遷移が保持すべきものを述べます。
パネル1 — スタート
全身が見える。足は肩幅。両手は下。カメラに向かっている。
パネル2 — 左に負荷
左膝が曲がります。体重が左足に移動する。右かかとが上がる。体幹はまだカメラに向かっている。
パネル3 — 回転開始
右足が後ろを横切る。体幹が時計回りに回転する。右腕が肩の高さに到達する。顔はまだ3/4ビューで見える。
パネル4 — ピークターン
背中が一瞬カメラに向かう。両足は床に残ったままです。ジャケットと髪も同じ時計回りの動きに従う。
パネル5 — ランディング
キャラクターが前に戻る。右足が最初に植え付けられる。腕が減速する。
パネル6 — エンドホールド
カメラに向かって、バランスの取れた姿勢、両手が見える、1秒間のスティルホールド。隣接するパネル間の不可能なジャンプを避けてください。パネル2に立っている対象が表示され、パネル3がそれが床に表示されている場合は、失われた降下状態を追加してください。ボードが省略したものは、モデルが発明する必要があります。
ステップ5:モデルがフレームをどう使うかを選ぶ
2つの一般的なアプローチがあります。
順序付けされたリファレンス画像
パネルを個別のリファレンス画像としてアップロードし、プロンプトで名前を付けます。これはより多くの詳細を保持し、各イメージが何を制御するかを述べることができます。
単一のストーリーボードシート
パネルを明確に番号が付けられた1つのイメージに組み合わせます。管理しやすいですが、各パネルは小さくなり、モデルはシートをシートを厳密なシーケンスではなく視覚的なスタイルリファレンスとして扱う場合があります。
初心者の場合は、APIが受け付ける場合は個別のイメージを使用してください。シートを人間的なレビュー成果物として保持してください。
ステップ6:静止画の説明ではなく、遷移を書く
プロンプトには既にイメージがあります。テキストを使用して、それらの間の動きを説明してください。
イメージ1~6は、同じ部屋の同じキャラクターの順序付けされた動きの状態です。アイデンティティ、衣装、カメラの位置、レンズ、光の方向、部屋のジオメトリを全体を通して保持します。
イメージ1からイメージ2に左の体重移動を伴って継続的に移動します。イメージ2からイメージ3に、右足と右腕が主導する時計回りの回転を開始します。ジャンプや方向の反転なしでイメージ4を通じて続ける。イメージ5を通じて減速し、イメージ6に示されている正確な前を向いた状態に着地します。
両足が床と信じられる接触を保ってください。余分な手足、複製した手、カット、カメラの動き、追加された人々、または背景の変化はありません。イメージ6の状態を1秒間保持してください。このプロンプトは3つの責任を割り当てます:
- イメージは視覚的な状態を定義します;
- 遷移テキストは方向と継続性を定義します;
- 制約は何が変わらないかを定義します。
ステップ7:短いモーションテストを実行する
完全なシーケンスを要求する前に、最も難しい遷移をテストしてください。パネル3と5の間の回転がリスクである場合、より短い期間でそれらの状態を送信してください。
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "イメージ1~6は順序付けされた動きの状態です。反転なしで順序で移動してください。アイデンティティ、衣装、固定カメラ、部屋のジオメトリ、床の接触を保ってください。最終的な状態を1秒間保持してください。カットや追加の人々はありません。",
"image_urls": [
"https://example.com/panel-01.png",
"https://example.com/panel-02.png",
"https://example.com/panel-03.png",
"https://example.com/panel-04.png",
"https://example.com/panel-05.png",
"https://example.com/panel-06.png"
],
"resolution": "720p",
"size": "16:9",
"duration": 10,
"generate_audio": false
}'フィールド image_urls は、ファイルをリファレンスとして扱います。これは、最初または最後のフレーム要求に明示的に使用される image_with_roles とは異なります。現在のAPIドキュメンテーションは、どのフィールドを組み合わせることができるかを説明します。
ステップ8:モーションスコアカードでレビューする
結果を「良い動き」に減らさないでください。実際の制御点を確認してください。
{
"order": "pass",
"screen_direction": "pass",
"foot_contact": "repair at 4.1s",
"hand_count": "pass",
"identity": "pass",
"camera_lock": "pass",
"final_state": "repair: right arm does not settle"
}最初の修復は狭い範囲である必要があります。欠けている遷移パネルを追加するか、1つのポーズを単純化するか、接触を明確にしてください。すべての行に追加の形容詞を追加しないでください。
一般的なストーリーボード失敗
モデルがパネルをスキップする
隣接する状態が似ていて、またはシーケンスが利用可能な期間に対してあまりにも多くのパネルを含む場合があります。冗長な状態を削除するか、スキップされた遷移にさらに時間を与えてください。
キャラクターがパネル間で変わる
パネルセットが一貫していません。同じアンカーから影響を受けたイメージを再構築し、修正された連続性シートを生成プロンプトで繰り返します。
体がポーズ間でスナップする
準備または回復状態を追加してください。大きな変化は、バランス、接触、方向を説明する中間フレームが必要です。
ストーリーボードが固定されている場合でもカメラが移動する
「ロックされたカメラ」を述べて、パネル全体でフレーミングを同じに保ってください。異なるクロップのボードはカメラの動きとして解釈される場合があります。
動きはイメージに従いますが、急いでいるように感じる
状態の数を減らすか、期間を延長してください。モデルは、すべての秒が新しいポーズを含む場合、読み可能な休止を作成できません。
FAQ
ストーリーボードフレームはいくつ使うべきですか?
状態の変化を説明する最も少ないフレームを使用してください。短い振付のシーケンスでは6~12がしばしば機能しますが、単純なアクションは3つだけ必要な場合があります。
ストーリーボードフレームは磨く必要がありますか?
いいえ。ポーズ、方向、接触、フレーミングは表面的な詳細よりも重要です。イメージを明確で一貫性のあるものに保ってください。
ストーリーボードを手描きすることはできますか?
はい。体の方向とオブジェクトの位置が簡単に読み取れる場合、手描きボードが機能します。最終的なキャラクターが特定の外観である場合は、個別のアイデンティティイメージを使用してください。
ストーリーボードにタイムコードを含めるべきですか?
保証ではなく、ガイダンスとして時間範囲を使用してください。重要な瞬間と遷移順序は、生成中の正確なフレームのタイミングよりも重要です。
これはファーストフレームと最後のフレームの生成と同じですか?
いいえ。最初/最後のフレーム生成は境界を固定します。モーションストーリーボードは中間状態を追加するため、それらの境界間のパスはより自由度が低くなります。
結論
ストーリーボード優先のAI動画ワークフローは、プロンプトの長さを視覚的な決定に置き換えます。実際の状態変化で動作を分割し、リファレンスセットを一貫性のあるものに保ち、遷移を説明し、重要な接触と終了状態を確認します。結果はまだ生成的ですが、モデルはもはや散文から全体的な振付を推測していません。
参考文献
- ByteDance Seed. Seedance 2.0 Official Launch. February 12, 2026. seed.bytedance.com
- ByteDance Seed. One-take Creation, Flexible Referencing: Introducing Seedance 2.5. July 31, 2026. seed.bytedance.com
- reAPI. Seedance 2.5 API — Parameters, Modes & Billing. Retrieved August 27, 2026. reapi.ai
著者

カテゴリ
他の記事

Kimi K3 vs Claude Opus 5:オープンウェイトか信頼性か
Kimi K3 vs Claude Opus 5を比較。オープンウェイト、1M文脈、推論、マルチモーダル、API料金、デプロイメント要件の違いを解説。


Seedream 5 Proのコンテンツフィルター:何がブロックされるのか
Seedream 5 Proのコンテンツフィルターは複数の層で実行され、拒否時にどの層が該当したかはほとんど明記されません。各層がブロックする内容と、不変の制限についても解説します。


Kimi K3完全ガイド:Moonshotの2.8T旗艦モデル
Kimi K3の仕様、構造、料金、APIを解説。1Mコンテキスト、常時推論、固定サンプリング、OpenAI互換APIでの利用方法をまとめます。
