GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
すべてのガイド

· reAPI Team

Hotel Lobby AIのペット実測:四足と直立の猫を比較

同じSeedance 2.5の動作参考とプロンプトで猫の姿勢を各1回テスト。実際の入力、無音の下書き、見える問題と実験の限界を確認できます。

Hotel Lobby AIのペット実測:四足と直立の猫を比較

今回のHotel Lobby AIペット実験では、四足の猫の参考画像からも、事前に直立画像を用意せずに直立した上半身が生成されました。ただし、どちらの条件でも前足が手のような形になっています。すべての動物に適用できる条件や自然な解剖構造の保証ではありません。2026年10月10日、四足の茶トラ猫と直立した茶トラ猫の画像を使い、それぞれ1回だけSeedance 2.5に動画をリクエストしました。右側の女性、動作参考、プロンプトは同一です。

これは実際の出力を確認できる小規模な比較で、動物が完璧に振付を再現するレシピではありません。猫は別々に生成したため、体型や模様が異なります。人間向けテンプレートのプロンプトもそのまま使いました。結果にはこれらの条件が含まれます。初めて制作する場合はHotel Lobby AIの全体チュートリアルを参照してください。この記事は動物の入力姿勢に絞ります。

要点

  • GPT Image 2で四足と直立の猫を1枚ずつ生成し、各画像につきSeedance 2.5動画を1回だけ送信しました。繰り返し試した中から良い例を選んだものではありません。[1]
  • 両方とも15秒、480p、16:9、draft: true、generate_audio: falseを指定しました。動画リクエストで変えたのは左側画像のURLだけです。[1]
  • サンプル画像では両方とも猫が左で直立し、前足が手に近いジェスチャーをしています。解剖的に正確な動作転送を示すものではありません。[1]
  • 同じ猫の姿勢だけを変えた厳密な対照ではありません。固定seedも、条件ごとの反復もありません。[1]
  • ペットの出力は無音の元下書きです。Hotel Lobby AIツールは生成後に元の音声トラックを追加します。既存の成人サンプルでは、この別工程が記録されています。[2]

カバーは別に作ったコンセプト画像で、この実験の動画フレームではありません。以下の猫画像と動画が実際のタスク出力です。

Hotel Lobby AIのペット実験で変えた条件

自然な動物の体を、人間2人が直立して演じる動作にどう当てはめるかが実用上の疑問です。動物と動作を同時に変更せず、動画リクエストを固定して左側写真だけを交換しました。具体的な2つの出力を確認できますが、モデルの総合評価にはなりません。

設定両リクエスト共通
動画モデルSeedance 2.5、doubao-seedance-2.5-face
左側茶トラ猫、姿勢の画像を交換
右側同一の架空の成人女性画像
動作参考同一の線画デュエット動画
指定時間15秒
解像度と比率480p、16:9
モードomni_reference_task_type: "reference"
下書きdraft: true
音声生成generate_audio: false
コンテンツフィルターcontent_filter: true
回数姿勢ごとに1回送信

これは記録した送信設定です。成功したリクエストに項目があるだけでは、各設定が出力に影響したことを独立に証明できません。動作の判断はHTTPステータスではなく出力観察に基づきます。1080pの最終版、別モデル比較、新しい動作参考の生成は行っていません。[1]

プロンプトは成人実験と完全に同じです。Image 1を左、Image 2を右と指定し、Video 1に振付、身体動作、口の動き、構図、タイミングを担当させます。一方で「face, hair, clothing and identity」「consistent hands」という人間向けの表現も残っています。検証済みの猫用プロンプトではなく、この適合不足も解釈上の制約です。

実際に使った猫の参考画像

2つのGPT Image 2リクエストは、オレンジ色の縞模様、白い顎と胸、緑の目、黒い無袖ベストを共通で指定しました。3:4の縦構図に全身を収め、暖かいベージュのスタジオ背景にして、他の動物、人、マイク、文字を入れないよう指示しています。女性、音楽、動作素材は再利用しました。

四本の足が床についている画像

左側役に実際に使用した四足の茶トラ猫画像

猫の胴体は水平で、四本の足が床についています。顔はカメラを向き、ベストは猫の胴に沿っています。尻尾も見えます。これは最初の動画の入力であり、想定結果のイラストではありません。

動画生成の前から直立している画像

後ろ足二本で立ち、前肢を左右に下ろした実際の猫画像

2枚目は既に縦長の直立した体で、後ろ足2本が床にあり、前肢2本が左右に離れて下がっています。前肢はアニメーション前から腕のように見えます。足の位置だけでなく、体の構造とベストの形も変わっています。

共通の説明で同一の猫が作られたわけではありません。顔、足の模様、大きさ、服の形は異なります。1枚目を編集して2枚目にしたわけでも、同じ本物のペットを2つの姿勢で撮影したわけでもありません。出力差を姿勢だけの効果とすることはできません。[1]

2つの無音下書きを確認する

四足入力:上半身は既に直立

四足入力の元動画を開く。

冒頭サンプルから猫は左で直立し、女性は右にいます。元の水平な体は維持されません。中盤と終盤では白い前足を上げ、指のように長い形やピンクの肉球が見えます。茶色の毛と黒いベストは識別できます。後ろ足は画面外なので、全身の肢体数は確認できません。

直立入力:指差しと親指のような形

直立入力の元動画を開く。

こちらも猫が左、女性が右です。前肢を上げて指差しや親指のような形を作り、前半から中盤の複数サンプルで指差し姿勢が続きます。表演のジェスチャーと分かりますが、常に自然な猫の前足ではありません。一方が他方より優れているという評価はしません。

両ファイルはH.264、854×480、約15.04秒で、音声ストリームはありません。0、5、10、14.5秒と、1秒1枚のフレーム列を確認しました。これはフレーム列の確認であり、連続再生や定量的なタイミング評価ではありません。[1]

静止画は肢体の輪郭確認に役立ちますが、姿勢が動作中も続くかは全体再生で見る必要があります。正確率、リップシンク点数、一般的な成功率は算出していません。短い良い場面だけでは全動作の正確な再現を証明できません。

比較時はマイク付近の前肢、右側女性との位置関係、ジェスチャーの切り替わりを見てください。最後も冒頭と同様に確認します。個体の見た目、体の形、動作のタイミングは別の評価項目です。1つが満たされても、別の項目で期待と違う可能性があります。

姿勢ごとに1回の試験で分かる範囲

タスク完了が示すのは、そのリクエストに結果が返ったことです。他の猫写真でも同じになる保証はありません。2つの動画から、不自然な足の頻度、最良のプロンプト、別モデルの優劣も決められません。

編集上の提案は、動画に費用を使う前に目的のシルエットを確認することです。人間のように直立した演者を作るなら、直立コンセプト画像はその意図を明確にします。自然な四足の動物を保つなら、出力がその目標を満たすかを確認し、人間の動作テンプレートが四足を維持すると仮定しないでください。これは準備方針であって、結果保証ではありません。

生成した茶トラ猫は流れの検証用ですが、本物のペットの顔や模様が厳密に保たれる証拠ではありません。自分のペットを試す場合は使用権のある写真を用い、入力と出力を比較してください。リクエストとタスクIDを残すと、同じタスクの失敗と新たな試行を区別できます。

条件の間でプロンプトは変更していません。姿勢、解剖指示、動作、モデルを同時に変えると、見栄えが改善しても理由を解釈しにくくなります。動物専用表現を別に試すことはできますが、ここでは未実施のテストを検証済み改善として扱いません。

動物のデュエットを準備し、確認する

  1. 自然な動物か、直立する架空の演者かを先に決め、結果を判断する目標にします。
  2. 全身、尻尾、足の間隔、顔、服を拡大して確認します。これは編集上のチェックで、効果を保証するモデル要件ではありません。
  3. 左右を明示します。今回は猫が左のImage 1、女性が右のImage 2です。
  4. 最初の確認では動作と設定を固定し、プロンプトの人間的な解剖表現も記録します。
  5. 動画全体を見ます。大きな動作、回転、最後で止めて、肢体の接合、変形、増えたように見える部分を確認します。
  6. 共有前に完成音声と映像を確認します。正しい音楽でも変形した足や左右の間違いは直りません。

現在の設定と料金はSeedance 2.5モデルページで確認できます。再試行前にはツールの見積もりを確認してください。

ペット動画は音声生成なしでリクエストし、後からの音声合成も行っていません。成人サンプルでは元の音声を別工程で追加しました。サイトは生成後にその工程を自動実行します。モデルの音声生成を有効にすることとは別で、曲を正確にコピーした証拠でもありません。[2]

よくある質問

動物を先に直立させる必要がありますか?

今回の四足入力1例では、事前の直立画像なしで上半身が直立しました。普遍的な規則ではありません。目的が直立キャラクターなら、その入力から始めて全出力を確認できます。

2枚は同じ猫ですか?

いいえ。説明は共通ですが、独立生成した架空の茶トラ猫です。姿勢、体型、模様、ベストが違うため、厳密な個体比較ではありません。

Seedance Miniも試しましたか?

いいえ。両方ともSeedance 2.5、doubao-seedance-2.5-faceです。Miniや別モデルの結果として扱わないでください。

ペット用にプロンプトを最適化しましたか?

いいえ。成人用の「hair」「hands」も両条件に残しました。動物用表現の比較や最良の表現の検証はしていません。

なぜペット動画に音楽がありませんか?

generate_audio: falseで生成した元下書きで、後からも合音していません。サイトの最終音声処理は別工程で、成人例がそれを示します。

完璧な動作転送を証明していますか?

いいえ。指定条件で見える動作を報告しており、反復試験や定量的タイミング分析はありません。タスクが完了しても全ジェスチャーの一致は証明されません。

自分のペット写真を使えますか?

ツールは参考画像を受け付けますが、今回の入力は架空の猫です。あなたの写真の動作は未検証です。入力と見積もりを確認し、期待する個体と姿勢に対して出力を評価してください。

欲しいシルエットを選ぶ

この2例を確認できるサンプルとして使い、全動物の規則と考えないでください。明瞭な入力と左右指定を残し、共有や再試行前に全動作を確認します。Hotel Lobby AIのペット動画では、参考キャラクターと最終的な体型が作りたいデュエットに合うかが実用的な判断です。Hotel Lobby AIワークスペースを開くか、2枚の写真の全体ガイドから始めてください。

次の手順は、プロンプトと参考素材のガイド、費用と単発利用の解説、テンプレートと生成のトラブル対処で確認できます。

参考資料

  1. reAPI Team。ペット姿勢実験、2026年10月10日。 実入力と元動画を本文に掲載。GPT Image 2が2タスク、Seedance 2.5が2リクエストで、姿勢ごとに動画1本です。公開実験記録。
  2. reAPI。Hotel Lobby AIツールと記録済み成人サンプル。 2026年10月10日に確認。reapi.ai/tools/hotel-lobby-ai。
すべてのガイド