
完整指南:用一张产品照片制作多场景AI视频广告
从单张产品照片到专业多场景AI视频广告的详细端到端工作流:创意简报、镜头卡、参考规则、提示词、API示例和完整质量检查。
将一张产品照片转变为多场景AI视频广告,本质上是一个计划问题。 模型能生成吸引人的运动,但它无法决定你的目标受众、核心信息、镜头顺序、产品规则和交付格式,除非你事先明确这些决定。
这个初级工作流从一张清晰的产品照片出发,建立六场景计划,独立生成短镜头,并在剪辑前逐一审核。它不假设生成的文字标签总是可靠的。关键文案、价格、免责声明和行动号召属于后期制作范畴。
TL;DR
- 为一个受众、一个消息、一种交付格式开始。
- 清理产品照片,列出不能改变的细节。
- 按目的而非视觉新奇度规划六个镜头。
- 在精确剪辑很重要时,独立生成短镜头。
- 保持产品锚点和负面约束在整个批次中保持一致。
- 在关注风格之前,批准轮廓、标签布局、数量、接触和结尾画面。
- 在生成后,在编辑器中添加确切的文字、定价和法律文案。

一张产品照片能提供和不能提供什么
一张好的产品固定镜头可以确定颜色、轮廓、盖子形状、宽泛的标签布局和表面材质。但它无法显示产品的每一侧、隐藏几何形状、盖子如何打开,或六个不同场景中应该发生什么。
把源图像视为证据,而不是完整的3D模型。如果广告需要准确的背面标签、机制或照片未显示的视图,请捕获另一个参考或避免该角度。
最安全的源照片具有:
- 一件产品,完全可见;
- 纯净或可移除的背景;
- 均匀的光线,没有过曝亮点;
- 足够的分辨率来检查边缘和标签位置;
- 没有手覆盖重要几何形状;
- 明确的商业使用权。
如果包装排版必须完全准确,计划在后期合成标签或产品板。ByteDance自己的Seedance 2.0评估指出文字渲染准确度仍有改进空间。[1]
第一步:写一份单页创意简报
在广告有一个工作目标之前,不要要求场景。
{
"product": "unscented facial moisturizer",
"audience": "people with dry skin who dislike heavy creams",
"single_message": "light texture, comfortable daily use",
"proof_to_show": "thin texture spreads quickly and leaves no visible residue",
"format": "9:16 social video",
"length": "18 seconds",
"tone": "clean, calm, practical",
"cta_added_in_post": "See ingredients",
"claims_to_avoid": [
"medical treatment",
"guaranteed results",
"unverified before-and-after claims"
]
}single_message字段防止故事板变成目录。一个18秒的广告无法解释每一个好处。选择一个视觉能够真正支持的要点。
第二步:创建产品身份契约
编写一次产品规则,并在每个镜头中重复使用。
{
"must_keep": [
"one white cylindrical bottle",
"short matte-white pump",
"label remains centered and rectangular",
"thin cobalt band near the base",
"bottle height-to-width ratio",
"no additional words, logos, badges, or products"
],
"may_change": [
"background",
"camera angle within visible reference evidence",
"lighting softness",
"supporting props"
],
"never_generate": [
"exact marketing copy",
"price",
"rating",
"medical claim",
"disclaimer text"
]
}这个契约比重复"保持产品一致"更有用。它列出了一个人或代理可以审查的可观察条件。
对于复杂的摄像机移动,白色模型或额外角度可以改进空间指导。现有的Seedance电商工作流解释了该参考层次结构。本教程重点关注用最小起始资源规划广告。
第三步:按功能规划六个场景
每个镜头都应该在剪辑中发挥作用。
| 镜头 | 时长 | 目标 | 视觉计划 | 结尾画面 |
|---|---|---|---|---|
| 1. 打破常规 | 2s | 停止滚动 | 产品瓶轮廓通过柔和前景阴影进入 | 产品居中 |
| 2. 身份 | 3s | 展示它是什么 | 缓慢20度轨道,标签侧可见 | 正三角视图 |
| 3. 质地 | 3s | 展示证明 | 少量分配到清晰玻璃上 | 滴充分分离 |
| 4. 使用 | 4s | 演示应用 | 手在前臂上涂薄层 | 无可见残留物 |
| 5. 情境 | 3s | 放在日常中 | 瓶子在浴室架子上的毛巾和水旁 | 产品畅通无阻 |
| 6. 英雄 | 3s | 创建CTA板 | 锁定特写,上方有负空间 | 一秒钟保持 |
这个顺序从注意力到身份、证据、使用、情境和编辑就绪的完成。不同的产品可能需要不同的功能,但镜头应该仍然有工作。
第四步:将每个场景转变为镜头卡
镜头卡分离固定产品规则与该镜头中要求的变化。
{
"shot_id": "03-texture",
"purpose": "show lightweight texture",
"duration": 3,
"start_state": "bottle upper third visible, pump untouched",
"action": "one slow pump dispenses a small translucent drop onto clear glass",
"camera": "locked macro side view",
"light": "large soft source from upper left",
"end_state": "drop fully separated, bottle shape unchanged",
"must_keep": [
"one bottle only",
"same pump and cobalt band",
"no added text"
],
"reject_if": [
"pump changes shape",
"two drops appear",
"liquid originates outside nozzle",
"label becomes invented text"
]
}reject_if字段将主观评审转变为可用的检查清单。它也支持稍后的选择性AI视频评论员循环。
第五步:在一次长生成和独立镜头之间决定
当模型能够创建一个连贯的多场景序列并且确切的编辑时序并不关键时,一次长生成是方便的。独立镜头让你对时长、修复和顺序有更多控制。
对于第一个活动,生成独立镜头,因为:
- 一个失败的纹理镜头不会摧毁英雄镜头;
- 每个提示词保持专注;
- 编辑可以改变速度而不重新生成;
- 不同的镜头可能需要不同的参考;
- 最终的CTA保持可以独立扩展。
一旦镜头卡起作用,你可以测试模型是否可以在一次通过中处理六个场景序列。
第六步:编写可重复使用的提示词头
将身份契约放在每个请求的顶部。
Image 1 is the product identity anchor. Preserve one white cylindrical bottle,
the short matte-white pump, the centered rectangular label layout, the thin
cobalt band near the base, and the bottle's height-to-width ratio.
Do not add words, logos, badges, ratings, prices, extra bottles, or packaging.
Do not redesign the pump or label. Keep the product fully opaque and physically
grounded.然后仅追加活跃镜头卡:
SHOT 03 — TEXTURE
Locked macro side view. One slow pump dispenses a small translucent drop onto
clear glass. The liquid must originate at the nozzle and separate into exactly
one drop. Large soft light from upper left. End with the drop fully separated
and the bottle unchanged. No camera movement, hands, captions, or music.这使提示词保持一致而不使其相同。
第七步:生成720p布局通过
使用较低分辨率的测试,直到构图和产品完整性通过。然后以所需的交付分辨率重新运行批准的镜头卡。
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "Image 1 is the product identity anchor. Preserve one white cylindrical bottle, short matte-white pump, centered label layout, cobalt band, and proportions. Do not add text, logos, badges, prices, or extra products. Locked macro side view. One slow pump dispenses exactly one small translucent drop onto clear glass. End with the drop fully separated and bottle unchanged.",
"image_urls": ["https://example.com/product-packshot.png"],
"resolution": "720p",
"size": "9:16",
"duration": 4,
"generate_audio": false
}'Seedance 2.5通过reAPI接受文本、图像、视频和音频参考,但允许的组合取决于任务模式。使用实时API文档作为实现的真实来源。
第八步:在美学之前审查产品真实性
按此顺序检查产品:
- 数量: 当镜头要求一个时,恰好一个产品。
- 轮廓: 高度、宽度、盖子、泵和边缘保持稳定。
- 标签布局: 主要块保持在正确位置。
- 接触: 手、液体、表面和产品合理地相互作用。
- 动作: 计划的事件发生一次并按正确顺序发生。
- 结尾画面: 镜头落在编辑所需的构图上。
- 风格: 照明、布景、颜色和完成支持简报。
一个吸引人的镜头配扭曲的产品是失败。一个简朴的镜头配正确的产品往往可以通过照明、背景或编辑改进。
第九步:组装编辑并添加确切副本
将批准的镜头带入编辑器。为最终平台剪切,而不是强行将每个生成的时长放入时间线。
在后期制作中添加这些元素:
- 在需要时验证的产品名称和标签板;
- 标题和行动号召;
- 价格和优惠日期;
- 法律或安全免责声明;
- 品牌字体和准确的颜色;
- 获得许可的音乐、旁白、字幕和音混。
这种分离保护准确性。生成视频创建运动板;编辑创建最终通信工件。
第十步:记录获胜配方
保存源图像、创意简报、身份契约、镜头卡、提示词、模型ID、请求设置、接受的输出和修复备注。下一个产品应该重复使用结构,而不是前一个产品的视觉细节。
/campaign
/source
/shot-cards
/prompts
/generated
/approved
/edit
production-notes.md一个可重复的文件结构是代理工作流的开始。代理可以读取镜头卡、提交任务、轮询结果、运行检查并请求人工审查,而无需发明活动策略。
常见初级错误
要求一个提示词发明活动
模型将根据视觉概率选择场景,而不是你的漏斗或声明。首先编写简报和镜头工作。
显示源照片不支持的角度
隐藏几何成为发明。捕获另一个产品角度或将摄像机保持在参考证明的范围内。
生成确切的促销文本
不要相信生成的文本中的价格、声明或免责声明。从批准的来源在后期添加。
在镜头之间改变产品规则
保持相同的身份头和源照片。只有活跃镜头卡应该改变。
在一个失败后重新生成整个广告
修复失败的镜头。独立镜头的存在是为了让接受的工作保持冻结。
FAQ
一张产品照片真的能支持六个场景吗?
是的,当场景保持在可见的几何范围内并使用照片作为一致的锚点时。当广告需要隐藏侧面或确切的机械行为时,捕获更多角度。
我应该在一个镜头中生成所有六个场景吗?
初级用户应该从独立镜头开始。单一生成对于连贯的流程很有用,但它更难修复和精确编辑。
我如何保持产品一致?
重复使用相同的清洁锚点,重复可观察的身份契约,避免不支持的角度,并在评估风格之前拒绝轮廓或标签漂移。
我应该在什么分辨率测试?
当可用时,使用较低成本的布局通过,如720p,然后将批准的镜头卡移动到最终分辨率。检查实时费率表,因为计费是特定于模型和配置的。
代理能自动化这个工作流吗?
是的。创意简报、镜头卡、拒绝规则和文件结构给代理有限的决定。对声明、产品真实性、品牌副本和最终编辑保持人工批准。
结论
当工作流提供缺失的生产决定时,一张产品照片可以成为一个有用的多场景AI视频广告。锁定消息和产品真实性,给每个镜头一个工作,独立生成和审查镜头,并在后期制作中添加确切的通信。可重复使用的资源不是神奇提示词;它是简报、身份契约和镜头计划一起工作。
References
- ByteDance Seed. Seedance 2.0 Official Launch. February 12, 2026. seed.bytedance.com
- ByteDance Seed. One-take Creation, Flexible Referencing: Introducing Seedance 2.5. July 31, 2026. seed.bytedance.com
- reAPI. Seedance 2.5 API — Parameters, Modes & Billing. Retrieved August 27, 2026. reapi.ai
作者

分类
更多文章

Wan 2.7 视频 API:1080p、音频和调用限制
使用 Wan 2.7 视频 API 处理文本、图像、参考和视频编辑工作流。学习 1080p 定价、音频控制、2–15 秒限制和代码。


Seedance 2.0 能在本地运行吗?真正可行的方案
Seedance 无法在本地运行,因为官方从未发布模型权重。本文给出证据、真正能在家中运行的开放权重视频模型,以及 API 方案。


真人 AI 视频生成器:哪些做法真的可行
用真人素材制作 AI 视频:如何准备合规参考图、挑选支持原生对白的模型,并逐项核对输入限制、审核结果与实际生成成本。
