Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Seedance 2.5 图像转视频:首帧、输入与费用
2026/09/12

Seedance 2.5 图像转视频:首帧、输入与费用

了解 Seedance 2.5 图生视频的首帧、首尾帧和多图参考用法。查看有效 API 参数、真人参考图要求,以及生成 10 秒视频的计费方式。

Seedance 2.5 图像转视频在 reAPI 上使用一个模型标识 doubao-seedance-2.5-face,采用不同的图像字段处理不同的任务。当视频应该从特定的构图开始时,使用明确的首帧;当开始和结束两个关键点都很重要时,使用首尾帧;当你希望模型在构建新场景时以视觉指导为依据时,使用参考图像。[1]

这种区分会影响你提交的 JSON。帧角色需要 size: "adaptive";参考图像输入允许选择纵横比。对于 10 秒、720p 分辨率、包含图像但无参考视频的请求,9 月 12 日的价格在积分向上取整后为 $2.669。Seedance 2.5 在线试用区和接口文档会展示可用的控制选项。[1][2]

快速总结

  • 使用 image_with_roles 配合 role: "first_frame" 来请求特定的可视首帧。将 size 设置为 adaptive[1]
  • 需要第二个端点时,添加一个 last_frame 条目。尾帧需要首帧;每个角色最多出现一次。[1]
  • image_urls 用于参考图像。接口接受最多 30 张,但你无需填满这个限制。[1]
  • reAPI 支持真人参考图像,并自动进行审核。审核拒绝会导致任务失败并全额退款。[2]
  • 图像参考不增加计费的源视频秒数。一个 10 秒的 720p 图像请求在 9 月 12 日无视频费率下费用为 2,669 积分。[1][2]

选择 Seedance 2.5 图像转视频的输入形式

在选择上传字段前,先明确图像必须控制什么。首帧定义初始构图;参考图像可以改为提供人物、物体或场景的外观。即使使用同一个源文件,这两种方式也是不同的指令。

你的目标请求字段纵横比结果中要检查的内容
动画化特定的首帧构图image_with_roles 配合 first_frameadaptive首帧、请求的动作和不期望的背景变化
在两个指定的构图间过渡image_with_roles 配合首帧和尾帧角色adaptive两个端点和它们之间的过渡
在新场景中使用一个或多个视觉参考image_urls选择被接受的 size身份、物体外观和每个参考的指定角色

输入字段和纵横比约束是有文档记载的接口行为。检查列是一份编辑清单,而非对某个输入字段能完美保留视觉内容的承诺。[1]

对于简单的照片动画,先从一个明确的首帧和一个可见的动作开始。如果目标是在新描述的位置放置两个被引用的人物,则改为从参考图像开始。在你知道需要哪种控制之前添加更多源文件,会同时让提示词和结果都变得更难解读。

动画化一个明确的首帧

明确首帧请求使用 image_with_roles。下面的 cURL 示例使用一个已作为公开样本可用的肖像。将其替换为你自己的许可源图像,并写出你想看到的动作。

curl --fail-with-body https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer $REAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "The adult turns her head slightly toward the camera and gives a small natural smile. Keep the framing, hairstyle, white top and background stable. One continuous shot, no camera movement.",
    "image_with_roles": [
      {
        "url": "https://file.deepytb.com/landing/qwen-image-2/playground-input.webp",
        "role": "first_frame"
      }
    ],
    "duration": 4,
    "resolution": "480p",
    "size": "adaptive",
    "generate_audio": false
  }'

帧提供起始构图,所以提示词可以专注于动作。描述哪个主体如何移动、朝哪个方向移动,以及什么应该保持不动。除非那些细节特别重要需要保留,否则要避免花费大部分提示词重新描述已经可见的细节。

对于固定摄像机肖像,头部或眼睛运动比会暴露场景不可见部分的大相机旋转更容易作为首次测试。对于产品照片,要检查轮廓、手柄位置、标签和反射。这些检查是为了评估输出质量;它们不是强制模型保留那些细节的设置。

提交返回一个任务 id。轮询该任务直到完成,然后读取 output.video_urls接口快速入门提供了完整的提交和轮询示例。[1]

连接首帧和尾帧

当开始和结束图像都很重要时,使用两个明确的角色。最多只能有一个 first_frame 和一个 last_frame,后者不能单独发送。保留 size: "adaptive",因为输出遵循帧输入的形状。[1]

{
  "image_with_roles": [
    {
      "url": "https://your-public-storage.example/start.png",
      "role": "first_frame"
    },
    {
      "url": "https://your-public-storage.example/end.png",
      "role": "last_frame"
    }
  ],
  "size": "adaptive"
}

这是一个部分有效载荷,要与模型、提示词、时长和分辨率组合使用。两个 URL 是占位符。使用示例前,先将实际图像上传到公共存储;本地文件路径或改名的扩展名不能替代可读的媒体文件。

选择描述合理过渡的端点。如果首帧显示一个坐着的人,尾帧显示该人站起来,就要解释站起来的动作并给予足够的时间。如果两张图像还改变了服装、房间几何和摄像机位置,过渡需要协调更多变化。决定你实际想要哪些变化,而不是让它们的解读保持隐含。

像审视端点一样仔细检查片段的中间部分。匹配开始和结束还不足够,当中间运动包含卡顿、变形的手或意外切割时。如果过渡是你需要改进的部分,在添加更多风格形容词前,先修改动作或选择更接近的端点。

为每个参考图像指定一个角色

对于由多张图像指导的新构图,使用 image_urls。接口接受最多 30 个参考图像,每个都必须低于有文档记载的文件大小限制。图像必须通过公开的 HTTP(S) URL 可访问;不接受 base64 数据 URI。[1]

{
  "model": "doubao-seedance-2.5-face",
  "prompt": "Use Image1 for the adult in white and Image2 for the adult in black. Place both in a quiet gallery. The adult in white waves once; the adult in black nods. Keep their hairstyles and outfits distinct. Fixed camera.",
  "image_urls": [
    "https://file.deepytb.com/landing/qwen-image-2/playground-input.webp",
    "https://file.deepytb.com/landing/grok-imagine-video-1-5/playground-input.png"
  ],
  "duration": 4,
  "resolution": "480p",
  "size": "16:9",
  "omni_reference_task_type": "reference",
  "generate_audio": false
}

第一个示例显示一个留着长发、穿白色上衣的成年人。第二个是一个留着短齐肩发、穿深色衣服的成年人的三视图肖像。使用后者时,要指明其面板描绘的是同一身份,这样预期的场景就清楚了。20 提示词库包含用于两参考测试的确切更长提示词和其生成结果。

不要在一个请求中组合 image_urlsimage_with_roles。它们是互斥的。也要将明确的帧角色与 image_with_rolesreference_image 的角色分开;文档将这两者视为不同的请求形状。[1]

在显式帧图像旁边添加 video_urlsaudio_urls 会改变这些图像的使用方式:请求变成多模态参考任务。在这个组合中,将帧视为参考指导,而不是依赖上面描述的严格首尾帧工作流。[1]

当参考集包含多个主体时,在所有权重要的地方重复主体的名称或视觉标签。"穿白色衣服的成年人拿起杯子"比"她拿起它"(在讨论两个人的段落之后)更不容易引起歧义。保留 Image1Image2 标签与实际的输入顺序一致。

上传真人参考和诊断失败

reAPI 支持 Seedance 2.5 的真人参考图像和视频。参考会在生成前通过自动审核,被拒绝的内容会产生带有完整退款的错误。对输入类型的支持不是对每个单独文件都被接受的保证。[2]

使用你有权使用的图像,并在提交前检查主体的预期呈现。如果请求失败,在重写提示词前先读取错误。无法访问的 URL、无效的请求字段和审核拒绝需要不同的响应。

失败首先检查
源 URL 无法读取确认直接媒体 URL 在没有登录浏览器会话的情况下可用
请求拒绝图像字段检查互斥条件和首尾帧角色规则
纵横比错误使用 adaptive 配合明确的帧角色
不支持的格式检查实际的文件编码,而不仅仅是文件名
审核拒绝审视材料和预期内容;检查返回的错误

真人参考错误指南提供了更广泛的故障排除背景。有关确切的接受文件格式和验证规则,请使用当前的 2.5 文档。[1]

一个图像和 10 秒 720p 的费用

仅有图像的请求使用无参考视频费率。9 月 12 日,该费率在 720p 下为每输出秒 $0.266824。因此 10 秒费用为 ceil(0.266824 × 10 × 1000) = 2669 积分,或 $2.669。[2]

无源视频的图像请求输出时长应计总费用
480p4 秒475 积分 / $0.475
720p10 秒2,669 积分 / $2.669
1080p10 秒4,619 积分 / $4.619

这些总费用使用精确的渲染费率,并将整个请求向上取整到一个积分。图像参考不增加计费秒数。如果你添加 video_urls,账单计算会改为包含参考视频时长和有文档记载的最小窗口。[1][2]

在比较输入模式时要保留这个区分。一个包含两张图像的提示词仍然是一个图像参考请求(就这个定价问题而言);仅仅因为它有多个源资源就不会变成参考视频请求。要了解更多模型的选择,请参阅图像转视频接口指南。本文涵盖在你选择了 2.5 后的 Seedance 特定字段选择。

常见问题

Seedance 2.5 图生视频

doubao-seedance-2.5-face 与图像输入一起使用。为特定的首尾帧构图选择明确的帧角色,或为参考图像选择 image_urls[1]

Seedance 2.5 能动画化静止图像吗?

能。对于明确的首帧,在 image_with_roles 中将图像作为 first_frame 发送,设置 size: "adaptive",并描述动作。[1]

Seedance 2.5 首尾帧

发送一个首帧条目和一个尾帧条目。尾帧需要首帧,明确的帧输入需要自适应大小。[1]

Seedance 2.5 怎么传真人参考图

将参考上传到可公开访问的媒体 URL,并通过适当的图像字段传递。真人参考受支持并自动审核。[1][2]

Seedance 2.5 单个视频的费用

一个 10 秒 720p 图像请求(无参考视频)在 9 月 12 日费率下费用为 $2.669,经过整积分向上取整。其他分辨率和时长会改变价格。[2]

Seedance 2.5 参考图像

接口接受最多 30 张图像。仅使用该镜头所需的参考,并在提示词中说明每个应该控制什么。[1]

从镜头需要的图像控制开始

使用一个帧表示特定的开始,两个帧表示指定的端点,或参考图像表示新组合的场景。保持首次测试足够短以便仔细检查。有效的 Seedance 2.5 图像转视频工作流从为图像明确角色开始,以检查实际运动结束。

参考资料

  1. reAPI. Seedance 2.5 API — Parameters, Modes & Billing. 2026年9月12日浏览器获取。reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 rendered pricing and real-person-reference FAQ. 2026年9月12日浏览器获取。reapi.ai/models/seedance-2-5