Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Kling 运动控制 API:v2.6 vs v3、价格与输入准备
2026/08/23

Kling 运动控制 API:v2.6 vs v3、价格与输入准备

选择合适的朝向模式、源视频时长、计费档位和参考图像来运行 Kling Motion Control v2.6 或 v3,有效减少人脸和身体漂移。

Kling 运动控制从一张参考图像的主体转移 3 到 30 秒参考视频的运动。 用 v2.6 Standard 获取最便宜的验证通路,每源视频秒 $0.063;当预算允许时用 v3 获得更新的一致性级别。朝向设置也改变最大源视频时长:图像朝向允许 3 到 10 秒,视频朝向允许 3 到 30 秒。[1]

大多数怪到模型头上的身份漂移始于静止图像和驱动视频之间的错配。价格很重要,但输入几何优先。

v2.6 vs v3 价格

reAPI 公开费率查证于 2026 年 8 月 23 日:

模型StandardPro10 秒 Standard10 秒 Pro
Kling v2.6 Motion Control$0.063/s$0.101/s$0.63$1.01
Kling v3 Motion Control$0.114/s$0.151/s$1.14$1.51

服务器探测源视频时长,向上取整计费秒数,乘以选定的模型和模式。没有客户端时长字段。[2]

7.2 秒的驱动片段计费为 8 秒。修剪上传前的未使用的导入和尾部帧可以省钱,减少主体不需要跟随的运动。

两种朝向模式容易混淆

character_orientation 决定哪个输入控制主体的朝向:

取值朝向跟随源视频时长
image参考图像3 到 10 秒
video参考视频3 到 30 秒

当静止图像的呈现必须保持主导地位时用 image:正面肖像、类似产品的角色视图,或特定服装轮廓。当表演转身、旋转、穿过镜头或改变朝向而输出应跟随它时用 video

错误的选择可能看起来像脸部漂移。如果一张正面的静止图像被强制跟随一个转向轮廓的驱动程序,而朝向仍然以图像主导,模型在解决相互矛盾的几何体。

最小请求

{
  "model": "kling-v2-6-motion-control",
  "prompt": "Follow the reference performance and timing. Keep the face, hair, and jacket from the subject image.",
  "image_url": "https://files.example.com/subject.png",
  "video_url": "https://files.example.com/motion-8s.mp4",
  "character_orientation": "image",
  "mode": "std",
  "keep_original_sound": "yes"
}

提示、图像、视频、朝向和模式是必需的。两个媒体字段必须是公网 URL;驱动视频应该是 MP4 或 MOV,不超过 100 MB。[2]

为什么脸改变了

脸部漂移很少有一个原因。按顺序检查这些。

1. 驱动程序显示静止图中缺失的角度

单个正面肖像不定义鼻子、下巴、耳朵或从侧面看的头发。如果动作片转九十度,模型必须编造它们。

选择最重要角度的参考图像,或使用停留在可用视图附近的驱动程序。运动控制接受一个主体图像,所以那一帧的质量比未使用参考的文件夹更重要。

2. 脸占用太少像素

全身图像可能对服装很好,对身份很差。裁剪得足够紧,使眼睛、鼻子、嘴和发际线清晰可见,同时保持运动需要的身体部位。

对于舞蹈,一个清洁的全身源与高分辨率的脸比遥远的环境照片更好。避免运动模糊、美颜滤镜和重压缩。

3. 身体比例不一致

具有长肢、宽松服装或非常不同轮廓的驱动程序可以将生成的身体拉离静止。选择具有相似框架、身体比例和服装体积的表演者。

4. 遮挡强制重建

手穿过脸部、快速旋转、头发遮住眼睛和离开框架都会移除身份证据。修剪驱动程序到一个更简单的部分作为第一次测试。

5. 提示要求另一个重新设计

"未来头盔中的电影战士"可以与"保持这个人的脸"冲突。提示应描述运动、摄像机、照明和不变量。除非改变身份是可接受的,否则不要添加第二个角色设计。

便宜的验证阶梯

  1. 修剪驱动程序到 3 到 5 秒围绕重要运动。
  2. 从 v2.6 Standard 开始。
  3. 仅当运动使两种模式都合理时,测试两种朝向模式。
  4. 修复图像/驱动程序错配,然后提高质量。
  5. 将已接受的输入对移至 v3 Standard。
  6. 仅在 Pro 的输出改进值得费率时使用 Pro。

切换到 Pro 不能向参考图像添加缺失的轮廓视图。支出应遵循输入清理,而不是替代它。

准备驱动片段而不是上传整个表演

运动控制对其收到的片段计费,模型必须解释内部的所有内容。切割驱动程序到属于结果的运动。

上传前:

  • 移除计数和表演者走到位置的部分;
  • 当肢体运动很重要时保持主体完全可见;
  • 避免在一个驱动程序内进行硬摄像机切割;
  • 裁剪或重新框架使表演者在框架中占据与静止类似的部分;
  • 在手或脸定义动作的地方减少极端运动模糊;
  • 除非需要有意的重新计时,否则保持原始帧速率;
  • 检查直接 MP4/MOV URL 是否可公网获取且在 100 MB 以下。

一个十秒的清洁驱动程序通常比 28 秒的蒙太奇给出更好的诊断。一旦输入对有效,更长的视频朝向请求可以将表演扩展到文档化的 30 秒上限。

单独评分运动和身份

一个输出可以正确跟随身体同时改变脸,或保留肖像同时变平运动。有用的评审表将那些失败分开:

维度问题
身份脸、头发、衣服和身体比例是否可识别?
运动时序、方向、肢体路径和体重转移是否保留?
朝向朝向是否遵循选定的图像/视频规则?
遮挡恢复手、转弯或头发覆盖脸后身份是否返回?
框架主体是否保持在预期的裁剪内?
音频源音频是否正确保存或移除?

在 v2.6 Standard、v3 Standard 和(仅如果需要)v3 Pro 上使用相同的清洁对。跨层比较不同的源裁剪无法告诉你模型版本是否改进了任何东西。

从舍入的源长度估计成本

因为账单使用舍入探测的时长,一批刚超过整数边界的片段会产生小的可避免的溢价。二十个 10.1 秒的驱动程序计费 220 秒,而不是 202。修剪每个到恰好十秒减少计费总额,而不移除有意义的运动。

以 v3 Standard 计,这两个总数约为 $25.08 和 $23.03,使用显示的 $0.114 费率。不要为了省几美分而不自然地加速一个动作,但在大批之前移除意外的尾部帧。

保持或丢弃原始声音

keep_original_sound 默认为 yes。保持它对舞蹈、唇同步和表演参考很有用。当驱动程序包含指导音频、版权音乐、房间噪音或不应该发送的对话时,将其设置为 no

该设置不改变用于账单的探测源时长。

生产中要记录什么

保存模型 id、模式、朝向、源时长、输入 URL、提示、任务 id 和最终状态。当某人报告"v3 改变了脸"时,那些字段显示模型版本是否改变或源是否被修剪、重新压缩或用另一个朝向提交。

Kling 运动控制模型页面有实时四单元价格表。API 文档列出源时长规则、有效载荷字段和验证错误。

References

  1. reAPI Kling Motion Control model and pricing page, accessed August 23, 2026.
  2. reAPI Kling Motion Control API documentation, accessed August 23, 2026.