
图像转视频 API 对比:2026 年价格、输入形式、免费额度
六款图像转视频 API 的输入形式完整对比:源图像、参考图、首末帧三种输入方案,跨六款模型的实时按秒计价详情及价格对照表,最低 $0.03/s。
如果你在寻找一个图像转视频 API 来实现从静止画面自动生成视频,2026 年 8 月的价格范围从每秒 $0.03 到 $0.18 及以上,差异最大的地方在于不同模型对"图像转视频"的理解各不相同。有些 API 对单个源图像进行动画处理,有些将图像视为身份或风格参考,在其基础上生成全新场景,还有一种接受首帧和末帧,然后填补中间的动作。
这是三种完全不同的任务,如果在选择输入形式之前就按价格选择模型,自动化管道往往需要重建两次。本指南首先按输入形式对六款模型进行分类,然后给出实时按秒计费的价格和自动化脚本,所有数据均采集自 2026 年 8 月 reAPI 上的模型页面。
要点速览
- 最便宜的静止画面动画方案,也是最便宜的首末帧路由: Seedance 2.0 Mini,价格为 $0.049875/s(480p 纯图像生成)[2]。其 $0.0315 的源视频费率不适用于图像或首末帧。
- 最简单的单图像路由: Grok Imagine Video 1.5 接受恰好一个源图像,在官方层级上以 $0.03/s(480p)运行,$0.06/s(720p)[1]。
- 最多参考图像容纳量: Seedance 2.5 每次请求接受最多 30 张参考图像[4];MiniMax H3 可接受 9 张加首末帧[5]。
- 首末帧控制 是稀有功能:在这六款中,仅 MiniMax H3 和 Seedance 2.0 Mini 同时暴露了片段首尾作为输入[2][5]。
- 此列表中没有 API 提供无限免费生成;视频推理成本太高而无法免费提供。注册额度用于测试,按秒计费意味着实际预算在每个测试片段不到一美元。
"图像转视频"背后的三种输入形式
源图像动画。 模型接收一张图像并从中生成动作:该图片是第一帧或接近第一帧。Grok Imagine Video 1.5 是这种形式的纯粹版本;其 image_urls 字段是必需的,只接受一张图像[1]。这是人们通常说的"让我的照片动起来"。
参考驱动生成。 图像引导身份、产品或风格,同时模型构建全新场景。Seedance 2.5 接受最多 30 张参考图像,Kling 3.0 和 Vidu Q3 各接受最多两张[4][3][6]。跨一系列片段的角色一致性就在这里实现。在 Seedance 2.5 上,图像参考保持在 $0.118589/s 的 480p 基准费率上;只有源视频才能选择 $0.071153 的费率,其时长也会成为计费对象[4]。
帧插值。 提供首帧,可选末帧,模型将它们连接起来。MiniMax H3 同时暴露 first_frame_url 和 last_frame_url 加上最多九张参考图像[5],Seedance 2.0 Mini 也提供同样的帧字段加九张图像参考,但价格低廉[2]。这是用于分镜拍摄的控制力强的形式。
六个图像转视频 API 的实时计价
所有六个在 reAPI 上的同一端点运行;下表价格是 2026 年 8 月检索的列出的按秒价格。
| 模型 | 输入形式 | 图像槽位 | 片段长度 | 最低列出价格 |
|---|---|---|---|---|
| Seedance 2.0 Mini | 首末帧 + 参考 | 9 + 2 帧 | 4–15 秒 | $0.049875/s(480p)[2] |
| Vidu Q3 | 参考 | 最多 2 张 | 1–16 秒 | $0.0368/s(540p turbo)[3] |
| Grok Imagine Video 1.5 | 源图像(必需) | 1 张 | 1–15 秒 | $0.03/s(480p)[1] |
| MiniMax H3 | 首末帧 + 参考 | 9 + 2 帧 | 4–15 秒 | $0.1125/s(768P,含音频)[5] |
| Kling 3.0 | 参考 | 最多 2 张 | 3–15 秒 | $0.077/s(无音频)[6] |
| Seedance 2.5 | 参考 | 最多 30 张 | 4–30 秒 | $0.118589/s(480p,图像输入)[4] |
分辨率上限不同:Grok 在该界面最高 720p[1],Vidu Q3 列出 1080p 层级最高 $0.1472/s[3],Kling 3.0 有 4K 层级 $0.3685/s[6]。这里的每个模型都拒绝 base64 上传;图像作为公开 HTTPS URL 输入。
一张图生成八秒视频的成本
同样的八秒任务,每个模型的最便宜适用层级:
| 模型、层级 | 8 秒片段 |
|---|---|
| Grok Imagine Video 1.5,官方 480p | $0.24[1] |
| Vidu Q3,turbo 540p | $0.29[3] |
| Seedance 2.0 Mini,图像输入 480p | $0.304[2] |
| Seedance 2.5,图像参考 480p | $0.949[4] |
| Kling 3.0,标准无音频 | $0.62[6] |
| MiniMax H3,标准含音频 | $1.46[5] |
价差约为 6 倍,最便宜和最昂贵层级之间,这就是为什么输入形式决策应该优先。用 H3 费率来动画化单个产品照片会购买你没在使用的控制力;将单个静止画面输入参考驱动模型并期望首帧保真会产生你不想要的不同场景。
用 Python 自动化管道
自动化是一个循环:每个图像提交一个任务,轮询每个任务 id,收集输出 URL。额度是 1 额度 = $0.001 预付的,失败任务会自动退款,所以批处理中的坏 URL 不花钱[1]。
import requests, time
API = "https://reapi.ai/api/v1"
HEADERS = {"Authorization": "Bearer rk_live_..."}
images = [
"https://your-cdn.com/product-01.png",
"https://your-cdn.com/product-02.png",
]
tasks = []
for url in images:
r = requests.post(f"{API}/videos/generations", headers=HEADERS, json={
"model": "grok-imagine-video-1.5-beta",
"image_urls": [url],
"prompt": "Slow 180-degree orbit around the product, studio lighting",
"resolution": "480p",
"duration": 8,
}, timeout=30)
tasks.append(r.json()["id"])
for task_id in tasks:
while True:
poll = requests.get(f"{API}/tasks/{task_id}", headers=HEADERS).json()
if poll["status"] in ("completed", "failed"):
print(task_id, poll["status"], poll.get("output") or poll.get("error"))
break
time.sleep(2)生产环境中需要注意两点:保持总请求速率低于平台的 5 请求/秒限制(包括轮询),并在快速响应的主机上暂存源图像,因为模型是服务端获取每个 URL。
"免费无限"问题
一个常见搜索是免费无限的图像转视频 AI。它在任何平台上都不以此名义存在,因为视频推理在完整渲染时间内占用昂贵的加速器;任何标榜为无限的产品都会在别处对你计费,通过队列、限流、水印或分辨率上限。存在的是:无需卡的注册额度,足以运行真实测试调用,以及之后按秒计费。按上述费率,一个 480p 八秒测试成本约两毛五。在此表中测试每个模型的自己素材成本约 $3.86,这是为自动化管道背后的引擎选择的可辩护行项目。
常见问题
你能推荐用于图像自动生成视频的 API 吗?
将 API 匹配到任务:Grok Imagine Video 1.5 用于以 $0.03/s 动画化单个静止画面[1],Seedance 2.5 用于参考密集的角色或产品工作[4],MiniMax H3 当你需要锁定首末帧时[5]。它们都通过 reAPI 上的一个端点运行,所以自动化代码在切换模型时保持不变。
有免费无限的图像转视频 AI 吗?
没有。GPU 时间让无限免费视频生成在经济上不可行,使用该措辞的产品通过队列或输出限制进行计费。免费注册额度用于测试加上从 $0.049875/s 开始的按秒费率是市场的真实样貌[2]。
哪个图像转视频 API 最便宜?
对于纯图像驱动的任务,Seedance 2.0 Mini 从 $0.049875/s 开始,Vidu Q3 Turbo 从 $0.0368/s,Grok Imagine Video 1.5 从 $0.03/s[1][2][3]。Mini 的更低 $0.0315 费率需要实际源视频并对源加输出时长计费,所以它不是图像转视频价格。
我能同时控制首末帧吗?
MiniMax H3 和 Seedance 2.0 Mini 都在一个请求中接受 first_frame_url 和 last_frame_url[2][5]。这些是用于分镜序列的工具,其中片段 N 的结尾必须匹配片段 N+1 的开始。
我能发送多少张参考图像?
Seedance 2.5 接受最多 30 张,MiniMax H3 和 Seedance 2.0 Mini 各最多 9 张,Kling 3.0 和 Vidu Q3 各最多 2 张,Grok Imagine Video 1.5 恰好 1 张[1][3][4][5][6]。更多槽位成本更高每秒,所以发送锁定身份所需的最少集合。
图像转视频输出包括音频吗?
MiniMax H3 始终按平费率生成音频;Seedance 2.5 默认启用音频;Kling 3.0 分开定价音频和无音频层级[4][5][6]。Grok Imagine Video 1.5 和 Vidu Q3 按此界面的分辨率层级定价。
实践中选择输入形式
决定图像是什么:首帧、参考,或两个端点之一。这个单一决定消除了大部分表格。然后让价格对幸存者排序,花费一批注册额度在两个候选人上运行自己的静止画面,然后才将任一方有线到生产环节。图像转视频 API 通过在第五百张图像时的表现与第一张图像一样来赚取在管道中的位置,且 $0.24 每测试片段,证明这花费的成本少于一个错误的下午返工。
参考资料
- reAPI. Grok Imagine Video 1.5 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/grok-imagine-video-1-5
- reAPI. Seedance 2.0 Mini — model page with live pricing and source-video billing. Retrieved August 17, 2026 from reapi.ai/models/seedance-2-0-mini
- reAPI. Vidu Q3 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/viduq3
- reAPI. Seedance 2.5 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/seedance-2-5
- reAPI. MiniMax H3 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/minimax-h3
- reAPI. Kling 3.0 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/kling-3-0
进一步阅读
- reAPI. Hailuo AI compared: Seedance 2.5, Kling 3.0, Veo 3.1. reapi.ai/blog/hailuo-ai-vs-other-ai-video-generators
- reAPI. Seedance 2.0 vs Kling 3.0. reapi.ai/blog/seedance-2-0-vs-kling-3-0-2026
更多文章

DeepSeek V4 Flash 正式版发布:0731 Agent 与 Codex 升级
DeepSeek V4 Flash 0731 正式版进入 API 公测:模型 ID 不变,Agent 能力增强,原生支持 Responses API,并完成 Codex 适配。


AI 视频:Higgsfield 之外的 6 个最佳替代平台
Higgsfield 替代品对比:reAPI、Atlas Cloud、fal、Replicate、Krea 和 Dreamina 的工作流、计费模式和可用性评测。


Seedance 2.5 发布验证:30 秒已确认,4K 支持待核实
Seedance 2.5 支持 30 秒视频生成、多模态参考、时间戳控制和视频编辑。本文详细验证了 4K、API 接口和输入限制等官方声明的真实情况。
