GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone

MiniMax H3 — 自带原生音频的多模态视频生成

MiniMax H3(亦即 Hailuo 03,海螺03)可将文本、图像、视频片段与音频参考转化为自带原生立体声的 2K 视频。通过一条提示词生成 4–15 秒片段,为首尾帧补全动画,或在一次 MiniMax H3 请求中调度最多 15 个参考文件。

模型特点
4–15 秒 · 帧控制 · 支持图、视频、音频参考
适用场景
真人口播、广告、角色视频
输入
文本、帧或参考媒体
输出
视频(mp4)
Input

1 至 7,000 字符

adaptive 仅在参考模式下可用

6

4 至 15 · 默认 6

768P 或 2K · 默认 2K · 影响价格

请求字段:content_filter (布尔) · 默认 true · 仅 API 可改

Estimated cost~$0.712712 credits
Result

Try one of these prompts

价格

积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。

首次测试成本
$0.03636 credits

最低档一次生成(1 image (6th-9th))。

测试预算参考
充值积分
$10
约 279 次测试
$50
约 1398 次测试
$100
约 2797 次测试
视频输出(2K),每秒
$0.119
价格 · 1 second
视频输出(768P),每秒
$0.074
价格 · 1 second
额外参考图像(第 6–9 张)
$0.036
价格 · 1 image (6th-9th)

MiniMax H3 API 是什么?

MiniMax H3 是 MiniMax 的多模态视频模型,另一个发布名称是 Hailuo 03,两者指的是同一个系统。在 reAPI 上,它由同一个异步接口按请求形态自动路由:只给 prompt 走文生视频,给首帧和尾帧走图生视频,最多传 9 张参考图、3 段参考视频和 3 条参考音频则走参考驱动生成。每次请求返回 4–15 秒、最高 2K 的视频,自带原生立体声,按输出秒数计费,第 6 到第 9 张参考图另按张收取少量费用。

你能用这个模型做什么

可以用这个模型构建并上线的真实工作流与生产级用例。

MiniMax H3 产品影片,各镜头间材质保持一致

镜头结构化的产品影片

MiniMax H3 可生成机位多变的商业广告:特写功能镜头、清晰可读的规格信息,以及贯穿整个序列的一致产品材质。将产品照片作为参考输入,MiniMax H3 会让包装、比例与品牌识别在镜头之间保持稳定。

立即试用 MiniMax H3
MiniMax H3 电影级场景,立体声与画面同步

带声音调度的电影级场景

在描述画面的同一条提示词中调度对白、音乐、环境声与音效。MiniMax H3 与画面流同步生成原生立体声,口型、脚步声与配乐无需单独的音频环节即可保持同步。

MiniMax H3 参考生视频,组合图像、视频与音频

基于参考素材的多模态混合创作

为每个素材分配角色:图像提供身份,视频片段提供动作,音频文件提供人声。MiniMax H3 参考生视频支持主体替换、动作迁移、背景修改与重打光——一次请求,最多 15 个参考文件。

为什么用 reAPI 调用 MiniMax H3

一个模型,三种模式

文生视频、图生视频与参考生视频共用同一个端点和同一个 MiniMax H3 model id。请求形态决定模式——无需维护多套集成。

原生立体声

MiniMax H3 与画面一同渲染声音,而不是事后补配。对白、环境声、音乐与音效都跟随指挥镜头的同一条提示词。

按量付费

MiniMax H3 按输出秒数计费,2K 统一费率。无订阅、无闲置成本——$1 可购买 1,000 credits 且永不过期,渲染失败自动退款。

MiniMax H3 vs Veo 3.1

在带原生音频的提示词驱动视频生成上,reAPI 上的 MiniMax H3 与 Google 的 Veo 3.1 表现如何。

能力
reAPI 上的 MiniMax H3
Veo 3.1
片段时长
4–15 秒,整秒步进
4、6 或 8 秒(remix 可延长至 15 秒)
最高分辨率
最高 2K
官方渠道最高 4K
原生音频
立体声始终与画面同步生成,可在提示词中调度
可选的合成音频(单独计价档位)
参考输入
最多 9 张图像 + 3 段视频 + 3 个音频文件,每个素材可分配角色
帧参考与图像参考模式;不支持视频或音频参考
编辑控制
主体替换、动作迁移、背景修改、重打光
Remix 与帧引导延长
物理真实感
结构化、商业级的镜头推进
顶级的物理真实感与电影级一致性

对比基于撰写时公开文档所载的行为。能力与限制会随时间变化;选择前请查阅各家最新文档。

三步上线

  1. step 01

    获取 API key

    注册 reAPI 账号并在控制台生成 key。同一个 key 即可使用 MiniMax H3 及目录中的所有其他模型。

    打开
  2. step 02

    在 playground 中测试

    打开本页的 MiniMax H3 playground,选择模式,提交提示词或参考素材,无需编写一行代码。

    打开
  3. step 03

    调用端点

    以 model minimax-h3 向 /api/v1/videos/generations 发送 POST 请求,随后轮询 task id 直到拿到视频 URL。

    打开
docs/api/minimax-h3

API 参考

复制即用的代码片段与完整参数表。

curl -X POST https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-h3",
    "prompt": "A cat walking slowly on the beach at sunset, cinematic shot",
    "aspect_ratio": "16:9",
    "duration": 6
  }'

参数校验失败

提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。

认证或余额问题

401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。

内容或素材被拒

参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。

任务失败或超时

进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。

常见问题

关于此模型的常见疑问。

MiniMax H3 是 MiniMax 的通用多模态视频模型,也以 Hailuo 03 之名发布。它能从文本、图像、视频片段与音频参考生成 4–15 秒、最高 2K 分辨率、自带原生立体声的视频。

start building

准备好上线了吗?

在 Playground 中试用,或直接获取 API Key 立即接入。