Skip to main content
MiniMax-H3 支持文本、图片、视频和音频等多模态输入,可生成 768P2K 视频。
link-token 使用 OpenAI 兼容的视频生成接口。请求体外层只放 model prompt ,MiniMax-H3 的 contentresolutiondurationratiocallback_urlaigc_watermark 均放在 metadata 中。

准备工作

在开始调用之前,请确保你已获取以下信息:

Base URL

API 地址:https://link-token.cn

API Key

在 link-token 后台生成的令牌,形如:sk-xxxxxxxxxxxx
视频生成是异步操作。完整流程如下:

1. 创建视频生成任务

请求信息

/v1/video/generations
必填
创建 MiniMax-H3 视频生成任务。
  • 认证方式Authorization: Bearer $YOUR_API_KEY
  • 内容类型application/json

请求体结构

不要把 contentresolutiondurationratiocallback_urlaigc_watermark 放在请求体外层。除 model prompt 外,这些字段都必须放在 metadata 中。

外层参数

string
必填
模型名称,固定填入 MiniMax-H3
string
必填
描述你想要生成的视频内容,支持中英文。最终会拼接到 metadata.content text 项中
object
必填
MiniMax-H3 的生成参数对象。

metadata 参数

content 元素

metadata.content 中的每个元素通过 type 区分输入类型。

role 取值

2. 选择生成模式

文生视频

content 只包含文本。此时 ratio 必填,且不能使用 adaptive

图生视频

在文本之外传入首帧、尾帧或首尾帧图片。图生视频的宽高比由输入图片决定,因此 ratio 应设为 adaptive

多模态参考生视频

你可以组合参考图片、参考视频和参考音频。ratio 可省略,默认值为 adaptive;也可以显式指定固定比例。
图生视频和多模态参考生视频不能混用。只要 content 中出现 reference_imagereference_videoreference_audio,就不能再使用 first_framelast_frame,反之亦然。

3. 输入媒体要求

整个请求体不能超过 64 MB。Base64 编码通常会使数据体积增加约 33%,较大的媒体文件建议使用公网 URL。 媒体 URL 支持以下形式:
  • 公网可访问的 HTTP 或 HTTPS URL。
  • 对应媒体类型的 Data URI,例如 data:image/png;base64,...data:video/mp4;base64,...data:audio/mp3;base64,...

图片限制

视频限制

音频限制

4. 发送请求

下面的示例创建一个 2K、5 秒、16:9 的文生视频任务。

创建成功响应

创建成功表示任务已经进入异步队列,不表示视频已经生成完成。
请保存完整的 task_id。后续查询必须原样使用该值。

5. 查询任务状态

请求信息

/v1/video/generations/{task_id}
必填
查询任务状态和生成结果。
string
必填
创建任务时返回的 link-token 公开任务 ID,例如 task_xxx

成功响应

HTTP 状态码:200

返回参数

状态映射

建议每隔 5 到 10 秒查询一次。以外层 data.status 判断任务是否结束,以 data.result_url 获取最终视频地址。

首次轮询前的数据

任务刚提交、尚未完成第一次上游轮询时,data.data 可能只包含创建任务时返回的 MiniMax 上游任务 ID:
此时应继续轮询,不要把该上游 task_id 替换到查询 URL 中。

任务失败响应

任务生成失败时,查询接口仍然返回 HTTP 200,顶层 code 仍为 success。失败状态和原因位于任务对象中。

任务不存在

任务 ID 不存在或不属于当前用户时,接口返回 HTTP 400

6. 回调通知

传入 metadata.callback_url 后,MiniMax 会先向该地址发送包含 challenge 的验证请求。你的服务需要在 3 秒内原样返回 challenge。验证成功后,任务状态变化时会向该地址发送 POST 通知。 回调不能替代查询接口。你的服务仍应保留通过 task_id 主动查询任务的能力。

7. 错误响应

接口使用 OpenAI 风格的错误对象,并返回对应的 HTTP 状态码。
排查问题时,请保留响应中的 request_id