Skip to main content
Base URL: https://router.flatkey.ai 当你需要文生视频、首尾帧控制,或图片、视频和音频参考时,可以使用 MiniMax-H3。所有请求都使用同一套异步流程:创建任务、轮询状态、下载最终 MP4。

多种输入方式

使用文本、首尾帧图片或图片、视频、音频参考生成视频。

统一异步流程

POST /v1/videos 创建任务,用 GET /v1/videos/{task_id} 轮询,再从 metadata.url 下载视频。
创建任务和查询状态时都要使用以下鉴权头:
请保护好 API Key,不要把它贴到公开日志、页面或工单中。

创建第一个 H3 视频

1. 提交文生视频任务

使用 MiniMax-H3 模型和文本提示词调用 POST /v1/videos。纯文本请求必须显式指定画面比例,并且不能使用 adaptive
响应会在 idtask_id 中返回公开任务 ID:
保存返回的 task_...。后续查询任务时需要使用它。

2. 轮询并下载结果

重复调用 GET /v1/videos/{task_id},直到 status 变成 completedfailed。状态变成 completed 后,从 metadata.url 读取临时下载地址。
metadata.url 是临时下载地址,不需要 Flatkey 鉴权头。任何拿到该地址的人都能在地址失效前访问生成的视频。请把它视为私密信息,不要记录到日志、公开或分享。请尽快下载视频并保存到自己的存储中。重复查询任务不会刷新已经失效的地址。

选择输入方式

每个请求都必须包含非空文本。你可以再添加首尾帧或参考素材来控制结果。
不要在同一个请求中混用首尾帧和参考素材。每个 content 元素只能包含一种与 type 对应的载荷。

控制首帧和尾帧

当你希望视频在两张图片之间自然过渡时,使用 first_framelast_frame

使用参考素材生成

参考素材可以帮助你保持主体、运动风格或声音一致。参考音频不能作为唯一的媒体输入。

请求设置

请求包含媒体且省略 ratio 时,Flatkey 会使用 adaptive。纯文本请求必须显式使用非 adaptive 的比例。

理解任务结果

对于 H3 视频响应,通用 usage 字段表示秒数:
  • usage.completion_tokens 表示生成视频的输出时长。
  • usage.total_tokens 表示总计费时长,其中包含参考视频输入时长。
这些值的单位是秒,不是语言模型 token。最终费用请以 Flatkey 控制台中的用量日志为准。

当前限制

  • 不支持 callback_url。请轮询任务状态。
  • 不支持任务列表、取消、删除、再生成和 remix。
  • 不支持 MiniMax-H3-Context-IR
  • 处理任务期间,远程素材 URL 必须保持可访问。