视频生成 / MiniMax
MiniMax-H3
API 调用名:minimax-h3
多模态视频生成
概览
这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率
- 模型类型:视频生成
- 输入格式:语音 / 视频 / 图片 / 文字
- 输出格式:视频
- 支持接口:video_generation
阶梯计费明细
| 档位 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| ≤512K 输入 Token | ¥0.0021/1K | ¥0.0084/1K | ¥0.0004/1K |
| >512K 输入 Token | ¥0.0042/1K | ¥0.0168/1K | ¥0.0008/1K |
按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。
能力清单
- 1:多模态上下文理解
- 2:真实创作需要融合不同模态的复杂信息,同时引入图片、声音、视频等多模态信息源。
- 3:通过语言描述清楚上下文和目标视频的关系,复杂的全模态理解工作 H3 会自己完成。
使用场景
- MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。
调用示例
使用 minimax-h3 调用:
curl https://www.wangyidaai.com/v1/video/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"prompt": "一只银色的狼在月光下的雪原上奔跑,电影级镜头",
"duration": 5,
"resolution": "1080p",
"ratio": "16:9"
}'
# 视频为异步任务,用上一步返回的 id 轮询结果
curl https://www.wangyidaai.com/v1/video/generations/TASK_ID \
-H "Authorization: Bearer YOUR_API_KEY"