公告
🎉 欢迎使用全球领先的大模型聚合平台 🎉一个 Key、一行代码改动,随时切换,永不宕机。企业级大模型智能网关平台·为企业提供 合规可控、稳定高效 的 AI 模型 API 聚合与治理服务, 百模一站接入 · 智能渠道编排与动态熔断 · 全链路加密与权限审计, 助力 AI 能力规模化落地,显著降本增效。原厂授权 · 真源可溯超低折扣 · 计价透明·多线路保障·不限时间·按量计费·用多少付多少

视频生成 / MiniMax

MiniMax-H3

API 调用名:minimax-h3

多模态视频生成

概览

这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率

  • 模型类型:视频生成
  • 输入格式:语音 / 视频 / 图片 / 文字
  • 输出格式:视频
  • 支持接口:video_generation
阶梯计费明细
档位输入输出缓存命中
≤512K 输入 Token¥0.0021/1K¥0.0084/1K¥0.0004/1K
>512K 输入 Token¥0.0042/1K¥0.0168/1K¥0.0008/1K

按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。

能力清单

  • 1:多模态上下文理解
  • 2:真实创作需要融合不同模态的复杂信息,同时引入图片、声音、视频等多模态信息源。
  • 3:通过语言描述清楚上下文和目标视频的关系,复杂的全模态理解工作 H3 会自己完成。

使用场景

  • MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。

调用示例

使用 minimax-h3 调用:

curl https://www.wangyidaai.com/v1/video/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-h3",
    "prompt": "一只银色的狼在月光下的雪原上奔跑,电影级镜头",
    "duration": 5,
    "resolution": "1080p",
    "ratio": "16:9"
  }'

# 视频为异步任务,用上一步返回的 id 轮询结果
curl https://www.wangyidaai.com/v1/video/generations/TASK_ID \
  -H "Authorization: Bearer YOUR_API_KEY"