视觉理解 / MiniMax
MiniMax-M3
API 调用名:minimax-m3
深度思考多模态工具调用代码
概览
MiniMax M3 凭借业界领先的 Coding 与 Agentic 能力、1M 超长上下文窗口以及原生多模态特性,可出色胜任企业级长文档理解、高质量内容生成、代码编写、Bug 修复及原生应用构建等任务;强大的 Agentic 能力端到端贯通工作流,原生多模态更带来流畅自然的图文混合交互体验。
- 模型类型:视觉理解
- 输入格式:文字 / 图片 / 视频
- 输出格式:文字
- 支持接口:chat / chat_completion
阶梯计费明细
| 档位 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| ≤512K 输入 Token | ¥0.0021/1K | ¥0.0084/1K | ¥0.0004/1K |
| >512K 输入 Token | ¥0.0042/1K | ¥0.0168/1K | ¥0.0008/1K |
按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。
分组折扣 · 当前展示的是「low」分组价:官方牌价的 8 折(省 20%)。
使用场景
- 论文复现:12 小时自主完成 ICLR 杰出论文
- CUDA 算子优化:147 次迭代,9.4× 加速
- PostTrainBench:让 M3 自己「训」模型
调用示例
使用 minimax-m3 调用:
curl https://www.wangyidaai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "描述一下这张图片" },
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
]
}]
}'