视觉理解 / ByteDance
Doubao-Seed-2.0-mini
API 调用名:doubao-seed-2-0-mini-260428
多模态视觉理解深度思考
概览
轻量均衡型全模态模型,支持文本、图片、语音、视频四模态理解与跨模态推理。精简推理链路以提升响应效率和运行稳定性,强化多语种及小语种处理能力,适用于通用轻量化多模态解析场景。
- 模型类型:视觉理解
- 输入格式:文字 / 图片 / 视频 / 语音
- 输出格式:文字
- 支持接口:chat_completion / chat
阶梯计费明细
| 档位 | 输入 | 输出 | 缓存命中 | 缓存创建 |
|---|---|---|---|---|
| ≤32K 输入 Token | ¥0.0002/1K | ¥0.0020/1K | ¥0.0000/1K | ¥0.0000/1K |
| ≤128K 输入 Token | ¥0.0004/1K | ¥0.0040/1K | ¥0.0001/1K | ¥0.0000/1K |
| >128K 输入 Token | ¥0.0008/1K | ¥0.0080/1K | ¥0.0002/1K | ¥0.0000/1K |
按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。
调用示例
使用 doubao-seed-2-0-mini-260428 调用:
curl https://www.wangyidaai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seed-2-0-mini-260428",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "描述一下这张图片" },
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
]
}]
}'