视觉理解 / ByteDance
Doubao-Seed-2.0-pro
API 调用名:doubao-seed-2-0-pro-260215
多模态视觉理解深度思考
概览
旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
- 模型类型:视觉理解
- 输入格式:文字 / 图片 / 视频
- 输出格式:文字
- 支持接口:chat_completion / chat
阶梯计费明细
| 档位 | 输入 | 输出 | 缓存命中 | 缓存创建 |
|---|---|---|---|---|
| ≤32K 输入 Token | ¥0.0032/1K | ¥0.0160/1K | ¥0.0006/1K | ¥0.0000/1K |
| ≤128K 输入 Token | ¥0.0048/1K | ¥0.0240/1K | ¥0.0010/1K | ¥0.0000/1K |
| >128K 输入 Token | ¥0.0096/1K | ¥0.0480/1K | ¥0.0019/1K | ¥0.0000/1K |
按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。
调用示例
使用 doubao-seed-2-0-pro-260215 调用:
curl https://www.wangyidaai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seed-2-0-pro-260215",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "描述一下这张图片" },
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
]
}]
}'