视觉理解 / ByteDance
Doubao-Seed-2.0-lite
API 调用名:doubao-seed-2-0-lite-260428
多模态模型深度思考视觉理解
概览
面向企业规模化部署的轻量级全模态模型,支持文本、图片、语音、视频四模态跨模态联合理解。集成音画协同分析、长视频时序检索、全维度音频解析、代码开发、智能Agent与GUI闭环操作能力,适配大批量全模态推理业务场景。
- 模型类型:视觉理解
- 输入格式:文字 / 图片 / 视频 / 语音
- 输出格式:文字
- 支持接口:chat / chat_completion
调用示例
使用 doubao-seed-2-0-lite-260428 调用:
curl https://www.wangyidaai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seed-2-0-lite-260428",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "描述一下这张图片" },
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
]
}]
}'