视觉理解 / Moonshot
Kimi-K3
API 调用名:kimi-k3
多模态代码视觉理解深度思考工具调用结构化输出
概览
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
- 模型类型:视觉理解
- 输入格式:文字 / 图片
- 输出格式:文字
- 支持接口:chat / chat_completion
阶梯计费明细
| 档位 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| 兜底档 | ¥0.0200/1K | ¥0.1000/1K | ¥0.0020/1K |
按len(输入上下文 token 数)落档。系数 $ / 1M tokens × 汇率 ¥7.3/$。default 分组价(其它分组按折扣换算)。
使用场景
- 编程
- Kimi K3 具备很强的长程编码能力。在极少人工监督的情况下,它可以持续完成长时间工程任务,理解和处理大型代码库,并协调使用终端工具。
- Kimi K3 也擅长结合软件工程与视觉推理的任务。它能够利用截图和视觉反馈,优化游戏开发、前端和 CAD 等场景。
- 知识工作
- Kimi K3 推动了端到端知识工作的进展。除了公开基准外,Kimi K3(max)在我们的内部评测中也展现出稳定提升。这些评测来自真实用户与智能体协作流程中反复出现的任务模式和挑战。Kimi K3 在不同生产场景导向的工作流中都表现出一致优势,说明其智能体知识工作能力得到了全面提升。
调用示例
使用 kimi-k3 调用:
curl https://www.wangyidaai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "描述一下这张图片" },
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.jpg" } }
]
}]
}'