- 输入 / 输出
- $3.00 / $15.00
- 上下文
- 1M
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Kimi K3 简介
Kimi K3 是 Moonshot AI 的开放权重旗舰模型,2026 年 7 月发布:2.8 万亿参数的混合专家模型,原生支持图片和视频输入,上下文 100 万 token。思考始终开启,强度可选 low、high 或 max。它采用 Kimi Delta Attention,每个 token 从 896 个专家中激活 16 个。Moonshot 面向长周期智能体、大型代码库和知识工作来打造它。
擅长的任务
- 推理强度可设为 low、high 或 max,一个模型既能快速作答,也能深度解决问题。
- 100 万 token 的上下文,面向大型代码库和很长的智能体历史。
- 原生支持图片和视频输入,图表、截图和录屏都可以成为任务的一部分。
- 支持 JSON 输出、动态加载的工具调用、前缀续写和自动上下文缓存。
什么情况换别的模型
- 思考始终开启,所以琐碎的回合比非思考模型花的时间更多。
- 这种规模的模型即使权重开放,自行部署也很吃力。
- 输出只有文本;图片或语音需要用另外的模型。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "kimi-k3", "input": "Hello!" }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
Default
每 1M token- Official 价格
- 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.00 / 文本 输入 $3.00 / 文本 输出 $15.00
- Verified 价格
- —
- 折扣
- —
缓存读取
- Official 价格
- $0.30
- Verified 价格
- —
- 折扣
- —
缓存写入
- Official 价格
- $3.00
- Verified 价格
- —
- 折扣
- —
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| Default | 输入 $3.00 / 输出 $15.00 / 缓存读取 $0.30 / 缓存写入 $3.00 / 文本 输入 $3.00 / 文本 输出 $15.00 | — | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.30 | — | — |
| 缓存写入 | $3.00 | — | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 99.2%
- 30 天请求数
- 100+
- 最后活动时间
- 6分钟前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Kimi K3 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 kimi-k3 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
长周期智能体
运行会进行数百次工具调用的研究或工程智能体,需要在很长的会话里记住前面的结果。
大型代码库的工作
把仓库的大部分载入上下文来浏览和修改,而不只靠检索。
视频和图表分析
针对录制的演示或密集的图表提问,得到引用画面内容的结论。
知识工作自动化
根据大量文档起草报告和分析,用工具获取数据并核对数字。
提示词示例
审阅附上的 600 页申报文件,列出每一笔关联方交易及其页码。
阅读这个仓库,解释一个请求如何从路由流到数据库,并写出每个文件的名字。
观看这段产品演示视频,为表单被重置的那一步写缺陷报告。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Kimi K3 是什么?
Moonshot AI 的开放权重旗舰模型,混合专家架构,参数 2.8 万亿。它能读取文本、图片和视频,上下文 100 万 token,回答前会思考,强度可调。
推理强度有哪几档?
Low、high 和 max。思考始终开启,强度决定模型斟酌的程度。常规请求用 low,困难的调试、规划或分析用 max。
Kimi K3 是开源的吗?
Moonshot 在 API 上线之后发布了权重,所以有硬件的话可以自行部署。通过 API 调用可以避开这笔成本,也能在不重新部署的情况下切换模型。
它支持视频输入吗?
支持。Moonshot 描述它原生支持图片和视频,适合在文字指令之外处理录屏、演示和图表。输出仍是文本,结论以文字形式返回。
它和 Kimi K2.6 有什么区别?
K3 更新也大得多,上下文窗口 100 万 token,有可配置的强度档位,据 Moonshot 称扩展也更高效。K2.6 的上下文更短,也没有强度设置。
Kimi K3 的费用是多少?
在 TokenLab 上,Kimi K3 的价格为 输入 $3.00 / 输出 $15.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Kimi K3 的上下文窗口和输出上限是多少?
Kimi K3 最多接收 1,048,576 token 的上下文,单次最多返回 131,072 token。
Kimi K3 应该使用哪个端点?
Kimi K3 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
Kimi K3 支持哪些操作?
Kimi K3 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Kimi K3 对比
资料来源
审阅于 2026年10月2日