Moonshot: Kimi K3
kimi-k3- 輸入 / 輸出
- $3.00 / $15.00
- 上下文
- 1M
- 最大輸出長度
- 128K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 Kimi K3
Kimi K3 是 Moonshot AI 於 2026 年 7 月發布的開放權重旗艦模型:這是一個擁有 2.8 兆參數的混合專家模型(MoE),具備原生圖像與影片輸入能力,以及一百萬 token 的上下文視窗。思考功能始終開啟,並提供低、高或最大努力程度選項。它使用 Kimi Delta Attention 技術,每個 token 啟用 896 個專家中的 16 個。Moonshot 將其打造為適用於長視角代理程式、大型程式碼庫與知識工作的模型。
適用場景
- 推理努力程度可設定為低、高或最大,因此單一模型即可涵蓋快速回答與深度問題解決需求。
- 一百萬 token 的上下文視窗,旨在處理大型程式碼庫與長期的代理程式歷史記錄。
- 原生圖像與影片輸入,因此圖表、螢幕截圖與錄影皆可作為任務的一部分。
- 支援 JSON 輸出、具備動態載入功能的工具呼叫、前綴續寫以及自動上下文快取。
其他選擇建議
- 思考功能始終開啟,因此瑣碎的互動所花費的時間會比非思考型模型更多。
- 儘管權重是開放的,但此規模的模型在自行託管方面負擔沉重。
- 僅輸出文字;若需圖像或語音,請使用獨立的模型。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "kimi-k3", "input": "Hello!" }'
定價
Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。
Default
每 1M Token- Official 價格
- 輸入 $3.00 / 輸出 $15.00 / 快取讀取 $0.30 / 快取寫入 $3.00 / 純文字 輸入 $3.00 / 純文字 輸出 $15.00
- Verified 價格
- —
- 折扣
- —
快取讀取
- Official 價格
- $0.30
- Verified 價格
- —
- 折扣
- —
快取寫入
- Official 價格
- $3.00
- Verified 價格
- —
- 折扣
- —
| Official 價格每 1M Token | Verified 價格每 1M Token | 折扣 | |
|---|---|---|---|
| Default | 輸入 $3.00 / 輸出 $15.00 / 快取讀取 $0.30 / 快取寫入 $3.00 / 純文字 輸入 $3.00 / 純文字 輸出 $15.00 | — | — |
| Prompt 快取價格 | |||
| 快取讀取 | $0.30 | — | — |
| 快取寫入 | $3.00 | — | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 99.2%
- 近 30 日請求數
- 100+
- 最後活動時間
- 12 分鐘前
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Kimi K3,並準備好編輯或發送提示詞。
協助我使用 kimi-k3 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
長視角代理程式
執行研究或工程代理程式,這些代理程式需要進行數百次工具呼叫,並在極長的工作階段中記住先前的結果。
大型程式碼庫工作
透過將大部分程式碼庫載入上下文,而非僅依賴檢索,來導航並修改大型儲存庫。
影片與圖表分析
針對錄製的演示或密集的圖表提出問題,並接收引用螢幕內容的分析結果。
知識工作自動化
從大型文件中草擬報告與分析,並使用工具來獲取數據與核對數字。
提示詞範例
審閱隨附的 600 頁文件,並列出每一筆關聯方交易及其頁碼。
閱讀此儲存庫並解釋請求如何從路由器流向資料庫,並標註每個檔案名稱。
觀看此產品演示影片,並針對表單重置的步驟撰寫錯誤報告。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
什麼是 Kimi K3?
Moonshot AI 的開放權重旗艦模型,採用混合專家設計,擁有 2.8 兆參數。它能讀取文字、圖像與影片,具備一百萬 token 的上下文視窗,並在回答前進行思考,且思考努力程度可調。
推理努力程度有哪些等級?
低、高與最大。思考功能始終開啟,努力程度設定決定了模型思考的深度。日常請求請使用「低」,困難的除錯、規劃或分析任務請使用「最大」。
Kimi K3 是開源的嗎?
Moonshot 在 API 發布後公開了權重,因此如果您擁有硬體資源,可以自行託管。透過 API 呼叫可避免此成本,並允許您在不重新部署的情況下切換模型。
它支援影片輸入嗎?
是的。Moonshot 描述其具備原生圖像與影片支援,適合處理螢幕錄影、演示與圖表,並搭配文字指令。輸出仍為文字,因此分析結果將以書面回答形式呈現。
它與 Kimi K2.6 有何不同?
K3 是更新且規模大得多的模型,具備一百萬 token 的視窗、可配置的努力程度等級,以及 Moonshot 所稱更高效的擴展能力。K2.6 的上下文較短,且沒有努力程度設定。
Kimi K3 的費用是多少?
在 TokenLab 上,Kimi K3 價格為 輸入 $3.00 / 輸出 $15.00 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Kimi K3 的上下文長度與輸出限制為何?
Kimi K3 支援最高 1,048,576 tokens 的上下文,單次回應上限為 131,072 tokens。
Kimi K3 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 Kimi K3 的呼叫。下方的請求範例展示了對應的程式碼格式。
Kimi K3 支援哪些操作?
Kimi K3 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Kimi K3
來源
更新於 2026年10月2日