為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Moonshot: Kimi K3

具備 1M 上下文與可切換式「最大努力思考」(max-effort thinking) 功能的多模態 Kimi 模型,適用於長程代理任務。
比較模型
kimi-k3
可用Moonshot對話
輸入 / 輸出
$3.00 / $15.00
上下文
1M
最大輸出長度
128K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 Kimi K3

Kimi K3 是 Moonshot AI 於 2026 年 7 月發布的開放權重旗艦模型:這是一個擁有 2.8 兆參數的混合專家模型(MoE),具備原生圖像與影片輸入能力,以及一百萬 token 的上下文視窗。思考功能始終開啟,並提供低、高或最大努力程度選項。它使用 Kimi Delta Attention 技術,每個 token 啟用 896 個專家中的 16 個。Moonshot 將其打造為適用於長視角代理程式、大型程式碼庫與知識工作的模型。

適用場景

  • 推理努力程度可設定為低、高或最大,因此單一模型即可涵蓋快速回答與深度問題解決需求。
  • 一百萬 token 的上下文視窗,旨在處理大型程式碼庫與長期的代理程式歷史記錄。
  • 原生圖像與影片輸入,因此圖表、螢幕截圖與錄影皆可作為任務的一部分。
  • 支援 JSON 輸出、具備動態載入功能的工具呼叫、前綴續寫以及自動上下文快取。

其他選擇建議

  • 思考功能始終開啟,因此瑣碎的互動所花費的時間會比非思考型模型更多。
  • 儘管權重是開放的,但此規模的模型在自行託管方面負擔沉重。
  • 僅輸出文字;若需圖像或語音,請使用獨立的模型。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "kimi-k3",
        "input": "Hello!"
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

Default

每 1M Token
Official 價格
輸入 $3.00 / 輸出 $15.00 / 快取讀取 $0.30 / 快取寫入 $3.00 / 純文字 輸入 $3.00 / 純文字 輸出 $15.00
Verified 價格
—
折扣
—
Prompt 快取價格

快取讀取

Official 價格
$0.30
Verified 價格
—
折扣
—

快取寫入

Official 價格
$3.00
Verified 價格
—
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
99.2%
近 30 日請求數
100+
最後活動時間
12 分鐘前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Kimi K3,並準備好編輯或發送提示詞。

協助我使用 kimi-k3 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 長視角代理程式

    執行研究或工程代理程式,這些代理程式需要進行數百次工具呼叫,並在極長的工作階段中記住先前的結果。

  • 大型程式碼庫工作

    透過將大部分程式碼庫載入上下文,而非僅依賴檢索,來導航並修改大型儲存庫。

  • 影片與圖表分析

    針對錄製的演示或密集的圖表提出問題,並接收引用螢幕內容的分析結果。

  • 知識工作自動化

    從大型文件中草擬報告與分析,並使用工具來獲取數據與核對數字。

提示詞範例

審閱隨附的 600 頁文件,並列出每一筆關聯方交易及其頁碼。

閱讀此儲存庫並解釋請求如何從路由器流向資料庫,並標註每個檔案名稱。

觀看此產品演示影片,並針對表單重置的步驟撰寫錯誤報告。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 Kimi K3?

Moonshot AI 的開放權重旗艦模型,採用混合專家設計,擁有 2.8 兆參數。它能讀取文字、圖像與影片,具備一百萬 token 的上下文視窗,並在回答前進行思考,且思考努力程度可調。

推理努力程度有哪些等級?

低、高與最大。思考功能始終開啟,努力程度設定決定了模型思考的深度。日常請求請使用「低」,困難的除錯、規劃或分析任務請使用「最大」。

Kimi K3 是開源的嗎?

Moonshot 在 API 發布後公開了權重,因此如果您擁有硬體資源,可以自行託管。透過 API 呼叫可避免此成本,並允許您在不重新部署的情況下切換模型。

它支援影片輸入嗎?

是的。Moonshot 描述其具備原生圖像與影片支援,適合處理螢幕錄影、演示與圖表,並搭配文字指令。輸出仍為文字,因此分析結果將以書面回答形式呈現。

它與 Kimi K2.6 有何不同?

K3 是更新且規模大得多的模型,具備一百萬 token 的視窗、可配置的努力程度等級,以及 Moonshot 所稱更高效的擴展能力。K2.6 的上下文較短,且沒有努力程度設定。

Kimi K3 的費用是多少?

在 TokenLab 上,Kimi K3 價格為 輸入 $3.00 / 輸出 $15.00 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Kimi K3 的上下文長度與輸出限制為何?

Kimi K3 支援最高 1,048,576 tokens 的上下文,單次回應上限為 131,072 tokens。

Kimi K3 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 Kimi K3 的呼叫。下方的請求範例展示了對應的程式碼格式。

Kimi K3 支援哪些操作?

Kimi K3 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Kimi K3

來源

更新於 2026年10月2日

更多來自 Kimi 的模型

相關模型