Moonshot: Kimi K3
kimi-k3- Eingabe / Ausgabe
- $3.00 / $15.00
- Kontext
- 1M
- Maximale Ausgabe
- 128K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-CacheReasoning
Über Kimi K3
Kimi K3 ist das Open-Weight-Flaggschiff von Moonshot AI, veröffentlicht im Juli 2026: ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, nativer Bild- und Videoeingabe sowie einem Kontext von einer Million Tokens. Die Denkfunktion ist immer aktiv, mit niedriger, hoher oder maximaler Intensität. Es nutzt Kimi Delta Attention und aktiviert 16 von 896 Experten pro Token. Moonshot hat es für langfristige Agenten, große Codebasen und Wissensarbeit entwickelt.
Stärken
- Die Intensität der Denkprozesse kann auf niedrig, hoch oder maximal eingestellt werden, sodass ein Modell sowohl schnelle Antworten als auch tiefgreifende Problemlösungen abdeckt.
- Kontext von einer Million Tokens, ausgelegt auf große Codebasen und lange Agenten-Historien.
- Native Bild- und Videoeingabe, sodass Diagramme, Screenshots und Aufnahmen Teil der Aufgabe sein können.
- Unterstützt JSON-Ausgabe, Tool-Aufrufe mit dynamischem Laden, Präfix-Fortsetzung und automatische Kontext-Zwischenspeicherung.
Alternativen
- Die Denkfunktion ist immer aktiv, daher kosten triviale Anfragen mehr Zeit als bei einem Modell ohne Denkfunktion.
- Ein Modell dieser Größe ist schwer selbst zu hosten, auch wenn die Gewichte offen sind.
- Text ist die einzige Ausgabe; verwenden Sie ein separates Modell für Bilder oder Sprache.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextResponses APIPOST/v1/responsesAPI-Format:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "kimi-k3", "input": "Hello!" }'
Preise
Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.
Default
Pro 1M Token- Official-Preis
- Eingabe $3.00 / Ausgabe $15.00 / Cache-Lesevorgang $0.30 / Cache-Schreibvorgang $3.00 / Text Eingabe $3.00 / Text Ausgabe $15.00
- Verified-Preis
- —
- Rabatt
- —
Cache-Lesevorgang
- Official-Preis
- $0.30
- Verified-Preis
- —
- Rabatt
- —
Cache-Schreibvorgang
- Official-Preis
- $3.00
- Verified-Preis
- —
- Rabatt
- —
| Official-PreisPro 1M Token | Verified-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Default | Eingabe $3.00 / Ausgabe $15.00 / Cache-Lesevorgang $0.30 / Cache-Schreibvorgang $3.00 / Text Eingabe $3.00 / Text Ausgabe $15.00 | — | — |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.30 | — | — |
| Cache-Schreibvorgang | $3.00 | — | — |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
- Erfolgsquote (30 Tage)
- 95,6%
- Anfragen (30 Tage)
- 100+
- Zuletzt aktiv
- vor 12 Stunden
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Kimi K3 in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste kimi-k3 mit einer kurzen Nachricht an /v1/responses. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Reasoning
- Vision
Langfristige Agenten
Führen Sie Forschungs- oder Entwicklungsagenten aus, die Hunderte von Tool-Aufrufen tätigen und sich über eine sehr lange Sitzung hinweg an frühere Ergebnisse erinnern müssen.
Arbeit an großen Codebasen
Navigieren und ändern Sie ein großes Repository, indem Sie einen Großteil davon in den Kontext laden, anstatt sich nur auf das Abrufen zu verlassen.
Video- und Diagrammanalyse
Stellen Sie Fragen zu einer aufgezeichneten Demo oder einem komplexen Diagramm und erhalten Sie Ergebnisse, die auf das verweisen, was auf dem Bildschirm zu sehen ist.
Automatisierung von Wissensarbeit
Entwerfen Sie Berichte und Analysen aus großen Dokumentensätzen und nutzen Sie Tools, um Daten abzurufen und Zahlen zu überprüfen.
Prompt-Beispiele
Überprüfen Sie die angehängte 600-seitige Einreichung und listen Sie jede Transaktion mit verbundenen Parteien mit der entsprechenden Seitenzahl auf.
Lesen Sie dieses Repository und erklären Sie, wie eine Anfrage vom Router zur Datenbank fließt, unter Nennung jeder Datei.
Sehen Sie sich dieses Produktdemovideo an und schreiben Sie den Fehlerbericht für den Schritt, bei dem das Formular zurückgesetzt wird.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Was ist Kimi K3?
Das Open-Weight-Flaggschiffmodell von Moonshot AI mit 2,8 Billionen Parametern in einem Mixture-of-Experts-Design. Es liest Text, Bilder und Videos, verfügt über einen Kontext von einer Million Tokens und denkt vor der Antwort mit einstellbarer Intensität nach.
Was sind die Intensitätsstufen für Denkprozesse?
Niedrig, hoch und maximal. Die Denkfunktion ist immer aktiv, und die Intensität legt fest, wie stark das Modell abwägt. Verwenden Sie 'niedrig' für Routineanfragen und 'maximal' für schwieriges Debugging, Planung oder Analyse.
Ist Kimi K3 Open Source?
Moonshot hat die Gewichte nach dem API-Start veröffentlicht, sodass Sie es selbst hosten können, wenn Sie über die Hardware verfügen. Der Zugriff über eine API vermeidet diese Kosten und ermöglicht es Ihnen, Modelle zu wechseln, ohne neu bereitstellen zu müssen.
Unterstützt es Videoeingabe?
Ja. Moonshot beschreibt die native Unterstützung für Bilder und Videos, was sich für Bildschirmaufnahmen, Demos und Diagramme neben Textanweisungen eignet. Die Ausgabe bleibt Text, sodass die Ergebnisse als schriftliche Antworten zurückkommen.
Wie unterscheidet es sich von Kimi K2.6?
K3 ist das neuere und wesentlich größere Modell mit einem Fenster von einer Million Tokens, konfigurierbaren Intensitätsstufen und laut Moonshot effizienterer Skalierung. K2.6 hat einen kürzeren Kontext und keine Einstellung für die Denkintensität.
Was kostet Kimi K3?
Auf TokenLab kostet Kimi K3 Eingabe $3.00 / Ausgabe $15.00 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Kimi K3?
Kimi K3 verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 131.072 Token aus.
Welchen Endpunkt soll Kimi K3 verwenden?
Verwenden Sie https://api.tokenlab.sh/v1/responses für Kimi K3. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Kimi K3?
Kimi K3 unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Kimi K3 vergleichen
Quellen
Geprüft am 02.10.2026