Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Moonshot: Kimi K3

Multimodales Kimi-Modell mit 1 Mio. Kontext und zuschaltbarem „Max-Effort“-Denken für langfristige Agentenaufgaben
Modelle vergleichen
kimi-k3
VerfügbarMoonshotUnterhaltung
Eingabe / Ausgabe
$3.00 / $15.00
Kontext
1M
Maximale Ausgabe
128K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-CacheReasoning

Über Kimi K3

Kimi K3 ist das Open-Weight-Flaggschiff von Moonshot AI, veröffentlicht im Juli 2026: ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, nativer Bild- und Videoeingabe sowie einem Kontext von einer Million Tokens. Die Denkfunktion ist immer aktiv, mit niedriger, hoher oder maximaler Intensität. Es nutzt Kimi Delta Attention und aktiviert 16 von 896 Experten pro Token. Moonshot hat es für langfristige Agenten, große Codebasen und Wissensarbeit entwickelt.

Stärken

  • Die Intensität der Denkprozesse kann auf niedrig, hoch oder maximal eingestellt werden, sodass ein Modell sowohl schnelle Antworten als auch tiefgreifende Problemlösungen abdeckt.
  • Kontext von einer Million Tokens, ausgelegt auf große Codebasen und lange Agenten-Historien.
  • Native Bild- und Videoeingabe, sodass Diagramme, Screenshots und Aufnahmen Teil der Aufgabe sein können.
  • Unterstützt JSON-Ausgabe, Tool-Aufrufe mit dynamischem Laden, Präfix-Fortsetzung und automatische Kontext-Zwischenspeicherung.

Alternativen

  • Die Denkfunktion ist immer aktiv, daher kosten triviale Anfragen mehr Zeit als bei einem Modell ohne Denkfunktion.
  • Ein Modell dieser Größe ist schwer selbst zu hosten, auch wenn die Gewichte offen sind.
  • Text ist die einzige Ausgabe; verwenden Sie ein separates Modell für Bilder oder Sprache.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextResponses API
    POST/v1/responses
    API-Format:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "kimi-k3",
        "input": "Hello!"
      }'

Preise

Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.

Default

Pro 1M Token
Official-Preis
Eingabe $3.00 / Ausgabe $15.00 / Cache-Lesevorgang $0.30 / Cache-Schreibvorgang $3.00 / Text Eingabe $3.00 / Text Ausgabe $15.00
Verified-Preis
—
Rabatt
—
Prompt-Cache-Preise

Cache-Lesevorgang

Official-Preis
$0.30
Verified-Preis
—
Rabatt
—

Cache-Schreibvorgang

Official-Preis
$3.00
Verified-Preis
—
Rabatt
—

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
95,6%
Anfragen (30 Tage)
100+
Zuletzt aktiv
vor 12 Stunden

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Kimi K3 in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste kimi-k3 mit einer kurzen Nachricht an /v1/responses. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Reasoning
  • Vision
  • Langfristige Agenten

    Führen Sie Forschungs- oder Entwicklungsagenten aus, die Hunderte von Tool-Aufrufen tätigen und sich über eine sehr lange Sitzung hinweg an frühere Ergebnisse erinnern müssen.

  • Arbeit an großen Codebasen

    Navigieren und ändern Sie ein großes Repository, indem Sie einen Großteil davon in den Kontext laden, anstatt sich nur auf das Abrufen zu verlassen.

  • Video- und Diagrammanalyse

    Stellen Sie Fragen zu einer aufgezeichneten Demo oder einem komplexen Diagramm und erhalten Sie Ergebnisse, die auf das verweisen, was auf dem Bildschirm zu sehen ist.

  • Automatisierung von Wissensarbeit

    Entwerfen Sie Berichte und Analysen aus großen Dokumentensätzen und nutzen Sie Tools, um Daten abzurufen und Zahlen zu überprüfen.

Prompt-Beispiele

Überprüfen Sie die angehängte 600-seitige Einreichung und listen Sie jede Transaktion mit verbundenen Parteien mit der entsprechenden Seitenzahl auf.

Lesen Sie dieses Repository und erklären Sie, wie eine Anfrage vom Router zur Datenbank fließt, unter Nennung jeder Datei.

Sehen Sie sich dieses Produktdemovideo an und schreiben Sie den Fehlerbericht für den Schritt, bei dem das Formular zurückgesetzt wird.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Was ist Kimi K3?

Das Open-Weight-Flaggschiffmodell von Moonshot AI mit 2,8 Billionen Parametern in einem Mixture-of-Experts-Design. Es liest Text, Bilder und Videos, verfügt über einen Kontext von einer Million Tokens und denkt vor der Antwort mit einstellbarer Intensität nach.

Was sind die Intensitätsstufen für Denkprozesse?

Niedrig, hoch und maximal. Die Denkfunktion ist immer aktiv, und die Intensität legt fest, wie stark das Modell abwägt. Verwenden Sie 'niedrig' für Routineanfragen und 'maximal' für schwieriges Debugging, Planung oder Analyse.

Ist Kimi K3 Open Source?

Moonshot hat die Gewichte nach dem API-Start veröffentlicht, sodass Sie es selbst hosten können, wenn Sie über die Hardware verfügen. Der Zugriff über eine API vermeidet diese Kosten und ermöglicht es Ihnen, Modelle zu wechseln, ohne neu bereitstellen zu müssen.

Unterstützt es Videoeingabe?

Ja. Moonshot beschreibt die native Unterstützung für Bilder und Videos, was sich für Bildschirmaufnahmen, Demos und Diagramme neben Textanweisungen eignet. Die Ausgabe bleibt Text, sodass die Ergebnisse als schriftliche Antworten zurückkommen.

Wie unterscheidet es sich von Kimi K2.6?

K3 ist das neuere und wesentlich größere Modell mit einem Fenster von einer Million Tokens, konfigurierbaren Intensitätsstufen und laut Moonshot effizienterer Skalierung. K2.6 hat einen kürzeren Kontext und keine Einstellung für die Denkintensität.

Was kostet Kimi K3?

Auf TokenLab kostet Kimi K3 Eingabe $3.00 / Ausgabe $15.00 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Kimi K3?

Kimi K3 verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 131.072 Token aus.

Welchen Endpunkt soll Kimi K3 verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/responses für Kimi K3. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Kimi K3?

Kimi K3 unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Kimi K3 vergleichen

Quellen

Geprüft am 02.10.2026

Mehr aus der Kimi-Serie

Ähnliche Modelle