xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- Eingabe / Ausgabe-50%
- $1.25 / $2.50$0.625 / $1.25
- Kontext
- 1M
- Maximale Ausgabe
- 128K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-Cache
Über Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning ist die Version von xAIs 4.20-Modell für direkte Antworten. Sie überspringt die erweiterte Denkphase, antwortet daher schnell auf Text- und Bild-Prompts und eignet sich für das Entwerfen von Texten, Extraktionen und toolgestützte Chats. xAI beschreibt es als eine Kombination aus strikter Einhaltung von Anweisungen und einer niedrigen Halluzinationsrate. Wählen Sie die Reasoning- oder Multi-Agent-Varianten, wenn ein Problem eine gründliche Analyse erfordert.
Stärken
- Antwortet ohne eine separate Denkphase, was die Latenz für interaktive Chats und Aufgaben mit hohem Volumen niedrig hält.
- xAI hebt die strikte Einhaltung von Anweisungen und eine niedrige Halluzinationsrate für dieses Modell hervor, was nützlich ist, wenn die Ausgabe einer Vorlage folgen muss.
- Unterstützt Funktionsaufrufe und strukturierte JSON-Ausgabe für Extraktions-Pipelines und toolgestützte Assistenten.
- Akzeptiert Bilder mit Text, sodass es eine Quittung oder einen Screenshot lesen und in einem Schritt beantworten kann.
- Prompt-Caching hilft, wenn viele Anfragen dieselben langen Anweisungen oder Referenztexte wiederverwenden.
Alternativen
- Ohne Reasoning-Schritt ist es bei mehrstufiger Logik oder Mathematik schwächer als grok-4.20 oder grok-4.7.
- Es teilt die Arbeit nicht auf mehrere Agenten auf; für ergebnisoffene Forschung ist die Multi-Agent-Variante besser geeignet.
- Die Ausgabe erfolgt nur als Text, ohne Generierung von Bildern, Audio oder Video.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextResponses APIPOST/v1/responsesAPI-Format:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
Preise
Der offizielle Preis ist die öffentliche Basisvorgabe des Modellerstellers. Der TokenLab-Preis ist das, was du für dieses Modell auf TokenLab zahlst.
Standardspezifikation
Pro 1M Token- Offizieller Preis
- Eingabe $1.25 / Ausgabe $2.50 / Cache-Lesevorgang $0.20
- TokenLab-Preis
- Eingabe $0.625 / Ausgabe $1.25 / Cache-Lesevorgang $0.10
- Rabatt
- -50%
Cache-Lesevorgang
- Offizieller Preis
- $0.20
- TokenLab-Preis
- $0.10
- Rabatt
- -50%
| Offizieller PreisPro 1M Token | TokenLab-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Standardspezifikation | Eingabe $1.25 / Ausgabe $2.50 / Cache-Lesevorgang $0.20 | Eingabe $0.625 / Ausgabe $1.25 / Cache-Lesevorgang $0.10 | -50% |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.20 | $0.10 | -50% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Grok 4.20 Non-Reasoning in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste grok-4.20-non-reasoning mit einer kurzen Nachricht an /v1/responses. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Vision
Kundenservice-Chat
Beantworten Sie Produkt- und Kontofragen in einem konsistenten Ton, rufen Sie bei Bedarf Suchfunktionen auf, ohne den Kunden auf eine lange Denkphase warten zu lassen.
Massenextraktion von Dokumenten
Verarbeiten Sie Tausende von Verträgen, Formularen oder E-Mails gemäß einem festen JSON-Schema und verlassen Sie sich auf die strikte Einhaltung der Anweisungen, um die Felder konsistent zu halten.
Entwerfen und Umschreiben
Erstellen Sie erste Entwürfe für E-Mails, Zusammenfassungen und Release-Notes in einem gewünschten Format und verfeinern Sie diese anschließend mit kurzen Folgeanweisungen.
Prompt-Beispiele
Fassen Sie diesen Support-Thread in drei Stichpunkten und einer Antwortempfehlung zusammen. Halten Sie die Antwort unter 80 Wörtern und versprechen Sie keine Rückerstattung.
Extrahieren Sie die Vertragsparteien, das Datum des Inkrafttretens und die Kündigungsfrist aus diesem Vertrag in das untenstehende JSON-Schema. Geben Sie null für fehlende Informationen zurück.
Schreiben Sie dieses Changelog für nicht-technische Kunden um. Behalten Sie die Überschriften bei, entfernen Sie interne Ticketnummern und verwenden Sie einfache Sätze.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Was ist Grok 4.20 Non-Reasoning?
Es ist die Version von xAIs Grok 4.20, die direkt antwortet, anstatt zuerst zu denken. Es liest Text und Bilder, schreibt Text und unterstützt Funktionsaufrufe sowie strukturierte Ausgaben. Es ist auf schnelle, anweisungsintensive Arbeit wie Extraktion, Entwurfserstellung und toolgestützten Chat ausgerichtet.
Wann sollte ich Non-Reasoning anstelle von grok-4.20 verwenden?
Verwenden Sie es, wenn die Aufgabe klar ist und die Antwort hauptsächlich aus Abruf, Umschreiben oder Formatierung besteht. Es antwortet schneller als die Reasoning-ID. Wechseln Sie zu grok-4.20, wenn die Antwort mehrere Analyseschritte erfordert, wie etwa beim Debugging oder bei der Planung.
Folgt Grok 4.20 Non-Reasoning JSON-Schemas?
Ja. Es unterstützt strukturierte Ausgaben, sodass Sie ein Schema bereitstellen können und eine Antwort erhalten, die diesem entspricht. In Kombination mit der Betonung von xAI auf strikte Einhaltung von Anweisungen macht dies das Modell zu einer vernünftigen Standardwahl für Extraktions- und Klassifizierungsaufgaben.
Kann es Bildeingaben akzeptieren?
Ja, Bilder können zusammen mit Text gesendet werden, zum Beispiel ein fotografiertes Formular oder ein UI-Screenshot. Die Antwort ist Text. Das Modell kann keine Bilder erstellen oder bearbeiten.
Funktioniert es mit einem bestehenden OpenAI-kompatiblen Client?
Ja. Bestehender OpenAI-kompatibler Client-Code funktioniert durch einfaches Ändern des Modellnamens, wobei Tool-Definitionen und JSON-Schemas wie bisher in den üblichen Feldern gesendet werden.
Was kostet Grok 4.20 Non-Reasoning?
Auf TokenLab kostet Grok 4.20 Non-Reasoning Eingabe $0.625 / Ausgabe $1.25 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning verarbeitet bis zu 1.000.000 Token Kontext und gibt pro Antwort bis zu 131.072 Token aus.
Welchen Endpunkt soll Grok 4.20 Non-Reasoning verwenden?
Verwenden Sie https://api.tokenlab.sh/v1/responses für Grok 4.20 Non-Reasoning. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Grok 4.20 Non-Reasoning vergleichen
Quellen
Geprüft am 02.10.2026