Google: Gemma 4 31B
gemma-4-31b- Eingabe / Ausgabe
- $0.102 / $0.297
- Modalitäten
- Unterhaltung
Über Gemma 4 31B
Gemma 4 31B ist das größte dichte Modell der Gemma 4-Familie von Google mit offenen Gewichten, die im März 2026 in Größen von E2B bis 31B eingeführt wurde. Google beschreibt die Familie als konzipiert für Schlussfolgerungen, agentische Workflows, Programmierung und multimodales Verständnis. Im Gegensatz zu den proprietären Gemini-Modellen sind die Gewichte veröffentlicht, sodass dasselbe Modell auch auf eigener Hardware ausgeführt werden kann.
Stärken
- Offene Gewichte ermöglichen es Ihnen, dasselbe Modell zwischen gehosteten und selbst betriebenen Setups zu verschieben.
- Die dichte 31B-Größe zielt auf eine Qualität bei Schlussfolgerungen und Programmierung ab, die bei kleineren Gemma 4-Größen nicht erreicht wird.
- Die Modellkarte von Google berichtet von starken Ergebnissen bei Benchmarks für Schlussfolgerungen und Programmierung wie MMLU Pro und LiveCodeBench v6.
- Mehrsprachige Abdeckung für mehr als 140 Sprachen.
Alternativen
- Es funktioniert nur mit Text und bietet kein Tool-Calling, daher sind Agenten-Workflows mit einem Gemini-Modell besser bedient.
- Es ist bei langen autonomen Aufgaben weniger leistungsfähig als Gemini 3.x Pro- und Flash-Modelle.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextChat Completions APIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gemma-4-31b", "messages": [ {"role": "user", "content": "Hello!"} ] }'
Preise
Der offizielle Preis ist die öffentliche Basisvorgabe des Modellerstellers. Der TokenLab-Preis ist das, was du für dieses Modell auf TokenLab zahlst.
Standardspezifikation
Pro 1M Token- Offizieller Preis
- Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012
- Official
- Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012
- Rabatt
- —
Cache-Lesevorgang
- Offizieller Preis
- $0.012
- Official
- $0.012
- Rabatt
- —
| Offizieller PreisPro 1M Token | OfficialPro 1M Token | Rabatt | |
|---|---|---|---|
| Standardspezifikation | Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012 | Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012 | — |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.012 | $0.012 | — |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Gemma 4 31B in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste gemma-4-31b mit einer kurzen Nachricht an /v1/chat/completions. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Selbst hostbarer Assistent
Erstellen Sie Prototypen mit dem gehosteten Modell und wechseln Sie dann auf Ihre eigenen GPUs, falls Datenrichtlinien dies erfordern.
Mehrsprachiger Chat
Antworten Sie Benutzern in vielen Sprachen mit einem einzigen Modell, was die Support-Tools einfacher hält als der Betrieb separater Übersetzer.
Code-Erklärung
Überprüfen Sie Code-Schnipsel und schreiben Sie Funktionen in Umgebungen, in denen ein Modell mit offenen Gewichten aus Richtlinien- oder Hosting-Gründen erforderlich ist.
Basis für Feinabstimmung
Vergleichen Sie eine gehostete Baseline, bevor Sie die offenen Gewichte an Ihre Domäne anpassen.
Prompt-Beispiele
Übersetzen Sie diesen Absatz ins Spanische, Deutsche und Japanische und notieren Sie alle Redewendungen, die Sie umformulieren mussten.
Erklären Sie, was diese SQL-Abfrage bewirkt, und schreiben Sie sie dann so um, dass die korrelierte Unterabfrage vermieden wird.
Schreiben Sie eine kurze, höfliche Antwort, in der Sie diese Besprechungsanfrage ablehnen und die nächste Woche vorschlagen.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Ist Gemma 4 31B Open Source?
Google veröffentlicht die Gewichte unter den Gemma-Bedingungen, was es zu einem Modell mit offenen Gewichten macht. Lesen Sie die Lizenz auf der Modellkarte vor der kommerziellen Nutzung, da es sich um die eigene Lizenz von Gemma handelt.
Wie unterscheidet sich Gemma von Gemini?
Gemini-Modelle sind die gehostete, proprietäre Produktlinie von Google. Gemma-Modelle sind kleinere Modelle mit offenen Gewichten, die auf verwandter Forschung basieren und die Sie herunterladen, feinabstimmen und selbst ausführen können.
Unterstützt es Tool-Calling?
Nein. Das gehostete Modell verarbeitet nur Text-Chat mit Texteingabe und -ausgabe ohne Tool-Calling. Verwenden Sie für Agenten, die Funktionen aufrufen, stattdessen ein Gemini-Modell.
Welche Größe hat das Modell?
Etwa 31 Milliarden Parameter, dicht, das größte der fünf Gemma 4-Größen: E2B, E4B, 12B, 26B, A4B und 31B. Kleinere Größen zielen auf Telefone und Laptops ab.
Was kostet Gemma 4 31B?
Auf TokenLab kostet Gemma 4 31B Eingabe $0.102 / Ausgabe $0.297 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welchen Endpunkt soll Gemma 4 31B verwenden?
Verwenden Sie https://api.tokenlab.sh/v1/chat/completions für Gemma 4 31B. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Gemma 4 31B?
Gemma 4 31B unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Gemma 4 31B vergleichen
Quellen
Geprüft am 02.10.2026