Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Google: Gemma 4 31B

Gemma 4 31B ist Googles dichtes Open-Weight-Modell für Textkonversationen, Programmierung und mehrsprachige Aufgaben. Dieses TokenLab-Modell stellt den verifizierten Text-Chat-Completions-Vertrag bereit.
Modelle vergleichen
gemma-4-31b
VerfügbarGoogleUnterhaltung
Eingabe / Ausgabe
$0.102 / $0.297
Modalitäten
Unterhaltung

Über Gemma 4 31B

Gemma 4 31B ist das größte dichte Modell der Gemma 4-Familie von Google mit offenen Gewichten, die im März 2026 in Größen von E2B bis 31B eingeführt wurde. Google beschreibt die Familie als konzipiert für Schlussfolgerungen, agentische Workflows, Programmierung und multimodales Verständnis. Im Gegensatz zu den proprietären Gemini-Modellen sind die Gewichte veröffentlicht, sodass dasselbe Modell auch auf eigener Hardware ausgeführt werden kann.

Stärken

  • Offene Gewichte ermöglichen es Ihnen, dasselbe Modell zwischen gehosteten und selbst betriebenen Setups zu verschieben.
  • Die dichte 31B-Größe zielt auf eine Qualität bei Schlussfolgerungen und Programmierung ab, die bei kleineren Gemma 4-Größen nicht erreicht wird.
  • Die Modellkarte von Google berichtet von starken Ergebnissen bei Benchmarks für Schlussfolgerungen und Programmierung wie MMLU Pro und LiveCodeBench v6.
  • Mehrsprachige Abdeckung für mehr als 140 Sprachen.

Alternativen

  • Es funktioniert nur mit Text und bietet kein Tool-Calling, daher sind Agenten-Workflows mit einem Gemini-Modell besser bedient.
  • Es ist bei langen autonomen Aufgaben weniger leistungsfähig als Gemini 3.x Pro- und Flash-Modelle.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextChat Completions API
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gemma-4-31b",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Preise

Der offizielle Preis ist die öffentliche Basisvorgabe des Modellerstellers. Der TokenLab-Preis ist das, was du für dieses Modell auf TokenLab zahlst.

Standardspezifikation

Pro 1M Token
Offizieller Preis
Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012
Official
Eingabe $0.102 / Ausgabe $0.297 / Cache-Lesevorgang $0.012
Rabatt
—
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.012
Official
$0.012
Rabatt
—

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Metriken erscheinen, sobald die Schwellenwerte für Datenschutz und Datenvolumen erreicht sind.

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Gemma 4 31B in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste gemma-4-31b mit einer kurzen Nachricht an /v1/chat/completions. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

  • Selbst hostbarer Assistent

    Erstellen Sie Prototypen mit dem gehosteten Modell und wechseln Sie dann auf Ihre eigenen GPUs, falls Datenrichtlinien dies erfordern.

  • Mehrsprachiger Chat

    Antworten Sie Benutzern in vielen Sprachen mit einem einzigen Modell, was die Support-Tools einfacher hält als der Betrieb separater Übersetzer.

  • Code-Erklärung

    Überprüfen Sie Code-Schnipsel und schreiben Sie Funktionen in Umgebungen, in denen ein Modell mit offenen Gewichten aus Richtlinien- oder Hosting-Gründen erforderlich ist.

  • Basis für Feinabstimmung

    Vergleichen Sie eine gehostete Baseline, bevor Sie die offenen Gewichte an Ihre Domäne anpassen.

Prompt-Beispiele

Übersetzen Sie diesen Absatz ins Spanische, Deutsche und Japanische und notieren Sie alle Redewendungen, die Sie umformulieren mussten.

Erklären Sie, was diese SQL-Abfrage bewirkt, und schreiben Sie sie dann so um, dass die korrelierte Unterabfrage vermieden wird.

Schreiben Sie eine kurze, höfliche Antwort, in der Sie diese Besprechungsanfrage ablehnen und die nächste Woche vorschlagen.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Ist Gemma 4 31B Open Source?

Google veröffentlicht die Gewichte unter den Gemma-Bedingungen, was es zu einem Modell mit offenen Gewichten macht. Lesen Sie die Lizenz auf der Modellkarte vor der kommerziellen Nutzung, da es sich um die eigene Lizenz von Gemma handelt.

Wie unterscheidet sich Gemma von Gemini?

Gemini-Modelle sind die gehostete, proprietäre Produktlinie von Google. Gemma-Modelle sind kleinere Modelle mit offenen Gewichten, die auf verwandter Forschung basieren und die Sie herunterladen, feinabstimmen und selbst ausführen können.

Unterstützt es Tool-Calling?

Nein. Das gehostete Modell verarbeitet nur Text-Chat mit Texteingabe und -ausgabe ohne Tool-Calling. Verwenden Sie für Agenten, die Funktionen aufrufen, stattdessen ein Gemini-Modell.

Welche Größe hat das Modell?

Etwa 31 Milliarden Parameter, dicht, das größte der fünf Gemma 4-Größen: E2B, E4B, 12B, 26B, A4B und 31B. Kleinere Größen zielen auf Telefone und Laptops ab.

Was kostet Gemma 4 31B?

Auf TokenLab kostet Gemma 4 31B Eingabe $0.102 / Ausgabe $0.297 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welchen Endpunkt soll Gemma 4 31B verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/chat/completions für Gemma 4 31B. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Gemma 4 31B?

Gemma 4 31B unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Gemma 4 31B vergleichen

Quellen

Geprüft am 02.10.2026

Ähnliche Modelle