Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Google: Gemini 3.7 Flash

Hocheffizientes Gemini-Modell für agentische Workflows, Programmierung und multimodales Reasoning
Modelle vergleichen
gemini-3.7-flash
VerfügbarGoogleUnterhaltung90% Rabatt bei Cache-Nutzung
Eingabe / Ausgabe-50%
$0.75 / $3.75$0.375 / $1.88
Kontext
1M
Veröffentlicht
13. Aug. 2026
Maximale Ausgabe
64K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-Cache

Über Gemini 3.7 Flash

Gemini 3.7 Flash ist ein stabiles Modell der Flash-Klasse von Google, das im August 2026 veröffentlicht wurde. Google beschreibt es als Modell für komplexe Programmierung, agentenbasierte Workflows und zuverlässige mehrstufige Ausführung. Es verarbeitet Text und Bilder, unterstützt Denkprozesse, ruft Tools auf, gibt schema-gebundenes JSON zurück und speichert Kontext im Cache. Es ist eine Stufe über 3.6 Flash und eine Stufe unter 3.8 Flash angesiedelt.

Stärken

  • Denkprozesse können vor der Antwort ablaufen, was bei Programmier- und mehrstufigen Aufgaben hilfreich ist.
  • Zuverlässige mehrstufige Ausführung ist das erklärte Designziel, was nützlich ist, wenn ein Agent seinen Fortschritt nicht verlieren darf.
  • Tool-Aufrufe und schema-gebundenes JSON erleichtern die Einspeisung der Ergebnisse in andere Systeme.
  • Die Bildeingabe verarbeitet Screenshots, Diagramme und gescannte Dokumente.

Alternativen

  • Gemini 3.8 Flash ist das neuere Modell, das Google als sein leistungsfähigstes Modell der Flash-Klasse präsentiert.
  • Denkprozesse erhöhen die Latenz, daher sind einfache Abfragen bei Flash-Lite besser aufgehoben.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    API-Format:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preise

Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.

Promotional Standard

Pro 1M Token
Official-Preis
Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
Verified-Preis
Eingabe $0.375 / Ausgabe $1.88 / Cache-Lesevorgang $0.0375
Rabatt
-50%
Prompt-Cache-Preise

Cache-Lesevorgang

Official-Preis
$0.075
Verified-Preis
$0.0375
Rabatt
-50%
Tool-Gebühren

Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.

Websuche

Official-Preis
$0.014/Suche
Verified-Preis
$0.007/Suche
Rabatt
-50%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
99,8%
Mediane Latenz (7 Tage)
13,6 sn=271
P95-Latenz (7 Tage)
53 sn=271
Anfragen (30 Tage)
1K+
Zuletzt aktiv
vor 19 Stunden

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Gemini 3.7 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste gemini-3.7-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.7-flash:generateContent. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Vision
  • Funktionsimplementierung

    Lassen Sie einen Agenten ein Ticket lesen, mehrere Dateien bearbeiten und Tests ausführen.

  • Workflow-Automatisierung

    Verketten Sie Genehmigungen, Abfragen und Benachrichtigungen, bei denen jeder Schritt vom vorherigen abhängt.

  • Code-Review

    Lesen Sie ein Diff, markieren Sie riskante Änderungen und erläutern Sie jeden Befund, damit ein menschlicher Prüfer schnell entscheiden kann, was zu akzeptieren ist.

  • Datenbereinigung

    Analysieren Sie inkonsistente Datensätze und schlagen Sie Normalisierungsregeln vor, bevor diese angewendet werden, damit die Bereinigung vorab geprüft werden kann.

Prompt-Beispiele

Lesen Sie dieses Ticket und die verknüpften Dateien, implementieren Sie die Änderung und listen Sie auf, welche Tests Sie ausgeführt haben.

Überprüfen Sie dieses Diff auf Nebenläufigkeitsfehler und stufen Sie die Ergebnisse nach Schweregrad ein.

Diese beiden Kundendatensätze sehen wie Duplikate aus. Erklären Sie, welche Felder in Konflikt stehen und welche Regel sie sicher zusammenführen würde.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Wofür ist Gemini 3.7 Flash konzipiert?

Komplexe Programmierung, Agenten-Workflows und mehrstufige Ausführung, die vom ersten bis zum letzten Schritt zuverlässig bleiben muss. Es ist ein Flash-Modell mit Denkfähigkeit sowie Tool- und Bildunterstützung.

Unterstützt es Denkprozesse?

Ja. Es kann vor der Antwort logisch schlussfolgern, was die Ergebnisse bei Code und Planung verbessert. Halten Sie diesen Aufwand bei kurzen interaktiven Dialogen gering, um die Antwortzeiten kurz zu halten.

Wie unterscheidet es sich von 3.6 Flash?

3.7 Flash ist das spätere Modell und fügt Denkprozesse hinzu, mit einem stärkeren Fokus auf zuverlässige mehrstufige Abläufe. 3.6 Flash ist auf Programmierschleifen und visuelles Schlussfolgern ohne Denkprozesse ausgelegt.

Ist 3.8 Flash eine bessere Wahl?

Oft ja, bei langfristigen Software-Engineering-Projekten. 3.7 Flash bleibt eine solide Wahl, wenn Sie Prompts bereits darauf abgestimmt haben und die Ergebnisse Ihren Anforderungen entsprechen.

Was kostet Gemini 3.7 Flash?

Auf TokenLab kostet Gemini 3.7 Flash Eingabe $0.375 / Ausgabe $1.88 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Gemini 3.7 Flash?

Gemini 3.7 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.

Welchen Endpunkt soll Gemini 3.7 Flash verwenden?

Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent für Gemini 3.7 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Gemini 3.7 Flash?

Gemini 3.7 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Gemini 3.7 Flash vergleichen

Quellen

Geprüft am 02.10.2026

Mehr aus der Gemini 3-Serie

Ähnliche Modelle