Google: Gemini 3.7 Flash
gemini-3.7-flash- Eingabe / Ausgabe-50%
- $0.75 / $3.75$0.375 / $1.88
- Kontext
- 1M
- Veröffentlicht
- 13. Aug. 2026
- Maximale Ausgabe
- 64K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-Cache
Über Gemini 3.7 Flash
Gemini 3.7 Flash ist ein stabiles Modell der Flash-Klasse von Google, das im August 2026 veröffentlicht wurde. Google beschreibt es als Modell für komplexe Programmierung, agentenbasierte Workflows und zuverlässige mehrstufige Ausführung. Es verarbeitet Text und Bilder, unterstützt Denkprozesse, ruft Tools auf, gibt schema-gebundenes JSON zurück und speichert Kontext im Cache. Es ist eine Stufe über 3.6 Flash und eine Stufe unter 3.8 Flash angesiedelt.
Stärken
- Denkprozesse können vor der Antwort ablaufen, was bei Programmier- und mehrstufigen Aufgaben hilfreich ist.
- Zuverlässige mehrstufige Ausführung ist das erklärte Designziel, was nützlich ist, wenn ein Agent seinen Fortschritt nicht verlieren darf.
- Tool-Aufrufe und schema-gebundenes JSON erleichtern die Einspeisung der Ergebnisse in andere Systeme.
- Die Bildeingabe verarbeitet Screenshots, Diagramme und gescannte Dokumente.
Alternativen
- Gemini 3.8 Flash ist das neuere Modell, das Google als sein leistungsfähigstes Modell der Flash-Klasse präsentiert.
- Denkprozesse erhöhen die Latenz, daher sind einfache Abfragen bei Flash-Lite besser aufgehoben.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextGemini APIPOST/v1beta/models/gemini-3.7-flash:generateContentAPI-Format:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preise
Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.
Promotional Standard
Pro 1M Token- Official-Preis
- Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
- Verified-Preis
- Eingabe $0.375 / Ausgabe $1.88 / Cache-Lesevorgang $0.0375
- Rabatt
- -50%
Cache-Lesevorgang
- Official-Preis
- $0.075
- Verified-Preis
- $0.0375
- Rabatt
- -50%
Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.
Websuche
- Official-Preis
- $0.014/Suche
- Verified-Preis
- $0.007/Suche
- Rabatt
- -50%
| Official-PreisPro 1M Token | Verified-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Promotional Standard | Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075 | Eingabe $0.375 / Ausgabe $1.88 / Cache-Lesevorgang $0.0375 | -50% |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.075 | $0.0375 | -50% |
| Tool-GebührenDie Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet. | |||
| Websuche | $0.014/Suche | $0.007/Suche | -50% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
- Erfolgsquote (30 Tage)
- 99,8%
- Mediane Latenz (7 Tage)
- 13,6 sn=271
- P95-Latenz (7 Tage)
- 53 sn=271
- Anfragen (30 Tage)
- 1K+
- Zuletzt aktiv
- vor 19 Stunden
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Gemini 3.7 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste gemini-3.7-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.7-flash:generateContent. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Vision
Funktionsimplementierung
Lassen Sie einen Agenten ein Ticket lesen, mehrere Dateien bearbeiten und Tests ausführen.
Workflow-Automatisierung
Verketten Sie Genehmigungen, Abfragen und Benachrichtigungen, bei denen jeder Schritt vom vorherigen abhängt.
Code-Review
Lesen Sie ein Diff, markieren Sie riskante Änderungen und erläutern Sie jeden Befund, damit ein menschlicher Prüfer schnell entscheiden kann, was zu akzeptieren ist.
Datenbereinigung
Analysieren Sie inkonsistente Datensätze und schlagen Sie Normalisierungsregeln vor, bevor diese angewendet werden, damit die Bereinigung vorab geprüft werden kann.
Prompt-Beispiele
Lesen Sie dieses Ticket und die verknüpften Dateien, implementieren Sie die Änderung und listen Sie auf, welche Tests Sie ausgeführt haben.
Überprüfen Sie dieses Diff auf Nebenläufigkeitsfehler und stufen Sie die Ergebnisse nach Schweregrad ein.
Diese beiden Kundendatensätze sehen wie Duplikate aus. Erklären Sie, welche Felder in Konflikt stehen und welche Regel sie sicher zusammenführen würde.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Wofür ist Gemini 3.7 Flash konzipiert?
Komplexe Programmierung, Agenten-Workflows und mehrstufige Ausführung, die vom ersten bis zum letzten Schritt zuverlässig bleiben muss. Es ist ein Flash-Modell mit Denkfähigkeit sowie Tool- und Bildunterstützung.
Unterstützt es Denkprozesse?
Ja. Es kann vor der Antwort logisch schlussfolgern, was die Ergebnisse bei Code und Planung verbessert. Halten Sie diesen Aufwand bei kurzen interaktiven Dialogen gering, um die Antwortzeiten kurz zu halten.
Wie unterscheidet es sich von 3.6 Flash?
3.7 Flash ist das spätere Modell und fügt Denkprozesse hinzu, mit einem stärkeren Fokus auf zuverlässige mehrstufige Abläufe. 3.6 Flash ist auf Programmierschleifen und visuelles Schlussfolgern ohne Denkprozesse ausgelegt.
Ist 3.8 Flash eine bessere Wahl?
Oft ja, bei langfristigen Software-Engineering-Projekten. 3.7 Flash bleibt eine solide Wahl, wenn Sie Prompts bereits darauf abgestimmt haben und die Ergebnisse Ihren Anforderungen entsprechen.
Was kostet Gemini 3.7 Flash?
Auf TokenLab kostet Gemini 3.7 Flash Eingabe $0.375 / Ausgabe $1.88 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Gemini 3.7 Flash?
Gemini 3.7 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.
Welchen Endpunkt soll Gemini 3.7 Flash verwenden?
Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent für Gemini 3.7 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Gemini 3.7 Flash?
Gemini 3.7 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Gemini 3.7 Flash vergleichen
Quellen
Geprüft am 02.10.2026