Google: Gemini 3.6 Flash
gemini-3.6-flash- Eingabe / Ausgabe
- $0.75 / $3.75
- Kontext
- 1M
- Veröffentlicht
- 21. Juli 2026
- Maximale Ausgabe
- 64K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-Cache
Über Gemini 3.6 Flash
Gemini 3.6 Flash ist ein stabiles Gemini-Modell der Flash-Klasse, das laut Google ein Gleichgewicht zwischen Geschwindigkeit und multimodaler Fähigkeit bietet. Es wurde im Juli 2026 veröffentlicht, zwischen 3.5 Flash und 3.7 Flash. Google positioniert es für effiziente Coding-Schleifen, Tool-Orchestrierung und visuelles Schlussfolgern, wodurch es sich für Agenten eignet, die ein Ergebnis prüfen, überarbeiten und die nächste Aktion entscheiden.
Stärken
- Geeignet für Schleifen, in denen ein Agent Code ausführt, die Ausgabe liest und überarbeitet.
- Tool-Orchestrierung über mehrere Aufrufe hinweg ist ein erklärter Schwerpunkt.
- Visuelles Schlussfolgern über Screenshots und Diagramme funktioniert in derselben Anfrage wie Text.
- Schema-gebundenes JSON und Caching unterstützen den wiederholbaren Produktionseinsatz.
Alternativen
- 3.7 und 3.8 Flash sind neuer und auf komplexeres Coding sowie längere autonome Abläufe ausgerichtet.
- Es verfügt über keinen dedizierten Denkmodus, daher sollte tiefgreifendes Überlegen besser von einem Pro-Modell durchgeführt werden.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextGemini APIPOST/v1beta/models/gemini-3.6-flash:generateContentAPI-Format:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preise
Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.
Standardspezifikation
Pro 1M Token- Offizieller Preis
- Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
- TokenLab-Preis
- Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
- Rabatt
- —
Cache-Lesevorgang
- Offizieller Preis
- $0.075
- TokenLab-Preis
- $0.075
- Rabatt
- —
Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.
Websuche
- Offizieller Preis
- $0.014/Suche
- TokenLab-Preis
- $0.007/Suche
- Rabatt
- -50%
| Offizieller PreisPro 1M Token | TokenLab-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Standardspezifikation | Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075 | Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075 | — |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.075 | $0.075 | — |
| Tool-GebührenDie Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet. | |||
| Websuche | $0.014/Suche | $0.007/Suche | -50% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
- Erfolgsquote (30 Tage)
- 99,7%
- Anfragen (30 Tage)
- 100+
- Zuletzt aktiv
- vor 13 Stunden
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Gemini 3.6 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste gemini-3.6-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.6-flash:generateContent. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Vision
Code-Korrektur-Schleifen
Lassen Sie einen Agenten Tests ausführen, Fehler lesen, Dateien patchen und den Vorgang wiederholen, bis sie bestehen.
UI-Inspektion
Vergleichen Sie einen Screenshot mit einer schriftlichen Spezifikation und listen Sie jede Abweichung bei Abstand, Farbe oder Layout auf, die ein Prüfer beheben sollte.
Tool-intensive Assistenten
Koordinieren Sie Such-, Kalender- und CRM-Aufrufe innerhalb einer Konversation und geben Sie die Ergebnisse jedes Tools an die nächste Entscheidung weiter.
Multimodale Q&A
Beantworten Sie Fragen, die sowohl ein Diagrammbild als auch den umgebenden Berichtstext erfordern.
Prompt-Beispiele
Führe die Tests aus, lies die Fehlerausgabe und ändere nur die Funktion, die den zweiten Test zum Scheitern bringt.
Vergleiche diesen Screenshot mit der Design-Spezifikation und liste jede Abweichung bei Abstand oder Farbe auf.
Überprüfe meinen Kalender und das CRM und entwirf dann eine Antwort, die zwei Besprechungstermine vorschlägt.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Was kann Gemini 3.6 Flash am besten?
Iterative Agentenarbeit: Coding-Schleifen, Tool-Orchestrierung und Schlussfolgern über Bilder. Es gleicht Geschwindigkeit mit multimodaler Fähigkeit aus, was es zu einem vernünftigen Standard für Agenten macht, die nicht das neueste Flash benötigen.
Wie unterscheidet es sich von 3.5 Flash?
3.6 ist die spätere Version und auf Coding-Schleifen und Tool-Nutzung ausgelegt, während 3.5 Flash die Basis für routinemäßige Arbeit mit hohem Volumen ist. Erwarten Sie ein besseres Agentenverhalten von 3.6.
Sollte ich auf 3.8 Flash umsteigen?
Wenn Sie lange Software-Aufgaben oder komplexe Unternehmensabläufe ausführen, ist 3.8 Flash das Modell, das Google dafür vorsieht. Für einfachere Agenten reicht 3.6 möglicherweise aus; führen Sie beide mit Ihren eigenen Traces aus.
Akzeptiert es Bilder?
Ja. Bilder und Text können in einer einzigen Anfrage kombiniert werden, und das Modell antwortet in Textform oder in einem JSON, das einem von Ihnen bereitgestellten Schema folgt. Es generiert selbst keine Bilder.
Was kostet Gemini 3.6 Flash?
Auf TokenLab kostet Gemini 3.6 Flash Eingabe $0.75 / Ausgabe $3.75 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Gemini 3.6 Flash?
Gemini 3.6 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.
Welchen Endpunkt soll Gemini 3.6 Flash verwenden?
Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent für Gemini 3.6 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Gemini 3.6 Flash?
Gemini 3.6 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Gemini 3.6 Flash vergleichen
Quellen
Geprüft am 02.10.2026