Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Google: Gemini 3.6 Flash

Gemini 3.6 Flash konzentriert sich auf effiziente Programmierschleifen, Tool-Orchestrierung und visuelles Reasoning. Er eignet sich gut für Agenten, die wiederholt Ergebnisse prüfen, Code überarbeiten und innerhalb einer größeren Aufgabe über den nächsten Schritt entscheiden.
Modelle vergleichen
gemini-3.6-flash
VerfügbarGoogleUnterhaltung90% Rabatt bei Cache-Nutzung
Eingabe / Ausgabe
$0.75 / $3.75
Kontext
1M
Veröffentlicht
21. Juli 2026
Maximale Ausgabe
64K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-Cache

Über Gemini 3.6 Flash

Gemini 3.6 Flash ist ein stabiles Gemini-Modell der Flash-Klasse, das laut Google ein Gleichgewicht zwischen Geschwindigkeit und multimodaler Fähigkeit bietet. Es wurde im Juli 2026 veröffentlicht, zwischen 3.5 Flash und 3.7 Flash. Google positioniert es für effiziente Coding-Schleifen, Tool-Orchestrierung und visuelles Schlussfolgern, wodurch es sich für Agenten eignet, die ein Ergebnis prüfen, überarbeiten und die nächste Aktion entscheiden.

Stärken

  • Geeignet für Schleifen, in denen ein Agent Code ausführt, die Ausgabe liest und überarbeitet.
  • Tool-Orchestrierung über mehrere Aufrufe hinweg ist ein erklärter Schwerpunkt.
  • Visuelles Schlussfolgern über Screenshots und Diagramme funktioniert in derselben Anfrage wie Text.
  • Schema-gebundenes JSON und Caching unterstützen den wiederholbaren Produktionseinsatz.

Alternativen

  • 3.7 und 3.8 Flash sind neuer und auf komplexeres Coding sowie längere autonome Abläufe ausgerichtet.
  • Es verfügt über keinen dedizierten Denkmodus, daher sollte tiefgreifendes Überlegen besser von einem Pro-Modell durchgeführt werden.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextGemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    API-Format:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preise

Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.

Standardspezifikation

Pro 1M Token
Offizieller Preis
Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
TokenLab-Preis
Eingabe $0.75 / Ausgabe $3.75 / Cache-Lesevorgang $0.075
Rabatt
—
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.075
TokenLab-Preis
$0.075
Rabatt
—
Tool-Gebühren

Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.

Websuche

Offizieller Preis
$0.014/Suche
TokenLab-Preis
$0.007/Suche
Rabatt
-50%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
99,7%
Anfragen (30 Tage)
100+
Zuletzt aktiv
vor 13 Stunden

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Gemini 3.6 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste gemini-3.6-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.6-flash:generateContent. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Vision
  • Code-Korrektur-Schleifen

    Lassen Sie einen Agenten Tests ausführen, Fehler lesen, Dateien patchen und den Vorgang wiederholen, bis sie bestehen.

  • UI-Inspektion

    Vergleichen Sie einen Screenshot mit einer schriftlichen Spezifikation und listen Sie jede Abweichung bei Abstand, Farbe oder Layout auf, die ein Prüfer beheben sollte.

  • Tool-intensive Assistenten

    Koordinieren Sie Such-, Kalender- und CRM-Aufrufe innerhalb einer Konversation und geben Sie die Ergebnisse jedes Tools an die nächste Entscheidung weiter.

  • Multimodale Q&A

    Beantworten Sie Fragen, die sowohl ein Diagrammbild als auch den umgebenden Berichtstext erfordern.

Prompt-Beispiele

Führe die Tests aus, lies die Fehlerausgabe und ändere nur die Funktion, die den zweiten Test zum Scheitern bringt.

Vergleiche diesen Screenshot mit der Design-Spezifikation und liste jede Abweichung bei Abstand oder Farbe auf.

Überprüfe meinen Kalender und das CRM und entwirf dann eine Antwort, die zwei Besprechungstermine vorschlägt.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Was kann Gemini 3.6 Flash am besten?

Iterative Agentenarbeit: Coding-Schleifen, Tool-Orchestrierung und Schlussfolgern über Bilder. Es gleicht Geschwindigkeit mit multimodaler Fähigkeit aus, was es zu einem vernünftigen Standard für Agenten macht, die nicht das neueste Flash benötigen.

Wie unterscheidet es sich von 3.5 Flash?

3.6 ist die spätere Version und auf Coding-Schleifen und Tool-Nutzung ausgelegt, während 3.5 Flash die Basis für routinemäßige Arbeit mit hohem Volumen ist. Erwarten Sie ein besseres Agentenverhalten von 3.6.

Sollte ich auf 3.8 Flash umsteigen?

Wenn Sie lange Software-Aufgaben oder komplexe Unternehmensabläufe ausführen, ist 3.8 Flash das Modell, das Google dafür vorsieht. Für einfachere Agenten reicht 3.6 möglicherweise aus; führen Sie beide mit Ihren eigenen Traces aus.

Akzeptiert es Bilder?

Ja. Bilder und Text können in einer einzigen Anfrage kombiniert werden, und das Modell antwortet in Textform oder in einem JSON, das einem von Ihnen bereitgestellten Schema folgt. Es generiert selbst keine Bilder.

Was kostet Gemini 3.6 Flash?

Auf TokenLab kostet Gemini 3.6 Flash Eingabe $0.75 / Ausgabe $3.75 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Gemini 3.6 Flash?

Gemini 3.6 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.

Welchen Endpunkt soll Gemini 3.6 Flash verwenden?

Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent für Gemini 3.6 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Gemini 3.6 Flash?

Gemini 3.6 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Gemini 3.6 Flash vergleichen

Quellen

Geprüft am 02.10.2026

Mehr aus der Gemini 3-Serie

Ähnliche Modelle