Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Google: Gemini 3.5 Flash

Gemini 3.5 Flash wurde für kontinuierliche Programmieraufgaben und agentische Arbeit entwickelt. Der lange Kontext und die Tool-Calling-Funktionen eignen sich für Assistenten, die eine Aufgabe über mehrere Schritte hinweg ausführen und dabei Dokumente, Code und frühere Entscheidungen beibehalten müssen.
Modelle vergleichen
gemini-3.5-flash
VerfügbarGoogleUnterhaltung90% Rabatt bei Cache-Nutzung
Eingabe / Ausgabe-50%
$1.50 / $9.00$0.75 / $4.50
Kontext
1M
Veröffentlicht
19. Mai 2026
Maximale Ausgabe
64K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-CacheReasoning

Über Gemini 3.5 Flash

Gemini 3.5 Flash ist ein stabiles Modell der Flash-Klasse von Google, das Google als Basis für Geschwindigkeit und grundlegende Leistung bei routinemäßigen Workloads mit hohem Durchsatz beschreibt. Es liest Text und Bilder, ruft Tools auf, gibt schema-gebundenes JSON zurück und unterstützt Caching. Es ist zwischen Flash-Lite 3.5 und den späteren Flash-Releases 3.6, 3.7 und 3.8 angesiedelt.

Stärken

  • Ein stabiles Allzweck-Flash-Modell für routinemäßige Chats, Extraktionen und Zusammenfassungen bei hohem Volumen.
  • Tool-Calling unterstützt Assistenten, die eine Aufgabe in wenigen Schritten ausführen.
  • Durch die Bildeingabe können Screenshots, Scans und Diagramme ohne ein separates Vision-Modell verarbeitet werden.
  • Schema-gebundenes JSON und Kontext-Caching eignen sich für wiederholte Pipeline-Aufrufe.

Alternativen

  • Die späteren Flash-Modelle 3.6, 3.7 und 3.8 sind leistungsfähiger bei Coding- und Agenten-Aufgaben.
  • Es verfügt über keinen dedizierten Denkmodus, daher ist komplexes, mehrstufiges Schlussfolgern besser an anderer Stelle aufgehoben.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextGemini API
    POST/v1beta/models/gemini-3.5-flash:generateContent
    API-Format:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preise

Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.

Standardspezifikation

Pro 1M Token
Official-Preis
Eingabe $1.50 / Ausgabe $9.00 / Cache-Lesevorgang $0.15
Verified-Preis
Eingabe $0.75 / Ausgabe $4.50 / Cache-Lesevorgang $0.075
Rabatt
-50%
Prompt-Cache-Preise

Cache-Lesevorgang

Official-Preis
$0.15
Verified-Preis
$0.075
Rabatt
-50%
Tool-Gebühren

Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.

Websuche

Official-Preis
$0.014/Suche
Verified-Preis
$0.007/Suche
Rabatt
-50%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
95,0%
Anfragen (30 Tage)
1K+
Zuletzt aktiv
vor 3 Stunden

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Gemini 3.5 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste gemini-3.5-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.5-flash:generateContent. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Reasoning
  • Vision
  • Kundenorientierter Chat

    Beantwortung von Produktfragen mit einer zwischengespeicherten Wissensdatenbank im Prompt-Präfix.

  • Batch-Zusammenfassung

    Zusammenfassung von Anrufprotokollen oder Tickets mit Ausgabe einer festen JSON-Zusammenfassung pro Element.

  • Formular- und Dokumentenlesen

    Extrahieren von Feldern aus gescannten Formularen und Lieferscheinen in strukturierte Datensätze, die ein nachgelagertes System direkt laden kann.

  • Coding-Hilfe für Einsteiger

    Code erklären, kleine Funktionen schreiben und Unit-Tests entwerfen, bei denen keine große Tiefe erforderlich ist.

Prompt-Beispiele

Fasse dieses Support-Protokoll in drei Stichpunkten zusammen und setze 'resolved' auf true oder false.

Lies diesen gescannten Lieferschein und gib die Bestellnummer, die Artikel und den Signaturstatus als JSON zurück.

Schreibe eine Python-Funktion, die ISO-Daten aus unformatierten Strings parst, sowie fünf Testfälle.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Was ist Gemini 3.5 Flash?

Ein stabiles Gemini-Modell der Flash-Klasse für routinemäßige Aufgaben mit hohem Durchsatz. Es verarbeitet Text und Bilder, nutzt Tools und erstellt strukturierte Ausgaben, wobei der Fokus auf konstanter Geschwindigkeit statt auf maximaler Tiefe liegt.

Wie ist der Vergleich zu Gemini 3.5 Flash-Lite?

Flash-Lite ist Googles schnellstes und wirtschaftlichstes 3.5-Modell; Flash ist das umfassendere Modell für Aufgaben, die mehr Sorgfalt erfordern. Wählen Sie Lite für Tagging und Extraktion, Flash für Konversationen und längere Ausgaben.

Ist es gut für Coding-Agenten geeignet?

Es kann kleine Coding-Aufgaben bewältigen, aber Googles spätere Flash-Modelle 3.7 und 3.8 sind für komplexes Coding und langfristige Agenten konzipiert. Verwenden Sie 3.5 Flash, wenn die Aufgabe einfach ist und das Volumen hoch ist.

Unterstützt es Bilder und Caching?

Ja, beides. Bilder können neben Text in einer Anfrage enthalten sein, und Kontext-Caching verwendet ein langes, gemeinsames Präfix über viele Anfragen hinweg wieder, wie etwa einen festen Anweisungssatz.

Was kostet Gemini 3.5 Flash?

Auf TokenLab kostet Gemini 3.5 Flash Eingabe $0.75 / Ausgabe $4.50 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Gemini 3.5 Flash?

Gemini 3.5 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.

Welchen Endpunkt soll Gemini 3.5 Flash verwenden?

Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent für Gemini 3.5 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Gemini 3.5 Flash?

Gemini 3.5 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Gemini 3.5 Flash vergleichen

Anleitungen für Gemini 3.5 Flash

Quellen

Geprüft am 02.10.2026

Mehr aus der Gemini 3-Serie

Ähnliche Modelle