Google: Gemini 3.5 Flash
gemini-3.5-flash- Eingabe / Ausgabe-50%
- $1.50 / $9.00$0.75 / $4.50
- Kontext
- 1M
- Veröffentlicht
- 19. Mai 2026
- Maximale Ausgabe
- 64K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-CacheReasoning
Über Gemini 3.5 Flash
Gemini 3.5 Flash ist ein stabiles Modell der Flash-Klasse von Google, das Google als Basis für Geschwindigkeit und grundlegende Leistung bei routinemäßigen Workloads mit hohem Durchsatz beschreibt. Es liest Text und Bilder, ruft Tools auf, gibt schema-gebundenes JSON zurück und unterstützt Caching. Es ist zwischen Flash-Lite 3.5 und den späteren Flash-Releases 3.6, 3.7 und 3.8 angesiedelt.
Stärken
- Ein stabiles Allzweck-Flash-Modell für routinemäßige Chats, Extraktionen und Zusammenfassungen bei hohem Volumen.
- Tool-Calling unterstützt Assistenten, die eine Aufgabe in wenigen Schritten ausführen.
- Durch die Bildeingabe können Screenshots, Scans und Diagramme ohne ein separates Vision-Modell verarbeitet werden.
- Schema-gebundenes JSON und Kontext-Caching eignen sich für wiederholte Pipeline-Aufrufe.
Alternativen
- Die späteren Flash-Modelle 3.6, 3.7 und 3.8 sind leistungsfähiger bei Coding- und Agenten-Aufgaben.
- Es verfügt über keinen dedizierten Denkmodus, daher ist komplexes, mehrstufiges Schlussfolgern besser an anderer Stelle aufgehoben.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextGemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentAPI-Format:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preise
Der Verified-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis ist der veröffentlichte Preis des Modellherstellers und gilt für die zuverlässigere Official-Route. Auto rechnet die Route ab, die die Anfrage abschließt.
Standardspezifikation
Pro 1M Token- Official-Preis
- Eingabe $1.50 / Ausgabe $9.00 / Cache-Lesevorgang $0.15
- Verified-Preis
- Eingabe $0.75 / Ausgabe $4.50 / Cache-Lesevorgang $0.075
- Rabatt
- -50%
Cache-Lesevorgang
- Official-Preis
- $0.15
- Verified-Preis
- $0.075
- Rabatt
- -50%
Die Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet.
Websuche
- Official-Preis
- $0.014/Suche
- Verified-Preis
- $0.007/Suche
- Rabatt
- -50%
| Official-PreisPro 1M Token | Verified-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Standardspezifikation | Eingabe $1.50 / Ausgabe $9.00 / Cache-Lesevorgang $0.15 | Eingabe $0.75 / Ausgabe $4.50 / Cache-Lesevorgang $0.075 | -50% |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.15 | $0.075 | -50% |
| Tool-GebührenDie Abrechnung erfolgt pro Aufruf, nur wenn das Modell das Tool verwendet. | |||
| Websuche | $0.014/Suche | $0.007/Suche | -50% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
- Erfolgsquote (30 Tage)
- 95,0%
- Anfragen (30 Tage)
- 1K+
- Zuletzt aktiv
- vor 3 Stunden
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Gemini 3.5 Flash in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste gemini-3.5-flash mit einer kurzen Nachricht an /v1beta/models/gemini-3.5-flash:generateContent. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Reasoning
- Vision
Kundenorientierter Chat
Beantwortung von Produktfragen mit einer zwischengespeicherten Wissensdatenbank im Prompt-Präfix.
Batch-Zusammenfassung
Zusammenfassung von Anrufprotokollen oder Tickets mit Ausgabe einer festen JSON-Zusammenfassung pro Element.
Formular- und Dokumentenlesen
Extrahieren von Feldern aus gescannten Formularen und Lieferscheinen in strukturierte Datensätze, die ein nachgelagertes System direkt laden kann.
Coding-Hilfe für Einsteiger
Code erklären, kleine Funktionen schreiben und Unit-Tests entwerfen, bei denen keine große Tiefe erforderlich ist.
Prompt-Beispiele
Fasse dieses Support-Protokoll in drei Stichpunkten zusammen und setze 'resolved' auf true oder false.
Lies diesen gescannten Lieferschein und gib die Bestellnummer, die Artikel und den Signaturstatus als JSON zurück.
Schreibe eine Python-Funktion, die ISO-Daten aus unformatierten Strings parst, sowie fünf Testfälle.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Was ist Gemini 3.5 Flash?
Ein stabiles Gemini-Modell der Flash-Klasse für routinemäßige Aufgaben mit hohem Durchsatz. Es verarbeitet Text und Bilder, nutzt Tools und erstellt strukturierte Ausgaben, wobei der Fokus auf konstanter Geschwindigkeit statt auf maximaler Tiefe liegt.
Wie ist der Vergleich zu Gemini 3.5 Flash-Lite?
Flash-Lite ist Googles schnellstes und wirtschaftlichstes 3.5-Modell; Flash ist das umfassendere Modell für Aufgaben, die mehr Sorgfalt erfordern. Wählen Sie Lite für Tagging und Extraktion, Flash für Konversationen und längere Ausgaben.
Ist es gut für Coding-Agenten geeignet?
Es kann kleine Coding-Aufgaben bewältigen, aber Googles spätere Flash-Modelle 3.7 und 3.8 sind für komplexes Coding und langfristige Agenten konzipiert. Verwenden Sie 3.5 Flash, wenn die Aufgabe einfach ist und das Volumen hoch ist.
Unterstützt es Bilder und Caching?
Ja, beides. Bilder können neben Text in einer Anfrage enthalten sein, und Kontext-Caching verwendet ein langes, gemeinsames Präfix über viele Anfragen hinweg wieder, wie etwa einen festen Anweisungssatz.
Was kostet Gemini 3.5 Flash?
Auf TokenLab kostet Gemini 3.5 Flash Eingabe $0.75 / Ausgabe $4.50 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Gemini 3.5 Flash?
Gemini 3.5 Flash verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.
Welchen Endpunkt soll Gemini 3.5 Flash verwenden?
Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent für Gemini 3.5 Flash. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Gemini 3.5 Flash?
Gemini 3.5 Flash unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Gemini 3.5 Flash vergleichen
Anleitungen für Gemini 3.5 Flash
Quellen
Geprüft am 02.10.2026