Google: Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite- Eingabe / Ausgabe-50%
- $0.30 / $2.50$0.15 / $1.25
- Kontext
- 1M
- Veröffentlicht
- 21. Juli 2026
- Maximale Ausgabe
- 64K
- Modalitäten
- VisionUnterhaltung
- Funktionen
- Tool-NutzungPrompt-Cache
Über Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite ist Googles schnellstes und kosteneffizientestes Modell der 3.5-Generation, veröffentlicht im Juli 2026. Es zielt auf hochvolumige Arbeit ab, bei der kurze Antwortzeiten wichtig sind: Dokumentenverarbeitung, Extraktion und kleine, wiederholte Agentenaufgaben. Es liest Text und Bilder, ruft Tools auf, gibt schema-gebundenes JSON zurück und speichert Kontext; Google empfiehlt es nun für neue Projekte.
Stärken
- Entwickelt für kurze Antwortzeiten bei Arbeiten, die tausendfach wiederholt werden.
- Verarbeitet Text und Bilder zusammen für die Dokumenten- und Screenshot-Verarbeitung.
- Schema-gebundenes JSON sorgt für konsistente Extraktionsergebnisse.
- Durch Funktionsaufrufe können kleine Agentenschritte wie Nachschlagevorgänge oder Routing ausgeführt werden.
Alternativen
- Lange Programmiersitzungen und komplexe Unternehmensabläufe gehören zu 3.8 Flash oder 3.1 Pro.
- Es übersieht Details, die ein umfassenderes Flash-Modell bei dichten oder mehrdeutigen Dokumenten erkennt.
Erste Schritte
API-Schlüssel erstellen
Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.
Senden Sie Ihre erste Anfrage
Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.
Text-zu-TextGemini APIPOST/v1beta/models/gemini-3.5-flash-lite:generateContentAPI-Format:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Preise
Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.
Standardspezifikation
Pro 1M Token- Offizieller Preis
- Eingabe $0.30 / Ausgabe $2.50 / Cache-Lesevorgang $0.03
- TokenLab-Preis
- Eingabe $0.15 / Ausgabe $1.25 / Cache-Lesevorgang $0.015
- Rabatt
- -50%
Cache-Lesevorgang
- Offizieller Preis
- $0.03
- TokenLab-Preis
- $0.015
- Rabatt
- -50%
| Offizieller PreisPro 1M Token | TokenLab-PreisPro 1M Token | Rabatt | |
|---|---|---|---|
| Standardspezifikation | Eingabe $0.30 / Ausgabe $2.50 / Cache-Lesevorgang $0.03 | Eingabe $0.15 / Ausgabe $1.25 / Cache-Lesevorgang $0.015 | -50% |
| Prompt-Cache-Preise | |||
| Cache-Lesevorgang | $0.03 | $0.015 | -50% |
Nutzung & Aktivität
Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.
Nutzung & Verfügbarkeit
Letzte 24 Stunden- Anfragen
- Erfolgsrate
- P95-Latenz
- Token gesamt
- Erfolgsquote (30 Tage)
- 99,7%
- Mediane Latenz (7 Tage)
- 1,9 sn=346
- P95-Latenz (7 Tage)
- 7 sn=346
- Anfragen (30 Tage)
- 100+
- Zuletzt aktiv
- vor 23 Stunden
Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.
In Console öffnen
Öffne Gemini 3.5 Flash-Lite in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.
Teste gemini-3.5-flash-lite mit einer kurzen Nachricht an /v1beta/models/gemini-3.5-flash-lite:generateContent. Zeige Antwort, Latenz und Kosten.
Anwendungsfälle
Geeignet für- Vision
Dokumenten-Pipelines
Konvertieren Sie Verträge, Rechnungen und Berichte in großem Maßstab in strukturierte Felder und schreiben Sie für jede eingehende Datei einen validierten JSON-Datensatz.
Ticket-Triage
Sortieren Sie eingehende Tickets oder Nachrichten nach Thema und Dringlichkeit, bevor ein Mensch oder ein größeres Modell sie sieht.
Kleine Agenten
Führen Sie eng gefasste Aufgaben in einer Schleife aus, wie z. B. Bestellabfragen oder Kalenderänderungen, bei denen jeder Schritt klein ist und die Schleife häufig wiederholt wird.
Visuelle Prüfungen
Bestätigen Sie, dass hochgeladene Fotos einfache Regeln erfüllen, wie z. B. ein sichtbares Etikett oder die korrekte Ausrichtung.
Prompt-Beispiele
Extrahieren Sie jede Position aus dieser Rechnung als JSON mit Beschreibung, Menge und Einzelbetrag.
Bewerten Sie die Dringlichkeit dieses Tickets als niedrig, mittel oder hoch und geben Sie den einen Satz an, der dies rechtfertigt.
Prüfen Sie, ob dieses Produktfoto das Verpackungsetikett deutlich zeigt; antworten Sie mit Ja oder Nein und begründen Sie dies.
Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.
FAQ
Wofür ist Gemini 3.5 Flash-Lite gedacht?
Schnelle, wiederholte, einfache Arbeit: Extraktion, Klassifizierung, Routing und leichte multimodale Prüfungen. Es ist das wirtschaftliche Ende der 3.5-Familie, das auf Antwortzeit statt auf Tiefe ausgelegt ist.
Ist es neuer als Gemini 3.1 Flash-Lite?
Ja. Es ist die spätere Generation, und Google listet es als die empfohlene leichtgewichtige Wahl für neue Projekte. Das ältere 3.1 Flash-Lite bleibt für bestehende Integrationen verfügbar.
Kann es Bilder lesen?
Ja, Bilder können einen Text in einer Anfrage begleiten, und die Antwort erfolgt als Klartext oder als strukturiertes JSON, was sich für Fotoprüfungen und die Extraktion gescannter Dokumente eignet.
Wann ist es zu klein?
Wenn die Aufgabe anhaltendes logisches Denken, sorgfältige Analyse langer Dokumente oder stundenlange Programmierarbeit erfordert. Wechseln Sie in diesen Fällen zu Gemini 3.8 Flash oder 3.1 Pro.
Was kostet Gemini 3.5 Flash-Lite?
Auf TokenLab kostet Gemini 3.5 Flash-Lite Eingabe $0.15 / Ausgabe $1.25 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.
Welche Kontext- und Ausgabelimits hat Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.
Welchen Endpunkt soll Gemini 3.5 Flash-Lite verwenden?
Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent für Gemini 3.5 Flash-Lite. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.
Welche Operationen unterstützt Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.
Gemini 3.5 Flash-Lite vergleichen
Quellen
Geprüft am 02.10.2026