Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite zielt auf hochvolumige Arbeit mit kurzen Antwortzeiten ab. Erwägen Sie den Einsatz für Dokumentenverarbeitung, Extraktion und kleinere Agentenaufgaben, die wiederholt ausgeführt werden und eine effiziente Verarbeitung von Text- und Bildeingaben erfordern.
Modelle vergleichen
gemini-3.5-flash-lite
VerfügbarGoogleUnterhaltung90% Rabatt bei Cache-Nutzung
Eingabe / Ausgabe-50%
$0.30 / $2.50$0.15 / $1.25
Kontext
1M
Veröffentlicht
21. Juli 2026
Maximale Ausgabe
64K
Modalitäten
VisionUnterhaltung
Funktionen
Tool-NutzungPrompt-Cache

Über Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite ist Googles schnellstes und kosteneffizientestes Modell der 3.5-Generation, veröffentlicht im Juli 2026. Es zielt auf hochvolumige Arbeit ab, bei der kurze Antwortzeiten wichtig sind: Dokumentenverarbeitung, Extraktion und kleine, wiederholte Agentenaufgaben. Es liest Text und Bilder, ruft Tools auf, gibt schema-gebundenes JSON zurück und speichert Kontext; Google empfiehlt es nun für neue Projekte.

Stärken

  • Entwickelt für kurze Antwortzeiten bei Arbeiten, die tausendfach wiederholt werden.
  • Verarbeitet Text und Bilder zusammen für die Dokumenten- und Screenshot-Verarbeitung.
  • Schema-gebundenes JSON sorgt für konsistente Extraktionsergebnisse.
  • Durch Funktionsaufrufe können kleine Agentenschritte wie Nachschlagevorgänge oder Routing ausgeführt werden.

Alternativen

  • Lange Programmiersitzungen und komplexe Unternehmensabläufe gehören zu 3.8 Flash oder 3.1 Pro.
  • Es übersieht Details, die ein umfassenderes Flash-Modell bei dichten oder mehrdeutigen Dokumenten erkennt.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextGemini API
    POST/v1beta/models/gemini-3.5-flash-lite:generateContent
    API-Format:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Preise

Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.

Standardspezifikation

Pro 1M Token
Offizieller Preis
Eingabe $0.30 / Ausgabe $2.50 / Cache-Lesevorgang $0.03
TokenLab-Preis
Eingabe $0.15 / Ausgabe $1.25 / Cache-Lesevorgang $0.015
Rabatt
-50%
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.03
TokenLab-Preis
$0.015
Rabatt
-50%

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
99,7%
Mediane Latenz (7 Tage)
1,9 sn=346
P95-Latenz (7 Tage)
7 sn=346
Anfragen (30 Tage)
100+
Zuletzt aktiv
vor 23 Stunden

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne Gemini 3.5 Flash-Lite in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste gemini-3.5-flash-lite mit einer kurzen Nachricht an /v1beta/models/gemini-3.5-flash-lite:generateContent. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Vision
  • Dokumenten-Pipelines

    Konvertieren Sie Verträge, Rechnungen und Berichte in großem Maßstab in strukturierte Felder und schreiben Sie für jede eingehende Datei einen validierten JSON-Datensatz.

  • Ticket-Triage

    Sortieren Sie eingehende Tickets oder Nachrichten nach Thema und Dringlichkeit, bevor ein Mensch oder ein größeres Modell sie sieht.

  • Kleine Agenten

    Führen Sie eng gefasste Aufgaben in einer Schleife aus, wie z. B. Bestellabfragen oder Kalenderänderungen, bei denen jeder Schritt klein ist und die Schleife häufig wiederholt wird.

  • Visuelle Prüfungen

    Bestätigen Sie, dass hochgeladene Fotos einfache Regeln erfüllen, wie z. B. ein sichtbares Etikett oder die korrekte Ausrichtung.

Prompt-Beispiele

Extrahieren Sie jede Position aus dieser Rechnung als JSON mit Beschreibung, Menge und Einzelbetrag.

Bewerten Sie die Dringlichkeit dieses Tickets als niedrig, mittel oder hoch und geben Sie den einen Satz an, der dies rechtfertigt.

Prüfen Sie, ob dieses Produktfoto das Verpackungsetikett deutlich zeigt; antworten Sie mit Ja oder Nein und begründen Sie dies.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Wofür ist Gemini 3.5 Flash-Lite gedacht?

Schnelle, wiederholte, einfache Arbeit: Extraktion, Klassifizierung, Routing und leichte multimodale Prüfungen. Es ist das wirtschaftliche Ende der 3.5-Familie, das auf Antwortzeit statt auf Tiefe ausgelegt ist.

Ist es neuer als Gemini 3.1 Flash-Lite?

Ja. Es ist die spätere Generation, und Google listet es als die empfohlene leichtgewichtige Wahl für neue Projekte. Das ältere 3.1 Flash-Lite bleibt für bestehende Integrationen verfügbar.

Kann es Bilder lesen?

Ja, Bilder können einen Text in einer Anfrage begleiten, und die Antwort erfolgt als Klartext oder als strukturiertes JSON, was sich für Fotoprüfungen und die Extraktion gescannter Dokumente eignet.

Wann ist es zu klein?

Wenn die Aufgabe anhaltendes logisches Denken, sorgfältige Analyse langer Dokumente oder stundenlange Programmierarbeit erfordert. Wechseln Sie in diesen Fällen zu Gemini 3.8 Flash oder 3.1 Pro.

Was kostet Gemini 3.5 Flash-Lite?

Auf TokenLab kostet Gemini 3.5 Flash-Lite Eingabe $0.15 / Ausgabe $1.25 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite verarbeitet bis zu 1.048.576 Token Kontext und gibt pro Antwort bis zu 65.536 Token aus.

Welchen Endpunkt soll Gemini 3.5 Flash-Lite verwenden?

Verwenden Sie https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent für Gemini 3.5 Flash-Lite. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

Gemini 3.5 Flash-Lite vergleichen

Quellen

Geprüft am 02.10.2026

Mehr aus der Gemini 3-Serie

Ähnliche Modelle