Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

Google: Gemini 3.1 Flash-Lite

Yüksek hacimli çok modlu ve aracı iş yükleri için düşük gecikmeli Gemini modeli
Modelleri karşılaştır
gemini-3.1-flash-lite
MevcutGoogleSohbetÖnbelleğe alınan girdi 90% daha ucuz
Girdi / Çıktı-50%
$0.25 / $1.50$0.125 / $0.75
Bağlam
1M
Yayınlanma tarihi
7 May 2026
Maksimum çıktı
64K
Modlar
Görüntü İşlemeSohbet
Yetenekler
Araç kullanımıİstem Önbelleği

Gemini 3.1 Flash-Lite hakkında

Gemini 3.1 Flash-Lite, Google'ın Gemini 3.1 serisindeki yüksek hacimli çok modlu ve ajan iş yükleri için tasarlanmış düşük gecikmeli, düşük maliyetli modelidir. Google, daha büyük modellerle yarışan öncü sınıf performansı çok daha düşük bir maliyetle sunduğunu belirtir. Metin ve görselleri okur, araçları çağırır, şemaya bağlı JSON döndürür ve bağlam önbelleğe almayı (context caching) destekler; yetenek olarak Flash katmanının altında yer alır.

Güçlü yönleri

  • Kısa yanıt süreleri, her çağrının hızlı bir şekilde yanıt vermesi gereken etkileşimli özellikler için onu uygun kılar.
  • Görsel ve metin aynı isteğin içine gider; bu da fiş, form ve ekran görüntüsü işlemeye uygundur.
  • Şemaya bağlı JSON çıktısı, serbest metnin kırılgan bir şekilde ayrıştırılması ihtiyacını ortadan kaldırır.
  • Araç çağırma ve bağlam önbelleğe alma, ölçeklenebilir bir şekilde tekrarlanan benzer ajan adımlarını destekler.

Alternatif aramanız gereken durumlar

  • Uzun, çok adımlı kodlama ajanları için Flash ve Pro modelleri bir Lite modeline göre daha iyi dayanır.
  • Öncelikli olarak akıl yürütme odaklı bir model değildir; zor matematik veya derin planlama Gemini 3.1 Pro'ya gönderilmelidir.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Metinden metneGemini API
    POST/v1beta/models/gemini-3.1-flash-lite:generateContent
    API formatı:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.1-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Fiyatlandırma

Verified fiyatı Verified için geçerlidir ve çoğu modelde daha düşüktür. Official fiyatı, model üreticisinin yayınladığı fiyattır ve daha güvenilir Official rotası için geçerlidir. Auto, isteği tamamlayan rotanın fiyatını uygular.

Varsayılan spesifikasyon

1M token başına
Official fiyatı
Girdi $0.25 / Çıktı $1.50 / Önbellek okuma $0.025
Verified fiyatı
Girdi $0.125 / Çıktı $0.75 / Önbellek okuma $0.0125
İndirim
-50%
Prompt cache fiyatlandırması

Önbellek okuma

Official fiyatı
$0.025
Verified fiyatı
$0.0125
İndirim
-50%
Araç ücretleri

Ücretlendirme, model aracı kullandığı her çağrı için yapılır.

Web araması

Official fiyatı
$0.014/arama
Verified fiyatı
$0.007/arama
İndirim
-50%

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Son 30 günün başarı oranı
100,0%
30 günlük istekler
40K+
Son etkinlik
11 dakika önce

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

Gemini 3.1 Flash-Lite modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

gemini-3.1-flash-lite ile /v1beta/models/gemini-3.1-flash-lite:generateContent üzerinden kısa bir mesaj dene. Yanıtı, gecikmeyi ve maliyeti göster.

Kullanım senaryoları

Uygun olduğu kullanımlar
  • Görüntü İşleme
  • Toplu veri çıkarma

    Binlerce faturadan veya formdan alanları çekin ve her sonucu doğrulanmış bir JSON nesnesi olarak yazın.

  • İçerik denetimi ve etiketleme

    Kullanıcı yüklemelerini ve yorumlarını, tek satırlık bir gerekçeyle sabit bir politikaya karşı etiketleyin.

  • Yönlendirme katmanı

    Bir isteğin hangi uzman modele veya araca gitmesi gerektiğine karar verin ve ardından iletin.

  • Gerçek zamanlı asistanlar

    Görünür bir bekleme süresinin kullanan kişinin deneyimine zarar vereceği otoktamamlama, hızlı yanıtlar veya sesli asistan turlarını güçlendirin.

Prompt örnekleri

Bu fatura görselinden satıcıyı, tarihi, toplamı ve para birimini çıkarın ve bunları JSON olarak döndürün.

Aşağıdaki yorumu spam, taciz, soru veya övgü olarak etiketleyin ve seçimi tek cümleyle açıklayın.

Bu kullanıcı mesajı göz önüne alındığında şunlardan birini seçin: search_docs, create_ticket, answer_directly. Yalnızca araç adıyla yanıt verin.

Bu model koşullu fiyatlandırmaya sahiptir. Yalnızca aylık token toplamları güvenilir bir tahmin üretmez; istek özellikleri, önbellek ve geçerli zaman penceresi için ayrıntılı fiyatlandırmayı kullanın.

FAQ

Gemini 3.1 Flash-Lite en çok ne için uygundur?

Çıkarma, sınıflandırma, etiketleme, yönlendirme ve hızlı çok modlu yanıtlar gibi yüksek hacimli, gecikmeye duyarlı işler. Hız ve çağrı başına daha hafif bir yük uğruna akıl yürütme derinliğinden biraz ödün verir.

Görsel kabul ediyor mu?

Evet. Metin ve görseller tek bir istekle karıştırılabilir, böylece belgeleri, ekran görüntülerini ve fotoğrafları okuyabilir. Yanıtı metin olarak veya şemanızla eşleşen JSON olarak geri döner.

Araç çağırabilir mi?

Evet. Fonksiyon çağırma desteklenir; bu da onun basit istekler için araçları seçen veya zor durumları daha büyük bir modele ileten ilk aşama ajan olarak hareket etmesini sağlar.

Gemini 3.5 Flash-Lite'tan farkı nedir?

3.5 Flash-Lite daha yeni nesildir ve Google'ın artık yeni projeleri yönlendirdiği modeldir; 3.1 Flash-Lite ise hala kararlı olan eski Lite modelidir. Trafiği taşımadan önce kendi prompt'larınızı her ikisinde de test edin.

Gemini 3.1 Flash-Lite ne kadara mal olur?

TokenLab üzerinde Gemini 3.1 Flash-Lite Girdi $0.125 / Çıktı $0.75 1M token başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

Gemini 3.1 Flash-Lite bağlam penceresi ve çıktı sınırı nedir?

Gemini 3.1 Flash-Lite 1.048.576 jetona kadar bağlam kabul eder ve tek yanıtta 65.536 jetona kadar çıktı verir.

Gemini 3.1 Flash-Lite hangi endpoint'i kullanmalı?

Gemini 3.1 Flash-Lite için varsayılan olarak https://api.tokenlab.sh/v1beta/models/gemini-3.1-flash-lite:generateContent kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Gemini 3.1 Flash-Lite hangi operasyonları destekler?

Gemini 3.1 Flash-Lite Metinden metne destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

Gemini 3.1 Flash-Lite karşılaştırması

Gemini 3.1 Flash-Lite içeren rehberler

Kaynaklar

2 Eki 2026 tarihinde incelendi

Gemini 3 serisinden daha fazlası

İlgili modeller