Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

Alibaba: Qwen3.5-Flash

Qwen3.5 Flash, 3.5 serisindeki uzun bağlamlı metin çalışmaları için verimlilik odaklı seçenektir. Aynı büyük kaynağın bir görev boyunca sürekli olarak danışılması gereken özetleme ve tekrarlanan belge işleme adımlarını destekleyebilir.
Modelleri karşılaştır
qwen3.5-flash
MevcutAlibabaSohbet
Girdi / Çıktı
$0.10 / $0.40
Bağlam
992K
Maksimum çıktı
64K
Modlar
Sohbet
Yetenekler
İstem Önbelleği

Qwen3.5-Flash hakkında

Qwen3.5-Flash, Alibaba'nın Qwen3.5 ailesinin daha hafif barındırılan katmanıdır ve Qwen3.5-Plus'tan daha hızlı ve daha ucuz metin işleme için oluşturulmuştur. Çok geniş bir bağlama ve istem önbelleğe alma (prompt caching) özelliğine sahiptir; bu da özetleme ve aynı büyük kaynak üzerinde tekrarlanan işlemler için uygundur. Ailenin geniş dil kapsamını paylaşır.

Güçlü yönleri

  • İstem önbelleğe alma, tek bir büyük kaynağa tekrarlanan başvurularda yardımcı olur.
  • Plus katmanına göre hız için ayarlanmıştır.
  • Qwen3.5 ailesinin 201 dildeki kapsamını paylaşır.
  • Özetleme veya etiketleme gibi işlem hattı adımları için iyi bir uyum sağlar.

Alternatif aramanız gereken durumlar

  • Qwen3.5-Plus, daha zorlu analizlerde daha iyidir.
  • Yalnızca metin kabul eder, bu nedenle bir görme (vision) modelinin yerini alamaz.
  • Agentic kodlama sonuçları bildiren Qwen3.8-Flash'tan daha eskidir.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Metinden metneResponses API
    POST/v1/responses
    API formatı:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "qwen3.5-flash",
        "input": "Hello!"
      }'

Fiyatlandırma

Çoğu modelde daha hesaplı olan Verified için TokenLab fiyatı geçerlidir. Daha güvenilir olan Official rotası ise üreticinin standart fiyatıyla ücretlendirilir. Auto seçeneği, isteği başarıyla tamamlayan rotayı baz alır.

Girdi token <= 125K

1M token başına
Resmi fiyat
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
Official
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
İndirim
—

Girdi token <= 250K

1M token başına
Resmi fiyat
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
Official
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
İndirim
—

Girdi token <= 1M

1M token başına
Resmi fiyat
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
Official
Girdi $0.10 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.125 / Metin Girdi $0.10 / Metin Çıktı $0.40
İndirim
—
Prompt cache fiyatlandırması

Önbellek okuma

Resmi fiyat
$0.01
Official
$0.01
İndirim
—

Önbellek yazma

Resmi fiyat
$0.125
Official
$0.125
İndirim
—

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

Qwen3.5-Flash modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

qwen3.5-flash ile /v1/responses üzerinden kısa bir mesaj dene. Yanıtı, gecikmeyi ve maliyeti göster.

Kullanım senaryoları

  • Toplu özetleme

    Gece çalışan bir işlem hattında uzun raporları, sorduğunuz bölümler boyunca önbelleğe alınmış aynı büyük kaynakla yoğunlaştırın.

  • Belge etiketleme ve yönlendirme

    Uzun metinleri konu, aciliyet veya sahip etiketleriyle etiketleyin ve sonucu sonraki kodların ayrıştırabileceği sabit bir formatta döndürün.

  • Tek bir kaynak üzerinde tekrarlanan Soru-Cevap

    Bir kılavuzu veya politikayı bir kez önbelleğe alın ve her seferinde tüm metni yeniden işlemek için ödeme yapmadan ona birçok soru sorun.

  • Taslak temizleme

    Yazarın iddialarına ve rakamlarına dokunmadan uzun taslaklardaki dil bilgisini, tonu ve yapıyı düzeltin.

Prompt örnekleri

Bu el kitabının her bölümünü iki satırda özetleyin.

Bu bileti ürün alanı ve aciliyet ile etiketleyin ve JSON döndürün.

Yapıştırılan politika hakkındaki soruları yanıtlayın; yoksa 'belirtilmemiş' yanıtını verin.

Bu model koşullu fiyatlandırmaya sahiptir. Yalnızca aylık token toplamları güvenilir bir tahmin üretmez; istek özellikleri, önbellek ve geçerli zaman penceresi için ayrıntılı fiyatlandırmayı kullanın.

FAQ

Qwen3.5-Flash tam olarak nedir?

Alibaba'nın Qwen3.5 ailesinin, uzun metinlerin hızlı işlenmesini amaçlayan daha hafif barındırılan katmanıdır. Güç açısından Qwen3.5-Plus'ın altında yer alır ve tekrarlanan, rutin belge adımları için tasarlanmıştır.

Flash'ı Qwen3.5-Plus yerine ne zaman seçmeliyim?

Hız ve maliyetin derinlikten daha önemli olduğu durumlarda, örneğin toplu özetleme, etiketleme veya sabit bir kaynak üzerinde Soru-Cevap yaparken Flash'ı seçin. Yanıtların birçok pasaj boyunca daha dikkatli analiz gerektirdiği durumlarda Plus'a geçin.

Qwen3.5-Flash istem önbelleğe almayı destekliyor mu?

Evet. İstem önbelleğe alma, çağrılar arasında yalnızca sorunun değiştiği tekrarlanan belge işleme adımlarında olduğu gibi, aynı uzun kaynak tekrar tekrar gönderildiğinde yardımcı olur.

Qwen3.5-Flash görüntüleri okuyabilir mi?

Hayır. Qwen3.5-Flash yalnızca metin kabul eder. Ekran görüntüleri, taramalar veya grafikler görevin bir parçası olduğunda Qwen3.8-Flash, Qwen3.7-Plus veya Qwen3-VL Plus'ı kullanın ve çıkarılan metni bu modele gönderin.

Alibaba'nın daha yeni bir Flash modeli var mı?

Evet. Qwen3.8-Flash, agentic kodlama ve uzun vadeli ajan çalışmaları için hedeflenen daha yeni, çok modlu bir uzmanlar karışımı (mixture-of-experts) modelidir. Qwen3.5-Flash'ı zaten iyi performans gösteren düz metin işlem hatları için tutun.

Qwen3.5-Flash ne kadara mal olur?

TokenLab üzerinde Qwen3.5-Flash Girdi $0.10 / Çıktı $0.40 1M token başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

Qwen3.5-Flash bağlam penceresi ve çıktı sınırı nedir?

Qwen3.5-Flash 991.808 jetona kadar bağlam kabul eder ve tek yanıtta 65.536 jetona kadar çıktı verir.

Qwen3.5-Flash hangi endpoint'i kullanmalı?

Qwen3.5-Flash için varsayılan olarak https://api.tokenlab.sh/v1/responses kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Qwen3.5-Flash hangi operasyonları destekler?

Qwen3.5-Flash Metinden metne destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

Qwen3.5-Flash karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

Qwen 3 / QwQ serisinden daha fazlası

İlgili modeller