Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

Alibaba: Qwen Flash

Qwen Flash, geniş bir bağlam penceresiyle günlük metin görevlerini yönetir. Yüksek hacimli özetleme, içerik dönüştürme ve uzun kaynak materyalleri konuşma içinde hazır bulundurması gereken asistanlar için bir adaydır.
Modelleri karşılaştır
qwen-flash
MevcutAlibabaSohbet
Girdi / Çıktı
$0.05 / $0.40
Bağlam
998K
Maksimum çıktı
32K
Modlar
Sohbet
Yetenekler
İstem ÖnbelleğiAkıl Yürütme

Qwen Flash hakkında

Qwen Flash, Alibaba'nın Qwen serisindeki hızlı, düşük maliyetli genel metin modelidir; özetleme, yeniden yazma ve basit asistanlar gibi yüksek hacimli işleri hedefler. Yetenek açısından Qwen Plus ve Qwen Max'in altında yer alır ve hacmin derinlikten daha önemli olduğu durumlarda ilk denenecek modeldir. Alibaba, bunu eski Qwen isimleri arasında listeler ve yeni projeler için daha yeni Qwen3 nesillerini önerir.

Güçlü yönleri

  • İstek başına düşük gecikme süresiyle büyük miktarda metni özetleme ve yeniden biçimlendirme.
  • Özetleme veya yanıtlama sırasında uzun bir kaynak belgeyi konuşma içinde hazır tutma.
  • İsteğe bağlı bir düşünme modu, mantık yürütme gücünü yalnızca ihtiyaç duyan isteklere harcamanızı sağlar.
  • İstem önbelleğe alma (prompt caching), uzun bir sistem istemi veya belge yeniden kullanıldığında tekrarlanan işleri azaltır.

Alternatif aramanız gereken durumlar

  • Yalnızca metin girişi, araç çağırma özelliği yok.
  • Mantık yürütme derinliği ve yazım kalitesi, zorlu analiz görevlerinde Qwen Plus ve Qwen Max'in gerisinde kalır.
  • Alibaba bunu eski bir isim olarak listeler, bu nedenle yeni bir yapı için güncel bir Qwen3 modeli daha uygun olabilir.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Metinden metneResponses API
    POST/v1/responses
    API formatı:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "qwen-flash",
        "input": "Hello!"
      }'

Fiyatlandırma

Çoğu modelde daha hesaplı olan Verified için TokenLab fiyatı geçerlidir. Daha güvenilir olan Official rotası ise üreticinin standart fiyatıyla ücretlendirilir. Auto seçeneği, isteği başarıyla tamamlayan rotayı baz alır.

Girdi token <= 125K

1M token başına
Resmi fiyat
Girdi $0.05 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.0625 / Metin Girdi $0.05 / Metin Çıktı $0.40
Official
Girdi $0.05 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.0625 / Metin Girdi $0.05 / Metin Çıktı $0.40
İndirim
—

Girdi token <= 250K

1M token başına
Resmi fiyat
Girdi $0.05 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.0625 / Metin Girdi $0.05 / Metin Çıktı $0.40
Official
Girdi $0.05 / Çıktı $0.40 / Önbellek okuma $0.01 / Önbellek yazma $0.0625 / Metin Girdi $0.05 / Metin Çıktı $0.40
İndirim
—

Girdi token <= 1M

1M token başına
Resmi fiyat
Girdi $0.25 / Çıktı $2.00 / Önbellek okuma $0.05 / Önbellek yazma $0.3125 / Metin Girdi $0.25 / Metin Çıktı $2.00
Official
Girdi $0.25 / Çıktı $2.00 / Önbellek okuma $0.05 / Önbellek yazma $0.3125 / Metin Girdi $0.25 / Metin Çıktı $2.00
İndirim
—
Prompt cache fiyatlandırması

Önbellek okuma

Resmi fiyat
$0.01
Official
$0.01
İndirim
—

Önbellek yazma

Resmi fiyat
$0.0625
Official
$0.0625
İndirim
—

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

Qwen Flash modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

qwen-flash ile /v1/responses üzerinden kısa bir mesaj dene. Yanıtı, gecikmeyi ve maliyeti göster.

Kullanım senaryoları

Uygun olduğu kullanımlar
  • Akıl Yürütme
  • Toplu özetleme

    Binlerce makaleyi, çağrı dökümünü veya incelemeyi, her öğeye aynı istemi uygulayarak kısa özetlere dönüştürün.

  • İçerik dönüştürme

    Notları şık bir e-postaya veya bir tabloyu düz yazıya dönüştürmek gibi metinleri tonlar, diller veya formatlar arasında değiştirin.

  • Hafif sohbet asistanları

    Yanıtların kısa olduğu ve yanıt süresinin nüanstan daha önemli olduğu bir SSS botunu veya uygulama içi yardımcıyı destekleyin.

  • Uzun belge Soru-Cevap

    Uzun bir kılavuzu veya politika setini isteme yapıştırın ve personel sorularını doğrudan buradan yanıtlayın.

Prompt örnekleri

Aşağıdaki ürün açıklamasını samimi bir dille, en fazla 60 kelime olacak şekilde yeniden yazın ve model numarasını değiştirmeyin.

Bu toplantı dökümünü kararlar, sorumluları ile birlikte eylem maddeleri ve çözülmemiş sorular olarak özetleyin.

Yalnızca yukarıdaki politika metnini kullanarak yanıtlayın: Bir yüklenici seyahat masraflarını talep edebilir mi? Kullandığınız maddeyi alıntılayın.

Bu model koşullu fiyatlandırmaya sahiptir. Yalnızca aylık token toplamları güvenilir bir tahmin üretmez; istek özellikleri, önbellek ve geçerli zaman penceresi için ayrıntılı fiyatlandırmayı kullanın.

FAQ

Qwen Flash en çok ne için uygundur?

Yüksek hacimli, günlük metin görevleri: özetler, yeniden yazmalar, çeviri tarzı dönüşümler ve basit asistanlar. Qwen serisinin hızlı ve ucuz katmanıdır, bu nedenle verimliliğin önemli olduğu ve görevin derin mantık yürütme gerektirmediği durumlarda kullanın.

Qwen Flash, Qwen Plus'tan nasıl farklıdır?

Flash hız odaklı, Plus ise dengeli katmandır. Plus daha güçlü analiz ve yazım sunar; Flash basit işleri daha hızlı ve ucuza halleder. Flash ile başlayın ve yanıtlar yetersiz kalırsa belirli görevleri Plus'a taşıyın.

Qwen Flash düşünme modunu destekliyor mu?

Evet. Düşünme modu, adım adım mantık yürütme gerektiren istekler için açılabilir, basit olanlar için kapalı tutulabilir. Alibaba'nın belgeleri, düşünme modunun bu model için desteklendiğini belirtir.

Qwen Flash görsel alabilir veya araç çağırabilir mi?

Hayır. Görsel girişi veya araç çağırma özelliği olmayan, metin girişi ve metin çıkışı sağlayan bir modeldir. İstek bunlardan birini gerektiriyorsa bir Qwen görsel modeli veya başka bir aile seçin.

Qwen Flash yeni bir proje için iyi bir seçim mi?

Mevcut hatlar üzerinde kalabilir ve istikrarlı yüksek hacimli işler için kullanılabilir olmaya devam eder. Yeni bir yapı için Alibaba, daha yeni Qwen3 nesillerine işaret eder, bu nedenle önce Qwen3.8 Flash ile karşılaştırın.

Qwen Flash ne kadara mal olur?

TokenLab üzerinde Qwen Flash Girdi $0.05 / Çıktı $0.40 1M token başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

Qwen Flash bağlam penceresi ve çıktı sınırı nedir?

Qwen Flash 997.952 jetona kadar bağlam kabul eder ve tek yanıtta 32.768 jetona kadar çıktı verir.

Qwen Flash hangi endpoint'i kullanmalı?

Qwen Flash için varsayılan olarak https://api.tokenlab.sh/v1/responses kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Qwen Flash hangi operasyonları destekler?

Qwen Flash Metinden metne destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

Qwen Flash karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

Qwen serisinden daha fazlası

İlgili modeller