Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

xAI: Grok Voice Think Fast 2.0

Grok Voice Think Fast 2.0, canlı sohbet için bir ses modelidir. Asistanın sadece hazırlanmış bir metni okumak yerine devam eden bir alışverişe ayak uydurması gereken sözlü arayüzler için bir adaydır.
grok-voice-think-fast-2.0
MevcutxAISesSenkron
Fiyat
İtibaren $0.001333
Modlar
Ses

Grok Voice Think Fast 2.0 hakkında

Grok Voice Think Fast 2.0, xAI'nin canlı ve iki yönlü konuşmalar için tasarlanmış gerçek zamanlı ses modelidir; hazır bir metni okumak yerine konuşmacıya ayak uydurması gereken asistanlar için geliştirilmiştir. grok-voice-latest takma adının arkasındaki sürümlü modeldir. Bir ürünün sözlü yanıtları için sabit bir model sürümüne ihtiyaç duyduğunda bu tam kimliği kullanın.

Güçlü yönleri

  • xAI'nin sesli asistan takma adının arkasındaki sabit, sürümlü sürümdür; bu sayede siz değiştirene kadar davranış tek bir modele bağlı kalır.
  • Sunucu taraflı ses etkinliği algılama özelliği, konuşma sırasını yönetir; böylece istemci, kendi duraklatma mantığına ihtiyaç duymadan mikrofon sesini akıtabilir.
  • Yanıt bazlı talimatlar, bir oturumun tek bir yanıt için sistem istemini değiştirmesine olanak tanır; örneğin, bir iade açıklaması için tonu değiştirmek gibi.
  • Telaffuz değiştirmeleri, transkripti değiştirmeden isimlerin ve ürün terimlerinin nasıl konuşulacağını düzeltir.

Alternatif aramanız gereken durumlar

  • Bu, konuşmaya dayalı bir konuşmadan konuşmaya (speech-to-speech) modelidir; bu nedenle dosyaların toplu transkripsiyonu ve uzun metinlerin seslendirilmesi için özel konuşma modelleri daha uygundur.
  • Canlı ses için bir bağlantıyı açık tutmak bir WebSocket istemcisi gerektirir; basit bir istek ve yanıt çağrısı bunu çalıştırmayacaktır.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    SesChat Completions API
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-voice-think-fast-2.0",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Fiyatlandırma

Official fiyat, model yapımcısının açık temel fiyatıdır. TokenLab fiyatı, bu modeli TokenLab'de ödediğiniz tutardır.

Audio Duration

saniye başına
Resmi fiyat
$0.001333
Official
$0.001333
İndirim
—

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Kullanım senaryoları

  • Etkileşimli sesli yanıt sistemi değişimi

    Menü tabanlı telefon ağaçlarını, sorunu basitçe dile getiren bir arayanla değiştirin; bu sırada asistan aramayı aktarır veya çözer.

  • Dil pratiği ortağı

    Hedef dilde sözlü diyalog kurun, hataları sesli olarak düzeltin ve öğrenci istediğinde hızı ayarlayın.

  • Eller serbest saha asistanı

    Bir teknisyenin sesli olarak bir kılavuz hakkında soru sormasına ve her iki eli de ekipman üzerindeyken cevapları duymasına olanak tanıyın.

Prompt örnekleri

Bir internet sağlayıcısı için sakin bir destek asistanısınız. Hesap posta kodunu sorun, ardından arayan kişiye yönlendiriciyi (router) yeniden başlatma konusunda rehberlik edin.

'Zyntra' markamızı ZIN-tra olarak telaffuz edin, dostça bir ton koruyun ve arayanın sözünü asla yarıda kesmeyin.

Portekizce öğretmeni olarak hareket edin. Yavaş konuşun, düzelttiğim cümleyi tekrar edin ve her turda bir takip sorusu sorun.

FAQ

grok-voice-think-fast-2.0 ile grok-voice-latest arasındaki fark nedir?

grok-voice-think-fast-2.0 belirli bir model sürümüdür, grok-voice-latest ise şu anda ona işaret eden bir takma addır. Takma ad daha yeni sürümlere geçecektir; tarihli isim ise test ettiğiniz sürümde kalır.

Grok Voice Think Fast 2.0 bir metinden sese (text-to-speech) modeli midir?

Hayır. Canlı bir oturumda dinler ve yanıt verir; ses girişi alır ve sözlü yanıtlar üretir. Hazır metni sese dönüştürmek için Grok Voice TTS'i, kayıtları yazıya dökmek için Grok Voice STT'yi kullanın.

Konuşmayı bitirdiğime nasıl karar veriyor?

Oturumlar, kullanıcı sırasının sonunu algılayan ve yanıtı başlatan sunucu taraflı ses etkinliği algılamayı etkinleştirebilir. İstemcinizde zaten bas-konuş özelliği varsa, sıraları kendiniz de yönetebilirsiniz.

Hangi sesleri kullanabilir?

Bir oturum, varsayılan olarak eve olmak üzere xAI'nin yerleşik sesleri arasından seçim yapabilir veya kısa bir referans kaydından klonlanmış özel bir ses kullanabilir. Yerleşik sesler desteklenen tüm dilleri konuşabilir.

Grok Voice Think Fast 2.0 ne kadara mal olur?

TokenLab üzerinde Grok Voice Think Fast 2.0 $0.001333 saniye başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

Grok Voice Think Fast 2.0 hangi endpoint'i kullanmalı?

Grok Voice Think Fast 2.0 için varsayılan olarak https://api.tokenlab.sh/v1/chat/completions kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Grok Voice Think Fast 2.0 karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

Grok Voice serisinden daha fazlası

İlgili modeller