Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

xAI: Grok Voice TTS

Grok Voice TTS, seçilen bir ses ve dilde yazılı metinden konuşma oluşturur. Yerelleştirilmiş anlatım, sesli bildirimler ve hazırlanmış metni sesli yanıt olarak sunması gereken uygulamalar için uygundur.
Modelleri karşılaştır
grok-voice-tts
MevcutxAIMetinden seseSenkron
Girdi / Çıktı
$15.00 / $0.00
Modlar
Ses

Grok Voice TTS hakkında

Grok Voice TTS, xAI'nin metinden sese modelidir; yazılı metni seçilen bir ses ve dilde sözlü sese dönüştürür. Duraklamalar, gülüşler ve fısıltılar gibi satır içi etiketler seslendirmeyi şekillendirir. Bunu, metnin zaten yazılı olduğu ve canlı bir konuşmanın gerekmediği anlatımlar, sesli bildirimler ve yerelleştirilmiş sesli yanıtlar için kullanın.

Güçlü yönleri

  • [pause] ve [laugh] gibi satır içi konuşma etiketleri ve whisper gibi kapsayıcı etiketler, metnin içinde seslendirme kontrolü sağlar.
  • Yerleşik seslerin tümü desteklenen dilleri konuşur, böylece tek bir ses kimliği aynı içeriğin yerelleştirilmiş sürümlerinde kullanılabilir.
  • Özel sesler, marka veya karakter sesleri için kısa bir referans klibinden klonlanabilir.
  • Altyazıları veya dudak hareketlerini sesle senkronize etmek için karakter düzeyinde zaman damgaları döndürülebilir.

Alternatif aramanız gereken durumlar

  • Sabit metin konuşur; sözü kesen veya yanıt veren bir arayan için bunun yerine konuşmaya dayalı bir ses modeli gerekir.
  • Uzun metinler için çıktı kalitesi, kaynak metindeki noktalama işaretlerine ve etiketlere bağlıdır; bu nedenle düzenlenmemiş makine metni düz (duygusuz) gelebilir.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Metinden seseTokenLab uç noktası
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "language_code": "en",
      "operation": "tts",
      "response_format": "mp3",
      "voice": "eve",
      "model": "grok-voice-tts",
      "input": "Hello from TokenLab."
    }'

Fiyatlandırma

Official fiyat, model yapımcısının açık temel fiyatıdır. TokenLab fiyatı, bu modeli TokenLab'de ödediğiniz tutardır.

Fiyatlandırma

1 milyon karakter başına
Official
Girdi$15.00/1 milyon karakterÇıktı$0.00/1 milyon karakter
Resmi fiyat
Girdi$15.00/1 milyon karakterÇıktı$0.00/1 milyon karakter

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

Grok Voice TTS modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

grok-voice-tts ile /v1/audio/speech üzerinden kısa bir ses isteği dene. Sonucu ve maliyeti göster.

Kullanım senaryoları

  • Seslendirilmiş makaleler ve dersler

    Bölümleri ayırmak için duraklamalar kullanarak bitmiş bir makaleyi veya kurs metnini bir ses parçasına dönüştürün.

  • Sesli uyarılar

    Sipariş güncellemelerini veya güvenlik bildirimlerini bir telefon kodeği aracılığıyla kullanıcının dilinde okuyun.

  • Yerelleştirilmiş ürün videoları

    Aynı metni seçilen bir sesle birkaç dilde seslendirin, ardından altyazıları hizalamak için zaman damgalarını kullanın.

Prompt örnekleri

Bu paragrafı sıcak, sabit bir sesle okuyun ve her cümleden sonra kısa bir [pause] ekleyin.

Aşağıdaki bildirimi Fransızca konuşun, ardından aynı sesi kullanarak Almanca tekrar edin.

<whisper>Paketiniz kargoya verildi.</whisper> [pause] Perşembe günü ulaşması bekleniyor.

FAQ

Grok Voice TTS ne yapar?

Metni sesli konuşmaya dönüştürür. Bir ses, isteğe bağlı olarak bir dil kodu ve bir çıktı formatı seçersiniz; o da satır içine yazdığınız tüm ifade edici etiketler dahil olmak üzere metin için ses döndürür.

Hangi ses formatlarını üretebilir?

MP3, WAV ve ham PCM'nin yanı sıra 8 kHz'den 48 kHz'e kadar örnekleme hızlarında mu-law ve A-law telefon kodekleri. Telefon kodekleri telefon sistemlerine uygundur; MP3 ise web ve mobil oynatma için uygundur.

Kaç dil konuşabilir?

xAI, BCP-47 koduyla seçilen yirmi dili belgeler; alternatif olarak otomatik dil algılama özelliği de mevcuttur. Her yerleşik ses desteklenen tüm dilleri konuşabilir, bu nedenle dil değiştirmek yeni bir ses gerektirmez.

Metin henüz gelmeye devam ederken ses akışı sağlayabilir miyim?

Evet. Bir WebSocket uç noktası, metin gönderildikçe gerçek zamanlı olarak ses üretir; bu, başka bir model konuşulacak yanıtı yazmaya devam ederken yardımcı olur.

Yanlış telaffuz edilen kelimeleri düzeltebilir miyim?

Evet. Telaffuz değiştirmeleri, yazılı bir terimi nasıl duyulması gerektiğiyle eşleştirmenize olanak tanır; böylece marka isimleri ve kısaltmalar, görüntülenen metni düzenlemeden doğru şekilde çıkar.

Grok Voice TTS ne kadara mal olur?

TokenLab üzerinde Grok Voice TTS Girdi $15.00 / Çıktı $0.00 1 milyon karakter başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz.

Grok Voice TTS hangi endpoint'i kullanmalı?

Grok Voice TTS için varsayılan olarak https://api.tokenlab.sh/v1/audio/speech kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Grok Voice TTS hangi operasyonları destekler?

Grok Voice TTS Metinden sese destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

Grok Voice TTS karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

Grok Voice serisinden daha fazlası

İlgili modeller