Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

ByteDance: OmniHuman-1.5

OmniHuman-1.5 için fiyat, performans, yetenekler ve hazır istek örnekleri.
Modelleri karşılaştır
omnihuman-1-5
MevcutByteDanceVideo oluşturAsenkron
Fiyat
İtibaren $0.1325
Modlar
Video oluştur

OmniHuman-1.5 hakkında

OmniHuman-1.5, ByteDance'in Akıllı Üretim Laboratuvarı'ndan bir dijital insan video modelidir. Bir kişinin tek bir görselinden, bir ses klibinden ve isteğe bağlı bir metin isteminden; konuşmaya uygun dudak senkronizasyonu, jestler ve vücut hareketleri içeren konuşan veya performans sergileyen bir avatar videosu oluşturur. Birden fazla konuşmacının olduğu sahneler de dahil olmak üzere, tepki veriyormuş gibi görünen karakterler için tasarlanmıştır.

Güçlü yönleri

  • Tek bir sabit görseli canlandırır, bu nedenle kişinin filme alınmış görüntüsüne ihtiyaç duyulmaz.
  • Dudak senkronizasyonu sağlanan sesi takip eder ve jestler konuşmanın anlamına uyacak şekilde seçilir.
  • İsteğe bağlı bir metin istemi, sesin yanı sıra eylemi veya kamera davranışını yönlendirebilir.
  • Karakterlerin birbirine tepki verdiği, iki kişilik sesle yönlendirilen sahneleri destekler.

Alternatif aramanız gereken durumlar

  • Bir ses parçasına ihtiyaç duyar; konuşmacısı olmayan sahneler için genel bir metinden videoya dönüştürme modeli değildir.
  • Çıktı kalitesi referans görsele bağlıdır; kırpılmış veya düşük çözünürlüklü bir yüz, kimlik sadakatini sınırlar.
  • Üretilen insanlar ve sesler rıza sorularını gündeme getirir, bu nedenle yalnızca haklarına sahip olduğunuz görselleri ve sesleri kullanın.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Görselden videoyaTokenLab uç noktası
    POST/v1/videos/generations
    curl -X POST "https://api.tokenlab.sh/v1/videos/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "image-to-video",
      "model": "omnihuman-1-5",
      "prompt": "Cinematic sunrise over a calm lake with gentle camera motion.",
      "image_url": "https://example.com/image.jpg"
    }'

Fiyatlandırma

Official fiyat, model yapımcısının açık temel fiyatıdır. TokenLab fiyatı, bu modeli TokenLab'de ödediğiniz tutardır.

Görselden videoya

saniye başına
Resmi fiyat
$0.1325
Official
$0.1325
İndirim
—

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

OmniHuman-1.5 modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

omnihuman-1-5 ile /v1/videos/generations üzerinden image-to-video işlemini gerçekleştir. Sonucu, durumu ve maliyeti göster.

Kullanım senaryoları

  • Konuşan sunucular

    Eğitim, ürün güncellemeleri veya açıklayıcı videolar için bir portreyi ve anlatım parçasını bir sözcü videosuna dönüştürün.

  • Karakter diyaloğu

    Kısa hikayeler ve sosyal medya klipleri için resimli veya fotoğrafik karakterleri senaryolu bir repliği konuşurken canlandırın.

  • Yerelleştirilmiş video

    Bir sunucu görselini, birkaç dilde kaydedilmiş sesle yeniden kullanarak her biri için eşleşen dudak senkronizasyonlu bir klip oluşturun.

Prompt örnekleri

Masadaki bir kadın kameraya konuşuyor, sakin jestler yapıyor, önemli noktalarda hafifçe başını sallıyor

Park bankındaki iki arkadaş birbirleriyle konuşuyor, konuşan kişiye doğru dönüyor

Şarkıcı küçük bir sahnede performans sergiliyor, etkileyici el hareketleri yapıyor, kamera sabit kalıyor

FAQ

OmniHuman-1.5 hangi girdileri alır?

Karakterin tek bir görseli, bir ses klibi ve isteğe bağlı olarak bir metin istemi. Görsel kimliği ve görünümü belirler, ses dudak senkronizasyonunu ve zamanlamayı yönlendirir, istem ise eyleme rehberlik edebilir.

Birden fazla kişinin olduğu videolar oluşturabilir mi?

Evet. ByteDance, iki konuşmacılı ses desteğini tanımlar; böylece karakterler arasındaki etkileşim tek bir klipte oluşturulabilir ve her kişinin hareketi kendi konuşmasını takip eder.

OmniHuman-1.5, avatarın nasıl hareket edeceğine nasıl karar verir?

ByteDance'in makalesi, eylemi sesten, görselden ve istemden planlayan çok modlu bir dil modelini ve hareketi işleyen bir difüzyon transformatörünü tanımlar. Bu, jestlerin genel bir döngüden ziyade içeriğe uymasını sağlamak içindir.

Genel bir video oluşturucu mudur?

Hayır. Sese göre konuşan veya performans sergileyen insanlar için özelleşmiştir. Sürücü bir ses parçası olmayan sahneler, manzaralar veya aksiyon görüntüleri için genel bir metinden videoya veya görselden videoya dönüştürme modeli kullanın.

OmniHuman-1.5 ne kadara mal olur?

TokenLab üzerinde OmniHuman-1.5 $0.1325 saniye başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

OmniHuman-1.5 hangi endpoint'i kullanmalı?

OmniHuman-1.5 için varsayılan olarak https://api.tokenlab.sh/v1/videos/generations kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

OmniHuman-1.5 hangi operasyonları destekler?

OmniHuman-1.5 Görselden videoya destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

OmniHuman-1.5 karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

İlgili modeller