LUVI'de bir yüzü konuşturmanın altı yolu ve fiyatı belirleyen tek fark
LUVI'de altı lip-sync ailesi var ve bunlar iki ayrı iş yapıyor: dördü durağan bir portreyi ses dosyasından canlandırıyor, ikisi elinizde zaten olan bir videonun ağzını yeniden senkronluyor. Hangi işi yaptığınız aynı zamanda hangi sürenin faturalandığını da belirliyor.

LUVI kataloğunda altı lip-sync ailesi var ve en sık yapılan hata, bir aileyi yapmadığı bir iş için seçmek. Dördü durağan bir portre ile bir ses dosyası alıp yüzü canlandırıyor. İkisi ise zaten var olan bir videoyu alıp ağzını yeni sese göre yeniden senkronluyor. Birini diğerinin yerine koyamazsınız ve hangi gruptaysanız, kredilerinizin hangi süreye göre sayıldığı da o grupta belirleniyor.
Hangi işi yapıyorsunuz?
Elinizde ne olduğuna bakın. Fotoğraf varsa birinci grup, konuşan birinin klibi varsa ikinci grup.
Portre artı ses, konuşan videoya dönüşüyor:
- OmniHuman 1.5: ByteDance'in modeli, 60 saniyeye kadar ses. Yazarları modeli ağız hareketinin ötesinde tarif ediyor: sesin anlamsal bağlamını yorumlayarak basit dudak senkronunu aşıyor ve karakterlerin gerçek duygu geçişleri göstermesini, jestlerini sözlerine ve niyetlerine uydurmasını sağlıyor.
- VEED Fabric 1.0 ve hızlı sürümü: bir saniyeden 300 saniyeye kadar ses, çözünürlük kademeleriyle.
- InfiniteTalk: uzun form seçeneği; 480p veya 720p'de on dakikaya kadar ses alıyor.
- Kling Avatar, standart ve pro kademeleriyle; profil klipleri, jenerikler ve sosyal medya paylaşımları için.
Var olan video artı yeni ses, dudaklar yeniden sürülüyor:
- Sync Lipsync v3: sync.so'nun modeli; dublaj ve dış ses için, 60 saniyeye kadar video.
- VEED Lipsync: düşük maliyetli dublaj yolu; o da 60 saniye video ile sınırlı.
Hangi süreyi ödüyorsunuz?
İnsanları asıl şaşırtan kısım bu. Birinci grupta sayaç sese göre işliyor, ikinci grupta videoya göre. Ruhen aynı iş, ölçülen iki farklı büyüklük.
22 Eylül 2026'da kontrol edildiğinde beş saniyede aralık epey geniş:
- VEED Lipsync: 130 krediden.
- InfiniteTalk: üretim başına 60 krediden.
- OmniHuman 1.5: 1.200 krediden.
- VEED Fabric 1.0: 1.650 krediden, hızlı sürümünde 2.200 krediden.
- Sync Lipsync v3: 2.200 krediden.
Bunun iki pratik sonucu var. Birincisi, var olan bir klibi VEED Lipsync ile dublajlamak, aynı metni bir portreden yeniden canlandırmaktan bir büyüklük mertebesi daha ucuz; yani görüntü zaten elinizdeyse onu kullanın. İkincisi, portre modellerinde ses dosyanızın uzunluğu faturanızın uzunluğudur; bir ses dosyasının başındaki iki saniyelik sessizliği kırpmak gerçek bir tasarruftur ve OmniHuman'da sayacın saydığı şey tam olarak budur.
Girdi en fazla ne kadar olabilir?
Tavanlar fiyatların düşündürdüğünden daha farklı ve bunlar tavsiye değil, yuvanın sert sınırları.
- 60 saniye: OmniHuman 1.5 (ses), Sync Lipsync v3 (video), VEED Lipsync (video).
- 300 saniye: VEED Fabric 1.0 ve Fabric 1.0 Fast (ses).
- On dakika: InfiniteTalk (ses).
Metniniz bir dakikayı aşıyorsa bu tek cümle altı seçeneği üçe indiriyor. Beş dakikayı aşıyorsa bire.
Onlara tam olarak ne veriyorsunuz?
Hepsi tam iki girdi alıyor ve yuvalar tipli: görsel yuvası video kabul etmiyor, ses yuvası ise zorunlu.
- Portre grubu net ve cepheye dönük bir yüz ister. Bir fotoğrafın 3B mesh'e dönüşmesine yarayan disiplin burada da işe yarar: eşit ışık, ağzın üzerinden geçen sert gölge yok, çene hattını kesen hiçbir şey yok.
- Video grubu, hâlihazırda bir şeyle kabaca senkron olan bir konuşan kafa ister. Konuşanın başını çevirdiği ya da kadraj dışına taştığı bir planın dudaklarını yeniden sürmek, sonucun yapıştırılmış görünmesinin en yaygın sebebidir.
- OmniHuman ince ayar için isteğe bağlı bir metin prompt'u alır; InfiniteTalk de alır, ayrıca bir seed ve çözünürlük seçeneği sunar. Videodan süren iki model ise hiç prompt almaz; talimat sesin kendisidir.
Neyi doğruladık
- Modeller:
bytedance/avatar-omni-human-v1.5,veed/fabric-1.0/image-to-videove hızlı sürümü,veed/lipsync,sync/lipsync-v3, InfiniteTalk modu ve Kling v2.6 avatar modları. - Okunanlar: her modun referans yuvaları, girdi süre sınırları ve parametreleri ile fiyatı; hem uygulamanın kendi katalog kodundan hem de canlı açık model sayfalarından alındı.
- Tarih: 22 Eylül 2026.
- Sonuçlar: yukarıdaki “başlangıç” rakamları her ailede iki kaynakta da aynı çıktı. Süre tavanları yuva tanımlarından geliyor: OmniHuman, Sync ve VEED Lipsync'te 60 saniye, VEED Fabric'te 300 saniye, InfiniteTalk'ta on dakika.
- Eksikler: Bu yazı için yeni bir üretim yapılmadı, dolayısıyla senkron kalitesi ya da benzerlik hakkında bir iddiası yok. Rakamlar taban değerler; saniye başına faturalanan ailelerde daha uzun ses ya da video daha pahalıdır, uzun bir çekimden önce Çalışma Alanı'ndaki tahmine bakın.
Hangisini seçmeli?
- Görüntünüz var ve başka bir dile geçirmeniz gerekiyor. Maliyet için önce VEED Lipsync; ağzın yakın planda da tutması gerekiyorsa Sync Lipsync v3.
- Fotoğrafınız ve kısa bir metniniz var. OmniHuman 1.5; yazarlarının tarif ettiği jest ve ifade çalışması, yalnızca ağız hareketinden fazlasını verir.
- Fotoğrafınız ve uzun bir metniniz var. InfiniteTalk, çünkü tek geçişte on dakikalık sesi alan tek model o.
- Tek bir portreden bir dizi kısa sosyal klip gerekiyor. Kling Avatar ya da VEED Fabric; kuyruğa almadan önce tam sürenize göre tahmine bakın.
LUVI'de bunlar Çalışma Alanı'nda diğer modeller gibi duruyor: seçersiniz, iki yuvayı doldurursunuz ve kredi tahmini çalıştırmadan önce görünür. Önce bir ses parçası hazırlıyorsanız aynı hesaptaki ses modelleri bunu üretebilir; zincirin tamamını bir iş akışına dizebilir ya da Claude üzerinden LUVI bağlayıcısıyla yürütebilirsiniz.
Yeni misiniz? LUVI hesabı açın ve tüm metni vermeden önce beş saniyelik bir sesle deneyin.
Kaynaklar
- OmniHuman-1.5 – OmniHuman Lab, proje sayfası (İngilizce). Erişim tarihi: 22 Eylül 2026.
- sync.so – sync.so, ürün sayfası (İngilizce). Erişim tarihi: 22 Eylül 2026.
- VEED – VEED, ürün sayfası (İngilizce). Erişim tarihi: 22 Eylül 2026.
Devamı Karşılaştırmalar
- Negatif prompt neredeyse yok oldu: bir şeyi onsuz nasıl dışlarsınızLUVI kataloğundaki 224 modelin yalnızca dördünde negatif prompt alanı var ve dördü de Qwen Image ailesinden. Alan kayboldu çünkü dayandığı örnekleme yöntemi kayboldu. Her ailede onun yerine ne yazılır ve “no X” yazmanın hâlâ işe yaradığı üç yer.
- Claude ya da ChatGPT'den üretim: Higgsfield, Krea, OpenArt ve LUVI'nin MCP bağlayıcılarını karşılaştırdıkHiggsfield, Krea, OpenArt ve LUVI Creator, Claude ya da ChatGPT'nin sizin hesabınızda üretim yapmasını sağlayan MCP bağlayıcılarını kendi sunucularında çalıştırıyor. Farkları üç noktada: fiyatı üretimden önce görüp görmemeniz, sunulan model sayısı ve asistanın her modelin prompt rehberine erişimi.
- Hangi LUVI video modelleri ses üretiyor: her birinin istediği tek cümleLUVI'deki video modellerinin çoğu artık sesi görüntüyle aynı geçişte üretiyor, ama geri kalan her şeyde ayrışıyorlar: anahtar açık mı geliyor, açmak para ekliyor mu ve sesi nasıl yazmanız gerekiyor. Her ailenin ses anahtarı ve ses sözdizimi, şemalarına bakılarak çıkarıldı.