Seedance 2.5 için prompt nasıl yazılır? Seedance 2.0 alışkanlıkları neden işe yaramaz

Seedance 2.5 tam saniyeli zaman damgalarını, türü belli ses kanallarını ve plan başına tek kamera hareketini okur. Kötü sonuçların çoğu, modele Seedance 2.0 gibi prompt yazmaktan çıkar. LUVI'nin içinde çalıştırdığımız rehberden alınan, işe yarayan yapı burada.

Yayın:

Yan yana beş küçük film karesi, her birinde tek bir sıcak ışık izi; altlarında tam saniyelere denk gelen kehribar rengi çentikli bir zaman çizgisi.

Seedance 2.5, ByteDance'in görüntüyle sesi tek render'da üreten video modelidir. LUVI'de metinden video, görselden video ve referanstan video olarak, 480p, 720p ve 1080p çözünürlükte çalışır; beş saniyelik bir klip 3.030 krediden başlar. Tek bir model ailesinin içinde gördüğümüz en sert kural tersyüzü de burada: Seedance 2.0'da yasa olan birkaç şey 2.5'te yanlıştır. Aşağıdaki yapı, LUVI'deki prompt rehberimizin uyguladığı yapıdır; nedenleriyle birlikte.

Dört parçalı yapı

Seedance 2.5 prompt'u tek cümlelik bir açıklama değildir; dört parçadan oluşur ve sıralaması şöyledir:

  1. Girdi tanımı (yalnızca medya modlarında). Yüklediğiniz her görseli, videoyu ve sesi yükleme sırasıyla numaralandırın; her birinin neye katkı verdiğini söyleyin: @Image 1 defines the artist's face, hair and dark green apron — only her face, hair and clothing, never its background.
  2. Tek cümlelik özet. Özne, mekân, olay, tür ya da stil ve varsa özel bir kamera hareketi.
  3. Tam saniyelere bölünmüş sahne gövdesi.
  4. Ses, türü belli kanalların içine içerik olarak yazılır.

Tek bir sahneyi 60 ila 100 kelime taşır; zamanlanmış çok planlı bir prompt 150 ila 250 kelimeye çıkar. Sert sınır 1.000 İngilizce kelimedir, ama 300'ün ötesinde iyi bir şey olmaz.

Seedance 2.5'te zaman damgaları işe yarar mı?

Yarar; ByteDance'in kendi belgeleri bunu açıkça söylüyor: 2.0 zaman damgalarına tepki vermez, yalnızca plan numaralarına uyar; 2.5 tam saniyeli zaman damgalarını destekler. Üç biçim tanınır: aralıklar ("0–3 seconds… 3–7 seconds…"; kesintisiz, arada boşluk bırakmadan), noktalar ("at the 5-second mark") ve göreli işaretler ("after 3 seconds").

ByteDance'in kendi örneklerinde kullandığı karma başlık, çok planlı prompt için en güvenli biçimdir:

Shot 1 (0-3s): extreme wide shot, ultra-low camera position, a lone cyclist crests a ridge at golden hour…
Shot 2 (3-7s): medium close-up, the camera pushes in slowly…

Her aralığa onu dolduracak kadar olay verin. Az verirseniz model kendi kafasına göre doldurur; çok verirseniz sahneler düşer.

Sesi nasıl yazarım?

Ses görüntüyle birlikte üretilir; bu yüzden sesi istemezsiniz, yazarsınız. Her kanalın kendi ayracı vardır: müzik tam genişlikli (…) içinde, ses efektleri ASCII <…> içinde, diyalog ASCII {…} içinde, ekran altyazısı köşeli 【…】 içinde. Bunları birbirine karıştırmak en sık görülen sessiz hatadır: model yanlış kanalı okur, ses genel geçer döner.

Diyalog bir formüle uyar: dil, aksan ya da bölgesel çeşit, söyleyiş, konuşan kişi ve en sonda replik: says in English, calm and low, the older man {We should have left an hour ago}. Çince ve İngilizce dışındaki her dil etiketlenmek zorundadır; İngilizceyi de etiketleyin, çünkü etiketsiz replikler kayar.

Plan başına kaç kamera hareketi?

Tek hareket. Belgelerdeki cümle aynen şöyle: "Do not require push, pull, pan, and move at the same time, as this will increase image instability." Yani itme, çekme, pan ve hareketi aynı anda istemeyin; görüntü kararsızlaşır. Hareketleri sahneden sahneye dizin, tek sahnenin içine yığmayın; kamerayı kendi cümlesinde tutun ki hareketi öznenin hareketi sanılmasın. Belgelenmiş sözcükleri kullanın: push in, pull out, pan, track, follow, orbit, dive, pull back, tilt up, handheld shake. Kadrajı niyet olarak yazın ("wide shot", "shallow focus"); odak uzaklığı ya da f-değeri olarak yazmayın, çünkü model bunları kabaca kümeler ve kendi belgeleri 45 mm'yi geniş açı sayar.

Negatif prompt var mı?

Yoktur. "No cape" yazarsanız pelerin çıkar. Bunun yerine varılacak durumu yazın: "the shoulder line is clean and unbroken." İşe yarayan tek olumsuzlamalar ses ve altyazı içindir ("no bgm", "no subtitles"); onlar da olasılıksaldır. Bu yüzden aynı planda hem ekran yazısı yazdırıp hem de yazıyı bastırmayı istemeyin.

Seedance 2.0'dan ne değişti?

  • Tempo. Seedance 2.0: yalnızca plan sırası; zaman damgaları yok sayılır. Seedance 2.5: tam saniyeli zaman damgalarına uyulur.
  • Yapı. 2.0: planlardan oluşan bir storyboard. 2.5: girdi tanımı → özet → zamanlanmış sahneler → ses.
  • Kamera. İkisinde de plan başına tek hareket; aynı yasa.
  • Ses. İkisinde de türü belli kanallar; aynı ayraçlar.
  • LUVI'deki çözünürlükler. 2.0: 480p'den 4K'ya (SR kademeleri). 2.5: 480p, 720p, 1080p.

Aklınızda tek bir şey kalacaksa: 2.5'te yazdığınız saniye, aldığınız saniyedir. 2.0'da ise yalnızca süstür.

LUVI'de

Çalışma Alanı'nda prompt rehberi anahtarını açın; taslağınız çalışmadan önce bu yapıya göre yeniden yazılır. Claude ve ChatGPT aynı işi bağlantının get_prompt_manual ve check_prompt araçlarıyla yapar (LUVI'yi Claude'a nasıl bağlarım). Kural setinin tamamı Seedance aile sayfasında duruyor; bir klibin fiyatının nasıl oluştuğu ise krediler nasıl çalışır yazısında anlatılıyor.

Sorular

Seedance 2.5 ses üretir mi?

Evet, aynı geçişte üretir ve varsayılan olarak açıktır. Sesi düz metinle istemek yerine türü belli kanalların içine içerik olarak yazın.

Seedance 2.0 prompt'larımı 2.5'te kullanabilir miyim?

Çoğunlukla hayır. 2.0 temposunu plan sırasına göre kurar ve zaman damgalarını yok sayar; 2.5 tam saniyeli zaman damgalarına uyar. 2.0 tarzı bir storyboard 2.5'te de çalışır, ama modelin asıl avantajından vazgeçersiniz.

5 saniyelik bir klip ne kadar tutar?

LUVI'de taban çözünürlükte 3.030 krediden başlar; 720p ve 1080p daha pahalıdır ve Çalışma Alanı, onaylamadan önce kesin tahmini gösterir.

Devamı Rehberler