Tek kişi yapay zekâ ile kısa film çekebilir mi? Storyboard, karakter tutarlılığı ve çekim geçişleri

Tek kişi yapay zekâ ile kısa film çekebilir mi? Storyboard, karakter tutarlılığı ve çekim geçişleri

EğitimlerYayınlandı

Çekebilir. Ama her parçası değil.

Tek kişilik yapay zekâ yapımını bilinçli olarak minicik bir hikâyede denedim: bir adam eski bir paltonun cebinde katlanmış bir not bulur. Sekiz çekim, tek kişi, tek bir cümleden baştan sona izlenebilir bir şeye. Aşağıda ne işe yaradı, nerede takıldım ve gerçekten neye mal oldu.

Tek kişi neyi bitirebilir, neyi bitiremez

Yanlış beklentiyle okumaya devam etmeyin diye önce sonuçlar.

Tek kişinin artık kendi başına yapabildikleri: storyboard, karakterin görünümü ve karakter tutarlılığı, her çekimin karesi, çekimler arası geçişler, ses ve dudak senkronu. Eskiden görüntü yönetmeni, ışıkçı, sanat departmanı ve oyuncu gerektiren iş bugün gerçekten tek bir masaya sığıyor.

Hâlâ olmayanlar: yaklaşık beş saniyeyi geçen sürekli karmaşık hareket, bir replikanın zamanlamasına birebir oturan oyunculuk, karede okunabilir metin bulunan her çekim (aşağıda anlatıyorum) ve gerçek bir mekân ya da tepki veren gerçek bir insan gerektiren her şey.

Yani yapay zekâ yapımının bugünkü tatlı noktası, birkaç kısa çekimden kurgulanmış 30 saniye ile 2 dakika arası. Üç dakikalık kesintisiz plan denemeyin — bu prompt yazma sorunu değil, yöntemin şu andaki tavanı.

Bir paragraf nasıl storyboard'a dönüşür?

Storyboard, ilk yapılacak adım ve tüm yapay zekâ yapım sürecinin en ucuzu. Hızlı, neredeyse maliyetsiz ve bitmiş karelere gerçek para harcamadan önce hikâye problemlerini açığa çıkarıyor.

Yöntem kaba: hikâyeyi çekim başına bir cümleye böl ve her cümleye üç şey yaz — ölçek, hareket, ışık. Sonra yapay zekâ görüntü üretimi üzerinden kurşun kalem hissi veren bir tur küçük eskiz çıkar.

Yapay zekâ ile çekilen bir kısa film için sekiz kareli storyboard, kurşun kalem eskizleri olarak çizilmiş

Benim bölümlemem şöyle: odayı kuran genel plan → orta, palto askıdan alınıyor → yakın, bir el cebe giriyor → yakın, avuçta açılmış not → orta, baş pencereye doğru kalkıyor → genel, palto sırtta, kapıya yürüyor → merdiven kapısı sabah ışığına açılıyor → uzak plan, sırtı sokağı çıkıyor.

Bu aşamada sezgiye aykırı bir tavsiye: iyi çizmeye çalışmayın. Yalnızca üç şeyi kontrol ediyorsunuz — hikâye tutuyor mu, ölçekler değişiyor mu, gereksiz çekim var mı. Eskiz kabalaştıkça kesmek kolaylaşıyor. İlk turumda 11 kare vardı; ritim ancak sekize indiğinde oturdu.

Her çekimde aynı yüz nasıl korunur?

Karakter tutarlılığı, yapay zekâ yapımının en sık kırıldığı yer ve bende en çok zaman alan adım.

Cevap bir karakter sayfası: bir kere kur, sonra yüzü kelimelerle tarif etmek yerine her çekimde ona referans ver. Tutarlılık tek bir referans görüntüyü yeniden kullanmaktan doğar, daha ayrıntılı tarif yazmaktan değil.

Yapay zekâ kısa filmi için karakter sayfası: aynı adam önden, üç çeyrek, profil ve arkadan

Önce temiz bir cepheden kare ürettim — gri fon, eşit ışık, styling yok, ifade yok, esasen bir seçme fotoğrafı. Sonra üç çeyreği, profili ve arkayı ondan kurdum. Bu dört görüntü bu filmin "oyuncusu" ve sonraki her çekim bu sayfayı alıyor.

Üç pratik not:

Yüzü metinle tarif etmeyin. "Otuzlarının ortası, kısa siyah saç, hafif sakal" yüz farklı insan üretir. Yüzü referans görüntüye bırakın; prompt yalnızca o çekimde değişeni taşısın.

Arka ve profili baştan üretin. Uzaklaşma çekimine gelene kadar beklerseniz, büyük olasılıkla cepheden gördüğünüz adam olmayacak.

Kıyafeti her prompt'a yazın. Karakter tutarlılığı yalnızca yüz değil — paltonun rengi ya da kesimi kaysın, seyirci geçişi yine görür. Bu üçünü tutturursanız bir yapay zekâ kısa filminde karakter tutarlılığı büyük ölçüde çözülmüş olur.

Çekimler nasıl zıplamadan bağlanır?

En az emek isteyen yöntem, bir çekimin son karesini sonrakinin ilk karesi yapmak.

Geçiş gösterimi: bir çekimin son karesi sonrakinin ilki oluyor; kadraj, ışık ve renk aynı şekilde sürüyor

Bu iki kare aynı anın ilk ve ikinci yarısı: solda nota bakıyor, sağda başı pencereye doğru kalkmış. Kadraj kımıldamadı, ışığın yönü kımıldamadı, renk kımıldamadı — yalnızca başın açısı ve bakış yönü değişti. Birlikte kurgulandığında tek bir sürekli tepki olarak okunuyor.

İkisini de ilk ve son kareden video içine başlangıç ve bitiş noktası olarak ver, aradaki boşluğu model doldursun. Bir modelden bütün bir hareketi "oynamasını" istemekten çok daha kararlı ve iki ucu siz sabitlediğiniz için karakter tutarlılığını da koruyor.

Geçişte iki ayrıntı gözden kaçıyor ve bunlar yapay zekâ yapımında gerçek çekimden daha pahalıya geliyor, çünkü sette düzeltilemiyor. Işığın yönü eşleşmeli. Bir çekimde ışık soldan geldiyse sonrakinde sağdan gelemez — seyirci neyin yanlış olduğunu adlandıramaz ama yanlış hisseder. Renk eşleşmeli. Sekiz çekimimin hepsi prompt'un içinde "soğuk şafak" taşıyor; sonradan kurtarmayı planlamadım.

Bütün çekimler bir kerede nasıl gözden geçirilir, sadece kötüler nasıl yenilenir?

Görüntüleri tek tek açmak sizi yanıltır. Her biri tek başına iyi görünür; ancak sırayla dizildiğinde üçüncü çekimde yüzün kaydığını fark ederiz.

Sekizinin tamamını üretken tuval üzerine sırayla tek bir satır hâlinde yayıp geri çekiliyorum. Karakter tutarlılığı problemleri bir satırda en kolay yakalanır — kaymış bir yüz ya da yanlış ışık tek bakışta ortaya çıkar. Yalnızca bu alışkanlık, yapay zekâ yapım sürecimdeki yeniden çalışmanın çoğunu ortadan kaldırdı: diziyi baştan kurmak yerine yalnızca bozuk hücreyi yeniden çalıştırıyorum.

Bir yapay zekâ kısa filminden bitmiş sekiz çekim, tek bir soğuk şafak rengiyle

Bunlar son sekizim. Üçüncü çekimin eli iki kez yenilendi; yedinci çekimin arka ışığı bir pozlama ayarı aldı.

Ses ne olacak?

Görüntü bu noktada bitiyor ama sessiz bir yapay zekâ kısa filmi kimseyi 30 saniyeden öteye tutamaz.

Benimkinde diyalog yok, yalnızca atmosfer gerekti. Diyalog varsa sıra şu: sesi metinden konuşmaya ile üret ya da ses klonlama ile sabit bir tını klonla, sonra ağzı oturtmak için dudak senkronu çalıştır.

Bu sırayı tersine çevirmeyin. Görüntüyü önce yaparsanız ağız hareketleriyle replika uzunluklarının uyuşmadığını görürsünüz; ses süresini önce sabitleyip kareleri ona göre üretirseniz çok daha az yeniden çalışırsınız. Sesi sona bırakmak, yapay zekâ yapımında en sık görülen sıralama hatası.

Bir kareyi hareket ettirmenin sınırı nerede?

Bir çekimden üretilen beş saniye: notu tutuyor, gözünü kırpıyor, bakışı pencere boyunca kayıyor

Bu beş saniye yukarıdaki çekimden geldi: soluk, bir kırpma, bakışın biraz kayması, kaşta hafif bir gerilme.

Üç kez "dönüp kapıya yürümesini" istedim ve her seferinde deforme oldu — iki adım sonra artık o değil. Yani sınır net: yerinde küçük tepkiler güvenilir; bir karakterden yer değiştirmesini ya da karmaşık hareket yapmasını istemek henüz değil. Hareket gereken çekimlerde modele oynatmak yerine önce son kareyi üretip aradan geçiyorum.

Üç başarısızlık, dürüstçe

Karedeki metin uydurma. Nota ait yakın çekimime yakınlaşın, kâğıttaki "el yazısı" tamamen anlamsız — üretim modelleri okunabilir metin üretemiyor ve bu, yapay zekâ yapımında koca bir çekim kategorisini sessizce devre dışı bırakıyor. Ya net çekmezsin (odak dışı, yarısı kapalı) ya da sonradan gerçek metin yerleştirirsin.

Eller hâlâ tek tek kontrol istiyor. Elin cebe girdiği çekimde ilk sürümde bir eklem yanlış yerdeydi; iki tekrar gerekti. Karede el olan her çekim yakınlaştırılıyor.

Sürekli hareket yüzü kaybediyor. Yukarıda dediğim gibi — iki üç saniyeyi geçen yer değiştirme neredeyse her zaman bozuluyor ve ilk düşen şey karakter tutarlılığı oluyor.

Kopyalanabilir sekiz çekim listesi

Bu sırayla çalışın, geri dönmeyeceksiniz:

  1. Hikâyeyi çekim başına bir cümleye böl, her cümle ölçek, hareket ve ışık taşısın
  2. Kaba bir storyboard üret ve yalnızca gerekli çekimlere kadar kes
  3. Tutarlılığı sabitlemek için karakter sayfasını kur: cephe, üç çeyrek, profil, arka
  4. Board'a göre çekim çekim üret, her defasında sayfayı ver, rengi her prompt'a yaz
  5. Çekimlerin bağlandığı yerde önce son kareyi, sonra ilk kareyi üret
  6. Hepsini tuvale yay ve satırda karşılaştır; yalnızca bozuk olanı yeniden çalıştır
  7. Ses süresini sabitle, sonra kareleri sese göre eşle
  8. Ellere, kulaklara ve karedeki her metne yakınlaş

Sekiz çekimin tamamı yaklaşık üç saat aldı; büyük kısmı üretimi beklemek değil, prompt yazmak ve çekim seçmekle geçti. Karakter tutarlılığı ve çekim geçişleri, birkaç kez yaptıktan sonra neredeyse iki kat hızlanıyor.

Bu seviye jenerikler, konsept işler ve sunum malzemesi için şimdiden yeterli. Müşteriye teslim edilecek bitmiş bir iş için hâlâ gerçekten çekip eksik çekimleri yapay zekâ ile tamamlarım. Yapay zekâ yapım sürecini kendiniz denemek isterseniz başlangıç noktası yapay zekâ video üretimi — başlamak için tek bir cümle yeterli.

Paylaş