Prompt Video AI yang Benar Tahan Melampaui Detik Ketiga

Summary

Prompt video AI yang baik mengarahkan shot bukan menggambarkan gambar. Namai satu subjek, satu aksi, satu gerakan kamera, cahayanya, dan satu hal yang harus tetap tidak berubah. Pertahankan clip ke satu beat, gunakan kosakata kamera nyata, dan tambahkan garis kunci untuk menghentikan latar belakang melayang. Untuk image-to-video, gambarkan hanya gerakannya. Mulai dengan satu model, ubah satu slot pada satu waktu, dan nilai clip dibisu sebelum menambahkan suara.

Overhead flat-lay dari lembar storyboard filmmaker indie, film strip, riso print dan clapperboard di meja kayu

Kamu mengetik "cinematic shot kota malam" dan dapatkan delapan detik sup neon yang meleleh. Selamat datang. Prompt video ai yang bagus tidak menggambarkan gambar. Mereka mengarahkan sebuah shot: siapa yang berbuat apa, kemana kamera bergerak, berapa lama, apa yang tetap diam. Di bawah adalah struktur lima bagian yang kami ambil dari setiap prompt yang berhasil, ditambah contoh siap-salin yang bisa kamu masukkan ke Veo, Kling atau Runway hari ini.

Mengapa prompt-mu meleleh setelah dua detik

Prompt gambar diam menggambarkan satu frame. Prompt video harus menggambarkan waktu. Itulah seluruh perbedaannya, dan itulah sebabnya kebiasaan Midjourney rusak saat kamu tekan tombol video.

Ketika kamu hanya menggambarkan tampilan, model harus menemukan gerakan. Model memilih opsi paling malas: zoom lambat, wajah melayang, latar belakang yang perlahan mengatur ulang dirinya sendiri. Kamu meminta mood dan mendapat screensaver.

Perbaikannya membosankan dan berhasil. Namai subjek, satu aksi, gerakan kamera, pencahayaan, dan satu hal yang harus tetap tidak berubah. Lima slot. Lewatkan satu dan model mengisinya untuk kamu, biasanya dengan buruk.

Panduan prompting Veo Google sendiri mendarat di kerangka yang sama: subjek, aksi, gaya, posisi dan gerakan kamera, komposisi, ambiens. Kami hanya merangkumnya agar bisa kamu pegang di kepala saat mengetik.

Formula lima-slot, dengan prompt yang bisa kamu curi

Ini framenya. Tulislah dalam urutan ini, dalam satu atau dua kalimat polos, dan pertahankan di bawah sekitar 60 kata untuk pass pertama.

  1. Subjek: satu frasa nominal dengan dua spesifik. "Pengantar dalam jaket hujan kuning", bukan "seorang".

  2. Aksi: satu kata kerja, satu beat. "Menyeberangi jalan dan berhenti di bawah tanda berkedip."

  3. Kamera: ukuran shot plus gerakan. "Sudut rendah, push-in lambat."

  4. Cahaya dan grade: "Cahaya lampu natrium, aspal basah, butir film 35mm."

  5. Kunci: apa yang tetap diam. "Signage latar belakang tetap statis, tidak ada karakter ekstra."

Curi ini:

Pengantar dalam jaket hujan kuning menyeberangi jalan kosong di malam hari dan berhenti di bawah tanda berkedip. Sudut rendah, push-in lambat, butir film 35mm, cahaya lampu natrium mencerminkan aspal basah. Signage dan bangunan tetap statis, tidak ada karakter ekstra, tidak ada teks.

Perhatikan apa yang hilang. Tidak ada "epik", tidak ada "masterpiece", tidak ada "8K ultra detail". Kata-kata itu adalah sisa dari era model gambar dan menambah noise, bukan arah. Gunakan token itu untuk kamera sebaliknya.

Vintage camera on a tripod slider track in a dim studio, ready for a slow dolly move

Bahasa kamera adalah upgrade termurah yang kamu miliki

Jika kamu hanya perbaiki satu slot, perbaiki ini. Model telah melihat jutaan clip berlabel dengan kosakata film, jadi istilah kamera nyata menarik perilaku nyata. Yang samar-samar menarik rata-rata.

Lembar contekan singkat yang benar-benar mengubah output:

Satu gerakan per clip. Dua gerakan simultan ("orbit sambil zoom dan tilt naik") adalah tempat fisika pergi mati. Jika ingin reveal kompleks, bangun sebagai shot terpisah dan potong bersama.

Prompt image-to-video: gambarkan gerakan, bukan gambarnya

Mulai dari still adalah kode curang diam dari seluruh kerajinan ini. Kunci tampilan dengan model gambar pertama, kemudian buat animasi. Prompt video berhenti menjadi deskripsi dan menjadi stage direction.

Gambar sudah berisi subjek, cahaya dan palet. Mengulangnya membuang kata dan kadang melawan frame. Tulis hanya apa yang bergerak:

Wanita itu membalikkan kepalanya perlahan ke arah jendela. Gorden terangkat dalam angin ringan. Kamera tetap diam. Segala sesuatu di frame lain tetap persis seperti apa adanya.

Kalimat terakhir itu penting lebih dari yang terlihat. "Segala sesuatu tetap seperti apa adanya" adalah kunci murah melawan latar belakang melayang yang membuat footage AI terungkap.

Jika membangun referensi di Midjourney atau Flux pertama, simpan komposisi sederhana: satu subjek jelas, ruang di sekelilingnya untuk kamera bergerak. Still ramai dan sesak memberikan model video tidak ada yang aman untuk push.

Blurred video editing timeline on a monitor above a notebook of camera angle sketches

Prompt yang layak disalin: tiga scene, tiga pekerjaan

Library prompt suka volume. Kami lebih suka memberi kamu tiga yang masing-masing mengajarkan reflex berbeda. Remix sesuka hati, tapi mulai dari ini.

Beat produk. Singkat, terkontrol, tanpa manusia untuk rusakkan.

Makro shot mug keramik matte di counter batu di pagi hari. Uap naik perlahan. Pull-back lambat mengungkap dapur berterang matahari. Cahaya jendela lembut, shallow depth of field. Bentuk mug dan counter tetap tidak berubah. Tidak ada tangan, tidak ada teks.

Piece mood. Satu karakter, satu gesture, banyak atmosfer.

Sosok sendiri dengan payung berjalan pergi turun jalan alley neon hujan di malam hari. Shot wide locked-off, anamorphic flare, hujan lebat, refleksi basah, butir 35mm. Sosok terus berjalan dengan kecepatan mantap. Tidak ada potongan.

Loop. Untuk latar belakang, hero sections, postingan sosial yang perlu diputar tanpa jahitan.

Awan melayang perlahan di atas ridge gunung di golden hour, kamera statis, parallax lembut dalam rumput foreground. Soft film grade. Gerakan halus dan berkelanjutan, frame awal dan akhir terlihat sama.

Masing-masing mengikuti lima slot. Masing-masing berakhir dengan kunci. Itulah polanya, dan itulah mengapa mereka tahan melampaui detik ketiga.

Lone figure with an umbrella walking away down a rainy neon alley at night, cinematic frame

Suara, durasi dan rasio aspek: setelan yang orang lupakan

Tiga detail duduk di luar lima slot dan masih menghancurkan clip saat diabaikan.

Durasi. Clip singkat tahan, yang panjang melayang. Jika model menawarkan lima hingga delapan detik, minta satu beat dan berhenti. Butuh tiga puluh detik? Rencanakan enam shot, bukan satu generasi heroik. Editor telah memotong di action selama satu abad karena alasan.

Rasio aspek. Putuskan sebelum menulis, karena komposisi bergantung padanya. Push-in lambat turun koridor dibaca indah di 16:9 dan terasa sempit di 9:16. Untuk vertikal, letakkan subjek di third tengah dan tinggalkan ruang kepala untuk chrome interface. Katakan rasio dalam prompt jika alat membiarkanmu.

Suara. Beberapa model sekarang menghasilkan audio dengan gambarnya. Jika punyamu, tulis suaranya seperti kamu menulis shot: "dengingan lalu lintas jauh, hujan di awning logam, satu sirene terteredam". Lewati permintaan musik kecuali kamu benar-benar membutuhkannya. Kamu akan ingin score sendiri bagaimanapun.

Ini versi prompt pengantar dengan suara ditambahkan:

Pengantar dalam jaket hujan kuning menyeberangi jalan kosong dan berhenti di bawah tanda berkedip. Sudut rendah, push-in lambat, butir 35mm, 16:9. Suara ambiens: hujan mantap, lalu lintas jauh, buzz listrik dari tanda. Tidak ada dialog, tidak ada teks.

Lima slot yang sama, satu baris ekstra. Itulah seluruh upgrade.

Model mana yang mendapat prompt mana?

Prompt yang sama, model berbeda, hasil berbeda. Jangan berharap satu master prompt untuk traveling. Beberapa generalisasi jujur, tidak ada benchmark yang berpura-pura:

Veo menangani kalimat panjang, deskriptif, sinematik dengan baik dan bisa membawa dialog dan cues suara ketika kamu menuliskannya. Kling cenderung menghargai aksi fisik jelas dan instruksi kamera, dan itu rumah nyaman untuk image-to-video. Runway suka prompt ketat, teredam dan memberimu lebih banyak kontrol hands-on saat iterating.

Jika lebih suka tidak juggling tiga tab, Higgsfield menempatkan beberapa model video di belakang satu workspace. Itu praktis ketika kamu ingin jalankan prompt yang sama melalui dua engine dan bandingkan, yang adalah cara tercepat belajar apa yang benar-benar didengarkan masing-masing.

Opini kami: pilih satu model, pelajari quirk-nya selama satu minggu, kemudian cabang keluar. Hopping engine setiap kali clip mengecewakan mengajarkanmu tidak ada.

Lewati kebiasaan ini (mereka menghabiskan kredit-mu)

Beberapa saran beredar karena terdengar cerdas. Tidak. Lewati:

Cara iterasi tanpa membakar kredit-mu

Perlakukan setiap generasi sebagai tes, bukan tiket lotre. Ubah satu slot pada satu waktu. Jika gerakan salah, sentuh baris aksi. Jika tampilan melayang, ketat kunci. Jika kamera mengapung, tukar "orbit" untuk "push-in lambat".

Simpan catatan berjalan tentang apa yang berhasil, dalam format apapun kamu benar-benar akan buka lagi. Board Are.na bekerja baik untuk ini, begitu juga file teks biasa. Poinnya adalah bahwa prompt ketiga kamu harus mulai dari pemenang prompt kedua kamu, bukan dari nol.

Dan tinjau clip dalam mode diam pertama. Menilai gerakan dengan sendirinya sebelum kamu biarkan soundtrack bagus maafkan.

Apa yang harus dicoba malam ini

Pilih satu scene dari tiga di atas, jalankan dalam model tunggal, dan ubah hanya baris kamera. Jalankan tiga kali: statis, push-in, tracking. Letakkan clip berdampingan. Kamu akan belajar lebih banyak dari eksperimen sepuluh menit itu daripada dari daftar seratus prompt.

Salin prompt, masukkan, dan lihat apa yang rusak. Kemudian katakan kepada kami slot mana yang akan kamu perbaiki pertama.

Praktik terbaik untuk iterasi cepat

Ketika kamu mulai dengan lima-slot framework, iterasi menjadi sistematis bukan intuitif. Jangan mencoba mengubah semuanya sekaligus. Sebaliknya, buat spreadsheet kecil atau dokumen teks dengan tiga kolom: slot apa, apa yang berubah, hasil apa. Satu perubahan per baris. Ini terdengar membosankan tapi menghemat energi mental dan kredit model.

Banyak kreator berpikir merge tool seperti ComfyUI atau menambahkan ControlNet adalah langkah berikutnya. Mungkin. Tapi pertama-tama kuasai prompt murni. Tools ada untuk mempercepat workflow yang sudah bekerja, bukan menyelamatkan workflow yang rusak.

Mengapa model berbeda mendengarkan berbeda

Setiap model video memiliki arsitektur training yang sedikit berbeda dan dataset training yang berbeda. Veo dilatih dengan klip yang lebih sinematik dan film-heavy, makanya menerima deskripsi naratif. Kling dilatih dengan lebih banyak konten user-generated dan short-form, makanya menghargai instruksi langsung. Runway berada di tengah dan lebih toleran terhadap eksperimen.

Ini bukan alasan untuk tidak coba semuanya. Ini alasan untuk mengerti bahwa satu prompt tidak universal. Bawa keyword dan structure ke setiap engine, tapi siap untuk reword action line atau camera instruction bergantung pada model.

Kesalahan umum pemula

Banyak orang datang ke video prompting dengan kebiasaan yang bekerja untuk image generation. Beberapa kesalahan paling umum:

Perbaikan: tulis seperti director breakdown sheet, bukan script novel. Lebih konkrit, lebih singkat, lebih action-oriented.

Setelah kamu memahami pola lima-slot, banyak masalah pemula lenyap. Kamu tahu apa yang dicari model karena kamu menjelaskannya dengan eksplisit. Tidak ada ruang untuk interpretasi buruk.

Frequently asked questions

Apa yang membuat prompt video AI bagus?
Prompt video AI yang baik menamai satu subjek, satu aksi, gerakan kamera, cahayanya dan garis kunci untuk apa yang harus tetap tidak berubah. Ini menggambarkan waktu dan gerakan, bukan hanya frame tunggal.
Berapa panjang prompt video AI yang seharusnya?
Targetkan 40 hingga 80 kata pada pass pertama. Melampaui kurang lebih 100 kata, model mulai menjatuhkan detail awal, jadi singkat dan spesifik mengalahkan panjang dan puitis.
Apakah saya memerlukan prompt berbeda untuk Veo, Kling dan Runway?
Ya, harapkan untuk menyesuaikan. Veo menangani kalimat sinematik panjang dan cues suara, Kling menghargai aksi fisik jelas, dan Runway suka prompt ketat. Pertahankan lima slot dan ubah sisanya.
Bagaimana cara menulis prompt image-to-video?
Lewati menggambarkan gambar, karena sudah memegang subjek, cahaya dan palet. Tulis hanya apa yang bergerak, namai perilaku kamera, dan tambahkan bahwa segalanya tetap persis seperti apa adanya.
Bisakah prompt video AI mencakup suara dan dialog?
Jika model kamu menghasilkan audio, ya. Tulis suara seperti shot: tekstur ambien, satu atau dua efek, dan dialog dalam tanda kutip jika diperlukan. Model tanpa audio mengabaikan baris ini.
Mengapa video AI melengkung wajah dan latar belakang?
Biasanya prompt meminta terlalu banyak: beberapa gerakan kamera, banyak aksi atau scene ramai. Gunakan satu gerakan, satu beat, kamera locked-off atau lambat, dan garis kunci untuk latar belakang.
★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   ★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   
✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦