Prompt Video IA Che Reggono Oltre il Terzo Secondo

Riassunto

I buoni **prompt video IA** dirigono un'inquadratura invece di descrivere un'immagine. Nomina un soggetto, un'azione, una mossa di telecamera, la luce e una cosa che deve rimanere invariata. Mantieni i clip su un singolo beat, usa vero vocabolario di telecamera, e aggiungi una lock line per fermare gli sfondi che vanno alla deriva. Per image-to-video, descrivi solo il movimento. Inizia con un modello, cambia uno slot alla volta, e giudica i clip silenziati prima di aggiungere audio.

Vista aerea piatta di un foglio di storyboard di un cineasta indipendente, striscia di film, stampa riso e clapperboard su una scrivania in legno

Hai scritto "un'inquadratura cinematica di una città di notte" e hai ottenuto otto secondi di zuppa di neon fusa. Benvenuto nel club. I buoni prompt video ia non descrivono un'immagine. Dirigono un'inquadratura: chi fa cosa, dove va la telecamera, quanto dura, cosa rimane congelato. Qui sotto c'è la struttura a cinque parti che ruba da ogni prompt che funziona, più esempi pronti da copiare direttamente in Veo, Kling o Runway oggi stesso.

Perché il tuo prompt si dissolve dopo due secondi

Un prompt di un'immagine statica descrive un fotogramma. Un prompt video deve descrivere il tempo. Questa è la differenza intera, ed è il motivo per cui un'abitudine Midjourney crolla il minuto in cui premi il pulsante video.

Quando descrivi solo un'estetica, il modello deve inventare il movimento. Sceglie l'opzione più pigra: uno zoom lento, un volto alla deriva, uno sfondo che si riorganizza silenziosamente. Hai chiesto un'atmosfera e hai ottenuto uno screensaver.

La soluzione è banale e funziona. Nomina il soggetto, un'azione, la mossa di telecamera, la luce, e una cosa che non deve cambiare. Cinque slot. Se ne perdi uno e il modello lo riempie per te, di solito male.

La stessa guida di Veo di Google arriva allo stesso scheletro: soggetto, azione, stile, posizione e movimento della telecamera, composizione, ambienza. Noi semplicemente lo riduciamo così lo puoi tenere in testa mentre digiti.

La formula a cinque slot, con un prompt da rubare

Ecco il riquadro. Scrivilo in questo ordine, in una o due frasi semplici, e mantienilo sotto circa 60 parole per un primo passaggio.

  1. Soggetto: una frase nominale con due specificità. "Un corriere in una giacca gialla antipioggia", non "una persona".

  2. Azione: un verbo, un beat. "Attraversa la strada e si ferma sotto un segno che lampeggia."

  3. Telecamera: dimensione dell'inquadratura più movimento. "Angolo basso, spinta lenta verso l'interno."

  4. Luce e grado: "luce stradale al sodio, asfalto bagnato, grana 35mm."

  5. Lock: cosa rimane fermo. "La segnaletica di sfondo rimane statica, nessun personaggio aggiuntivo."

Ruba questo:

Un corriere in una giacca gialla antipioggia attraversa una strada vuota di notte e si ferma sotto un segno che lampeggia. Angolo basso, spinta lenta verso l'interno, grana film 35mm, luce stradale al sodio che si riflette sull'asfalto bagnato. Segnaletica e edifici rimangono statici, nessun personaggio aggiuntivo, nessun testo.

Nota quello che manca. Nessun "epico", nessun "capolavoro", nessun "8K ultra dettagliato". Queste parole sono reliquie dell'era del modello immagine e aggiungono rumore, non direzione. Spendi quei token sulla telecamera invece.

Telecamera vintage su un binario slider tripode in uno studio buio, pronta per una mossa dolly lenta

Il linguaggio della telecamera è l'upgrade più economico che hai

Se sistemi solo uno slot, sistemi questo. I modelli hanno visto milioni di clip etichettati con vocabolario cinematografico, quindi i termini di telecamera reali tirano comportamento reale. Quelli vaghi tirano la media.

Un foglio di aiuto breve che cambia davvero gli output:

Un movimento per clip. Due movimenti simultanei ("orbita mentre zoomi e inclini verso l'alto") è dove la fisica va a morire. Se vuoi una rivelazione complessa, costruiscila come shot separati e montali insieme.

Prompt image-to-video: descrivi il movimento, non l'immagine

Partire da uno fermo è il codice cheat silenzioso di tutto questo mestiere. Blocchi l'estetica con un modello immagine per primo, poi anima. Il prompt video smette di essere una descrizione e diventa una direzione di scena.

L'immagine già contiene il soggetto, la luce e la tavolozza. Ripeterle spreca parole e a volte combatte il fotogramma. Scrivi solo quello che si muove:

La donna gira lentamente la testa verso la finestra. Le tende si sollevano in una brezza leggera. La telecamera rimane ferma. Tutto il resto nel fotogramma rimane esattamente come è.

Quell'ultima frase conta più di quanto sembri. "Tutto il resto rimane come è" è un cheap lock contro gli sfondi alla deriva che tradiscono il filmato IA.

Se stai costruendo riferimenti in Midjourney o Flux per primo, mantieni la composizione semplice: un soggetto chiaro e nitido, spazio intorno per la telecamera per muoversi. Uno fermo affollato e disordinato non dà al modello video nulla di sicuro da spingere.

Timeline di editing video sfocata su un monitor sopra un taccuino di schizzi di angoli di telecamera

Prompt che vale la pena copiare: tre scene, tre lavori

Le librerie di prompt amano il volume. Noi preferiamo darti tre che ognuno insegni un riflesso diverso. Rimescola liberamente, ma inizia da questi.

Il beat del prodotto. Corto, controllato, nessun umano da distorcere.

Macro shot di una tazza di ceramica opaca su un bancone di pietra all'alba. Il vapore sale lentamente. Il lento tiro indietro rivela una cucina illuminata dal sole. Luce morbida dalla finestra, profondità di campo poco profonda. La forma della tazza e il bancone rimangono invariati. Nessuna mano, nessun testo.

Il pezzo d'atmosfera. Un personaggio, un gesto, molta atmosfera.

Una figura solitaria con un ombrello cammina via giù in un vicolo neon bagnato di pioggia di notte. Ampio inquadratura bloccata, bagliore anamórfico, pioggia pesante, riflessi bagnati, grana 35mm. La figura continua a camminare a un passo costante. Nessun taglio.

Il loop. Per gli sfondi, sezioni hero, post di social che devono riprodursi senza una cucitura.

Nuvole che derivano lentamente su un crinale di montagna all'ora d'oro, telecamera statica, parallasse dolce nell'erba in primo piano. Grado film morbido. Il movimento è sottile e continuo, i fotogrammi di inizio e fine sembrano identici.

Ognuno segue i cinque slot. Ognuno finisce con una lock. Ecco il modello, ed è il motivo per cui reggono oltre il terzo secondo.

Figura solitaria con ombrello cammina via giù in un vicolo neon bagnato di pioggia di notte, inquadratura cinematografica

Suono, durata e rapporto di aspetto: i dettagli che le persone dimenticano

Tre dettagli si trovano al di fuori dei cinque slot e rovinano comunque i clip quando ignorati.

Durata. I clip corti reggono insieme, i lunghi vanno alla deriva. Se un modello offre cinque a otto secondi, chiedi un beat e fermati. Hai bisogno di trenta secondi? Pianifica sei shot, non una generazione eroica. I redattori hanno tagliato in azione per un secolo per una ragione.

Rapporto di aspetto. Decidi prima di scrivere, perché la composizione dipende da esso. Una lenta spinta verso l'interno lungo un corridoio si legge magnificamente in 16:9 e si sente stretto in 9:16. Per verticale, metti il soggetto nel terzo centrale e lascia spazio per il chrome dell'interfaccia. Di' il rapporto nel prompt se lo strumento te lo permette.

Suono. Alcuni modelli ora generano audio con l'immagine. Se il tuo lo fa, scrivi il suono come scrivi l'inquadratura: "ronzio del traffico distante, pioggia su una tenda di metallo, una sirena attutita". Salta le richieste musicali a meno che non ne hai davvero bisogno. Vorrai comunque registrarlo tu stesso.

Ecco una versione del prompt del corriere con il suono aggiunto:

Un corriere in una giacca gialla antipioggia attraversa una strada vuota e si ferma sotto un segno che lampeggia. Angolo basso, spinta lenta verso l'interno, grana 35mm, 16:9. Suono ambientale: pioggia costante, traffico distante, lieve ronzio elettrico dal segno. Nessun dialogo, nessun testo.

Stessi cinque slot, una riga extra. Questo è l'upgrade intero.

Quale modello ottiene quale prompt?

Lo stesso prompt, modello diverso, risultato diverso. Non aspettarti che un prompt master viaggi. Poche generalizzazioni oneste, nessun benchmark preteso:

Veo maneggia bene le frasi lunghe, descrittive e cinematiche e può portare dialogo e spunti audio quando li scrivi. Kling tende a premiare l'azione fisica chiara e le istruzioni della telecamera, ed è una casa comoda per image-to-video. Runway ama i prompt ristretti e temperati e ti dà più controllo pratico una volta che iterare.

Se preferisci non fare il giocoliere tre schede, Higgsfield mette diversi modelli video dietro uno spazio di lavoro. Questo è utile quando vuoi eseguire lo stesso prompt attraverso due motori e confrontare, che è il modo più veloce per imparare cosa ognuno davvero ascolta.

Il nostro punto di vista: scegli un modello, impara le sue stranezze per una settimana, poi ramifica. Saltare i motori ogni volta che un clip delude non ti insegna nulla.

Salta queste abitudini (ti costano crediti)

Alcuni consigli circolano perché suonano intelligenti. Non lo sono. Salta:

Come iterare senza bruciare i tuoi crediti

Tratta ogni generazione come un test, non un biglietto della lotteria. Cambia uno slot alla volta. Se il movimento è sbagliato, tocca la linea d'azione. Se l'estetica va alla deriva, stringi la lock. Se la telecamera galleggia, scambia "orbita" per "spinta lenta verso l'interno".

Mantieni una nota corrente di quello che ha funzionato, in qualunque formato aprirai davvero di nuovo. Le bacheche Are.na funzionano bene per questo, così come un file di testo semplice. Il punto è che il tuo terzo prompt dovrebbe iniziare dal vincitore del tuo secondo prompt, non da zero.

E rivedere i clip silenziati per primo. Giudica il movimento di per sé prima di lasciare che una bella colonna sonora lo perdoni.

Cosa provare stasera

Scegli una scena dalle tre sopra, eseguila in un singolo modello, e cambia solo la linea della telecamera. Eseguila tre volte: statica, spinta verso l'interno, tracking. Metti i clip uno accanto all'altro. Imparerai più da quel esperimento di dieci minuti che da qualunque lista di cento prompt.

Copia il prompt, rilascialo, e vedi cosa si rompe. Poi raccontaci quale slot aggiusteresti per primo.

Domande frequenti

Che cosa rende buono un prompt video IA?
Un buon prompt video IA nomina un soggetto, un'azione, una mossa di telecamera, la luce e una cosa che deve rimanere invariata. Descrive il tempo e il movimento, non solo un singolo fotogramma.
Quanto dovrebbe essere lungo un prompt video IA?
Mira a 40-80 parole al primo passaggio. Oltre circa 100 parole, la maggior parte dei modelli inizia a rilasciare i dettagli iniziali, quindi corto e specifico batte lungo e poetico.
Ho bisogno di prompt diversi per Veo, Kling e Runway?
Sì, aspettati di regolare. Veo gestisce bene le frasi lunghe e cinematiche, Kling premia l'azione fisica chiara, e Runway ama i prompt ristretti. Mantieni i cinque slot e parafrasando il resto.
Come scrivo prompt image-to-video?
Salta la descrizione dell'immagine, poiché contiene già il soggetto, la luce e la tavolozza. Scrivi solo quello che si muove, nomina il comportamento della telecamera, e aggiungi che tutto il resto rimane esattamente come è.
I prompt video IA possono includere suono e dialogo?
Se il tuo modello genera audio, sì. Scrivi il suono come un'inquadratura: trama ambientale, uno o due effetti, e dialogo tra virgolette se necessario. I modelli senza audio ignorano queste righe.
Perché i video IA distorcono volti e sfondi?
Di solito il prompt chiede troppo: diversi movimenti di telecamera, molte azioni o scene affollate. Usa una mossa, un beat, una telecamera bloccata o lenta, e una lock line per lo sfondo.
★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   ★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   
✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦