Come scrivere prompt per video AI che funzionano davvero: un framework in 5 dimensioni

Anna

I generatori di video AI possono trasformare una breve descrizione in una scena in movimento, ma un prompt vago produce spesso un risultato vago. Il soggetto potrebbe apparire corretto nel primo fotogramma per poi cambiare forma, la videocamera potrebbe rimanere ferma oppure diverse azioni potrebbero confondersi in un unico movimento caotico.

La soluzione non consiste nel riempire il prompt di ulteriori aggettivi. Un approccio migliore è scrivere un brief sintetico per l'inquadratura: definire cosa c'è sullo schermo, cosa cambia, come la videocamera lo osserva e quali dettagli devono rimanere stabili. Questa guida spiega come scrivere prompt per la generazione di video AI attraverso un framework a cinque dimensioni, esempi video reali, template pronti da copiare e un semplice flusso di revisione.

Cosa rende efficace un prompt per video AI?

Un prompt per video AI utile assegna al modello un compito visivo chiaro. Identifica il soggetto principale, descrive un'azione visibile, colloca tale azione in un ambiente specifico, dirige la videocamera e definisce l'aspetto dell'inquadratura.

Prompt debole:

A beautiful woman walking in a cinematic city.

Questo lascia aperte diverse decisioni importanti. Che aspetto ha la donna? Sta camminando verso la videocamera o si sta allontanando? La videocamera è statica o in movimento? Quale città, momento della giornata e illuminazione dovrebbe utilizzare il modello?

Prompt più efficace:

A young woman with short dark hair, a black leather jacket, and dark trousers walks slowly through a rain-soaked Tokyo street, then turns toward the camera. Medium side-tracking shot with a gentle forward push. Wet pavement reflects blue and pink neon, with light mist in the air. Realistic 35mm film look, low-saturation colors, soft neon side light, 8 seconds.

come scrivere prompt per video AI.jpg

La seconda versione fornisce al generatore un soggetto, un'azione, un'ambientazione, la direzione della videocamera, il trattamento visivo e la durata. Non garantisce un risultato perfetto, ma riduce la quantità di supposizioni necessarie.

Le cinque dimensioni di un prompt per video AI

Usa il seguente ordine come punto di partenza:

[Subject] + [Action] + [Setting] + [Camera] + [Style and Lighting]

prompt per la generazione di video AI.jpg

Per un prompt pronto per la produzione, aggiungi successivamente i parametri di controllo dell'output:

[Duration] + [Aspect Ratio] + [Audio] + [Continuity Rules]

Le cinque dimensioni descrivono il contenuto creativo dell'inquadratura. Durata, formato, audio e continuità sono vincoli di supporto che rendono il risultato più facile da utilizzare.

1. Soggetto: definisci ciò che lo spettatore deve vedere

Inizia con la persona, il prodotto, l'animale o l'oggetto principale. Usa i dettagli che contano per l'inquadratura anziché descrivere tutto ciò che riesci a immaginare.

Per una persona, i dettagli utili possono includere:

  • età approssimativa;
  • capelli, abbigliamento e accessori;
  • postura del corpo o espressione facciale;
  • dettagli sull'identità che devono rimanere coerenti.

Per un prodotto, descrivi:

  • forma e materiale;
  • colore e finitura;
  • posizionamento dell'etichetta o del packaging;
  • l'angolazione da cui dovrebbe essere mostrato.

Confronta queste due descrizioni:

A woman
A short-haired woman in a charcoal wool coat, cream scarf, and brown leather gloves

La seconda versione fornisce al modello un'identità visiva che può essere riutilizzata nelle inquadrature successive. Per un personaggio ricorrente, copia la descrizione chiave parola per parola nei vari prompt, invece di riscriverla ogni volta con nuovi sinonimi.

2. Azione: descrivi un cambiamento principale nel tempo

Un video ha bisogno di un verbo. Il prompt di un'immagine statica può descrivere un soggetto fermo in una stanza, ma il prompt di un video deve spiegare cosa cambia nel corso del filmato.

Le buone azioni sono fisiche e visibili:

  • versa il caffè in una tazza di ceramica;
  • si volta lentamente verso la finestra;
  • posa una barchetta di carta sull'acqua;
  • apre un portatile e preme un tasto;
  • cammina sotto la neve che cade.

Evita di concentrare un'intera storia in un unico breve filmato. "Apre la porta, attraversa la strada di corsa, sale in auto e parte" contiene diverse inquadrature. Suddividila in prompt separati o usa uno storyboard temporizzato quando lo strumento supporta sequenze più lunghe.

Puoi aggiungere un piccolo movimento secondario per dare vita all'inquadratura:

The woman walks slowly along the pier while her scarf moves gently in the wind.

L'azione primaria è camminare. Il movimento della sciarpa la supporta senza distogliere l'attenzione.

3. Ambientazione: colloca l'azione in un luogo credibile

"Un ufficio" o "una foresta" sono spesso definizioni troppo generiche. Aggiungi i dettagli che influenzano l'atmosfera e la composizione:

  • luogo;
  • momento della giornata;
  • condizioni meteo;
  • elementi in primo piano e sullo sfondo;
  • texture visibili;
  • movimento sullo sfondo.

Esempio:

A quiet ceramic studio at dawn, with wooden shelves, pale clay bowls, a large north-facing window, and soft dust floating in the sunlight.

Non è necessario descrivere ogni oggetto presente nella stanza. Scegli i dettagli che aiutano il modello a comprendere il luogo e che lo spettatore può effettivamente vedere.

4. Videocamera: spiega come viene girata l'inquadratura

Il linguaggio della videocamera trasforma una scena in un'inquadratura con una regia precisa. Includi inquadratura, angolazione, movimento e velocità quando sono rilevanti.

Termini comuni per l'inquadratura:

  • primissimo piano;
  • primo piano;
  • piano medio;
  • campo largo;
  • inquadratura dall'alto;
  • ripresa aerea.

Termini comuni per i movimenti di macchina:

  • inquadratura fissa e bloccata;
  • carrellata in avanti lenta;
  • carrellata indietro;
  • panoramica da sinistra a destra;
  • carrellata laterale/di inseguimento;
  • movimento orbitale;
  • ripresa con gru verso l'alto;
  • inseguimento con camera a mano.

Usa un solo movimento di macchina principale per ogni breve clip. Per esempio:

Macro close-up with a slow push-in toward condensation forming on the glass bottle.

Questo è molto più chiaro e applicabile rispetto a "rendi dinamica l'inquadratura del prodotto". Se anche il soggetto si muove, descrivi i due movimenti separatamente:

The cyclist moves from left to right while the camera tracks alongside at a steady pace.

5. Stile e illuminazione: definisci il trattamento visivo

Lo stile indica al modello l'aspetto visivo che deve avere il filmato. L'illuminazione indica come deve essere illuminata la scena. Sono aspetti correlati, ma non costituiscono la stessa istruzione.

Le indicazioni di stile utili includono:

  • filmato documentaristico realistico;
  • spot commerciale pulito di prodotto;
  • animazione in carta ritagliata fatta a mano;
  • resa visiva in pellicola 35 mm con toni attenuati;
  • animazione in stop-motion;
  • anime in cel-shading;
  • riprese UGC girate con smartphone.

Le indicazioni di illuminazione utili includono:

  • luce calda del mattino proveniente dalla finestra;
  • luce diurna fredda e nuvolosa;
  • controluce netto al tramonto;
  • luce laterale soffusa al neon;
  • un unico faretto dall'alto;
  • luce di candela con ombre profonde.

Sostituisci le frasi astratte con qualità visibili. Invece di "atmosfera cinematografica di alto livello", prova con "controluce morbido, movimento di camera contenuto, profondità di campo ridotta e colori caldi e attenuati".

Parametri di supporto: durata, formato, audio e continuità

Le cinque dimensioni costruiscono l'inquadratura. I seguenti controlli aiutano ad adattarla a un progetto reale.

Durata e proporzioni (aspect ratio)

Indica la durata desiderata quando il modello lo consente e scegli le proporzioni adatte alla destinazione d'uso:

  • 16:9 per video panoramici e paesaggi cinematografici;
  • 9:16 per video verticali sui social media;
  • 1:1 per post quadrati sui social media.

Se lo strumento include controlli dedicati per la durata e il formato, usa prima quelli e mantieni il prompt focalizzato sulla direzione creativa.

Audio e dialoghi

Se il modello supporta l'audio nativo, descrivi esattamente il suono che desideri:

Natural café ambience, soft cup and spoon sounds, distant conversation, no music.

Per i dialoghi, scrivi le parole esatte tra virgolette e identifica chi parla. Mantieni la battuta abbastanza breve da rientrare nella clip. Se non desideri parlato o sottotitoli, specificalo solo quando il modello supporta tali vincoli.

Regole di continuità

Quando un personaggio o un prodotto compare in diverse inquadrature, ripeti i dettagli che non devono cambiare:

Keep the same face, hairstyle, cream sweatshirt, product shape, label position, and warm color palette throughout the sequence.

Per l'image-to-video, concentrati su cosa deve muoversi e cosa deve rimanere fisso. L'immagine di partenza fornisce già gran parte della composizione, quindi il prompt di solito non deve ripetere ogni singolo dettaglio visivo.

I prompt text-to-video e image-to-video sono diversi

Il text-to-video richiede al modello di costruire la scena a partire dalle parole. Includi soggetto, ambientazione, azione, videocamera, illuminazione e stile.

L'image-to-video parte da un riferimento visivo esistente. Concentrati su movimento, comportamento della videocamera e stabilità:

Animate the supplied product image with a slow push-in. Add a subtle highlight moving across the glass and a shallow background parallax. Keep the bottle shape, label, color, and position unchanged. Avoid extra products, packaging distortion, and unreadable text.

come scrivere prompt per image-to-video e text-to-video.jpg

La frase "anima questa immagine" è solitamente troppo vaga. Indica al modello cosa cambia e cosa no.

Esempi reali di video AI e cosa insegnano

I seguenti esempi si basano su casi selezionati dalla libreria di prompt di GoEnhance. I video sono inclusi per permetterti di confrontare le istruzioni scritte con il movimento ottenuto. Le pagine di origine e gli URL dei video sono stati verificati il 26 agosto 2026; le pagine di origine potrebbero subire modifiche nel tempo.

Per altri esempi specifici per modello, consulta i prompt per Seedance 2.0, i prompt per Grok Imagine e la raccolta più ampia di prompt video.

Esempio 1: un vlog rurale lo-fi

Caso d'uso: video lifestyle in stile documentario.

Seedance 2.0 slice-of-life vlog, 15 seconds, 16:9. Preserve the same woman’s face, hairstyle, skin tone, and body proportions. She wears an oversized olive linen shirt, dusty burgundy wide-leg trousers, brown sandals, and small gold hoops. Set the video in an authentic Korean rural village with mossy walls, hanok roofs, ceramic jars, roosters, cooking smoke, and overgrown paths. Use a late-2000s flip-camera look: heavy handheld shake, imperfect reframing, autofocus hunting, exposure swings, rolling shutter, motion blur, faded muddy colors, digital noise, and compression artifacts. She walks, splashes water on her face, feeds a stray dog, sips from a tin cup, then waves as the recording cuts off. No posing, glamour, stabilization, music, or modern grading. Include birds, roosters, footsteps, wind, water, and village ambience.

Questo prompt è volutamente dettagliato riguardo all'epoca visiva, alle imperfezioni della videocamera, all'abbigliamento, all'ambiente, alla sequenza di azioni e al sonoro. Dimostra che "realistico" non significa sempre pulito o perfetto: il linguaggio visivo desiderato può includere difetti quando questi fanno parte dello stile.

Esempio 2: una scena di scoperta fantascientifica

Caso d'uso: narrazione cinematografica di fantascienza.

Create a cinematic sci-fi short with a lonely, contemplative tone that gradually shifts into quiet wonder. A damaged exploration robot moves through a desaturated alien landscape of dusty earth and grey rock under overcast daylight. Use one glowing blue accent in the robot’s chest. Begin with macro close-ups of scratched metal and slow mechanical movement, then track behind the robot as it discovers a tiny living plant inside a collapsed research station. Push in slowly while dust floats through the beam of light. Use 35mm cinematography, restrained camera movement, realistic surface texture, soft atmospheric haze, and a quiet electronic score. End on the robot reaching toward the plant. No comedy, no fast cuts, no extra characters, no flicker.

L'insegnamento fondamentale è la progressione emotiva. Il prompt non si limita a elencare oggetti; spiega come la scena passa dall'isolamento alla meraviglia e fornisce al modello una conclusione chiara.

Esempio 3: uno spot pubblicitario di cibo

Caso d'uso: pubblicità di prodotto e contenuti a tema culinario.

Create a premium food commercial featuring a freshly grilled burger on a dark wooden table. Begin with a macro close-up of melted cheese and crisp lettuce, then slowly orbit around the burger as steam rises from the toasted bun. Warm side lighting creates soft highlights on the ingredients, with a shallow depth of field and a rich but natural color grade. Add subtle restaurant ambience and a gentle sizzle. End with a clean hero shot centered on the burger, leaving empty space on the right for a short CTA. Keep the burger shape and ingredient layers consistent. No extra burgers, distorted food, unreadable text, or sudden cuts.

Questo esempio definisce una composizione finale precisa invece di lasciare che la clip si interrompa casualmente. Questo aspetto è fondamentale nella pubblicità, poiché l'ultimo fotogramma deve spesso ospitare un logo, il nome del prodotto o una CTA in fase di montaggio.

Esempio 4: una ripresa di prodotto con movimento controllato

Caso d'uso: marketing di prodotti tecnologici o lifestyle.

Create a sleek cyberpunk product commercial featuring matte black wireless earbuds in an open charging case on a reflective metal surface. Use a slow orbital camera move while thin blue and violet light strips pass across the case. Macro close-up, shallow depth of field, crisp material texture, controlled reflections, and a dark futuristic color palette. Add a quiet electronic pulse and a soft mechanical click as the case opens. End with the earbuds centered in a clean hero composition. Keep the case shape, earbud position, and branding consistent. Avoid extra products, warped reflections, and invented text.

Il prodotto rimane la priorità. Le luci in movimento aggiungono dinamismo, ma il prompt non richiede che il prodotto ruoti, si apra, si trasformi e voli contemporaneamente.

Template di prompt per video AI pronti da copiare

Usa questi template come punto di partenza. Sostituisci i campi tra parentesi quadre e rimuovi qualsiasi istruzione non applicabile alla tua inquadratura.

Template 1: scena cinematografica con personaggio

Create a [duration] [aspect ratio] [visual style] featuring [subject description]. The scene takes place in [location] during [time of day and weather]. [Subject] [one primary action]. Use a [shot type] with [camera movement and speed]. Add [lighting, color palette, and texture]. Include [sound or dialogue] if needed. End with [final image]. Keep [identity, outfit, and important props] consistent. Avoid [specific failure modes].

Template 2: spot di prodotto

Create a [duration] commercial for [product]. Begin with [opening shot] that shows [material, texture, or feature]. Then [one product action or use case] with [camera movement]. Use [lighting, color, and visual style]. End with a clean hero composition of [product], leaving space for [logo or CTA]. Keep the product shape, color, label, and branding consistent. Avoid [extra objects, distorted packaging, or invented text].

Template 3: animazione image-to-video

Animate the supplied image with [camera movement]. Make [specific subject or environmental element] move slowly and naturally. Add [secondary motion such as wind, light, steam, or water]. Keep [face, clothing, product shape, label, composition, and colors] unchanged. Use [style and lighting]. Duration: [duration]. Avoid [warping, flicker, extra objects, and unwanted text].

Template 4: video UGC per i social

Create a natural [duration] vertical UGC video featuring [creator] in [location]. 0–[x] seconds: [hook]. [x]–[y] seconds: [demonstration or transformation]. [y]–[end] seconds: [reaction and CTA]. Use phone-camera handheld movement, realistic lighting, natural speech, and authentic ambient sound. Keep [product, clothing, and creator identity] consistent. Avoid forced acting, studio polish, random subtitles, and label changes.

Template 5: trasformazione animata

Create a [duration] [animation style] transformation. Begin with [starting object or scene]. Gradually transform it into [final object or scene] through [specific visible steps]. Keep the transformation centered and continuous. Use [camera movement], [texture], [lighting], and [sound]. End on [final pose, product, or logo]. Avoid abrupt cuts, random characters, flicker, and style changes.

Errori comuni nei prompt per video AI e soluzioni pratiche

Errore 1: accumulare aggettivi invece di dirigere l'inquadratura

Termini come "bellissimo", "epico" e "di alta qualità" non dicono al modello cosa mettere in movimento. Sostituiscili con decisioni visive concrete su inquadratura, movimento, luce e texture.

Errore 2: richiedere diverse azioni slegate tra loro

Suddividi una sequenza in più inquadrature. Una clip di sei secondi è più facile da controllare se contiene un solo passaggio chiaro, come "la donna si volta verso la finestra", anziché un'intera routine mattutina.

Errore 3: dimenticare la videocamera

Se la videocamera è importante, specificala. Un'inquadratura fissa e statica può essere una scelta deliberata, ma non dare indicazioni sulla videocamera lascia la decisione interamente al modello.

Errore 4: descrivere solo il soggetto e non il cambiamento

"Un cane in un parco" descrive un singolo fotogramma. "Un golden retriever corre sull'erba bagnata mentre la videocamera lo segue a fianco" descrive un video.

Errore 5: usare istruzioni negative generiche

"Non farlo venire male" non serve a nulla. Specifica il problema esatto che vuoi evitare: "Mantieni l'etichetta leggibile e la forma della bottiglia inalterata". Alcuni modelli rispondono meglio anche a descrizioni positive del risultato desiderato, come "movimento di camera fluido e stabile" invece di "nessun tremolio della videocamera". Testa la formulazione con il modello che stai utilizzando.

Errore 6: aspettarsi che il testo del prompt controlli ogni impostazione tecnica

Risoluzione, durata, proporzioni, seed e controlli della videocamera potrebbero essere disponibili direttamente nell'interfaccia dello strumento. Utilizza queste impostazioni quando possibile e mantieni il prompt scritto concentrato sulla direzione visiva.

Come correggere una generazione non riuscita

Considera la prima generazione come un test diagnostico. Identifica il problema principale, quindi modifica una sola variabile alla volta.

  1. Se il soggetto muta, ribadisci la sua identità visiva e rimuovi i dettagli superflui.
  2. Se l'azione è confusa, riduci la clip a un unico verbo principale.
  3. Se l'inquadratura risulta piatta, aggiungi un movimento e una velocità precisi per la videocamera.
  4. Se lo sfondo è caotico, rimuovi gli oggetti secondari e semplifica l'ambientazione.
  5. Se il prodotto cambia forma, aggiungi una regola di continuità e usa un'immagine di riferimento se disponibile.
  6. Se l'atmosfera non è corretta, regola la descrizione di luci e colori invece di riscrivere l'intero prompt.
  7. Se la parte finale è inutilizzabile, descrivi esplicitamente la composizione del fotogramma finale.

Modificare una sola variabile alla volta rende più facile capire quali istruzioni il modello segue con precisione. Conserva la versione migliore come nuovo prompt di base invece di ricominciare da capo dopo ogni tentativo.

Cosa sfugge alla maggior parte delle guide sui prompt per video AI

Una formula è utile, ma un flusso di lavoro ripetibile ha molto più valore di un lungo elenco di parole chiave. Adotta queste buone pratiche quando vuoi ottenere risultati più coerenti:

  • Mostra la versione fallita e la versione corretta in modo che il cambiamento sia chiaro.
  • Separa il movimento del soggetto, il movimento della videocamera e il movimento ambientale.
  • Considera ogni prompt come una singola inquadratura, per poi unire le varie inquadrature in fase di montaggio.
  • Ripeti i dettagli su personaggio, abbigliamento, prodotto e colori nei prompt correlati.
  • Adatta il prompt allo scopo: gli spot di prodotto richiedono un packaging stabile, mentre i vlog lo-fi possono richiedere imperfezioni intenzionali della camera a mano.
  • Concludi le clip commerciali e social con una composizione utilizzabile anziché con un taglio accidentale.
  • Tieni un breve registro dei prompt annotando modello, impostazioni, formule efficaci ed errori corretti.

Queste pratiche rendono i prompt più facili da analizzare e riutilizzare. Evitano inoltre un errore frequente: aggiungere altre parole quando il vero problema è che l'inquadratura contiene troppe istruzioni in contrasto tra loro.

Un semplice piano pratico per principianti

Non c'è bisogno di iniziare con una storia complessa. Fai pratica con il framework creando inquadrature brevi e facili da valutare.

Esercizio 1: soggetto e azione

Scrivi cinque prompt usando la stessa struttura:

[Subject] performs [one visible action].

Modifica solo il soggetto e l'azione. Questo ti aiuterà a capire se il modello comprende il verbo.

Esercizio 2: aggiungi ambientazione e videocamera

Mantieni la stessa azione, poi testa tre ambientazioni e tre movimenti di macchina. Confronta quali combinazioni producono il movimento più chiaro.

Esercizio 3: aggiungi micro-movimenti e continuità

Aggiungi un movimento ambientale, come vento, vapore, acqua o polvere fluttuante. Poi aggiungi una regola di continuità per viso, abbigliamento, prodotto o oggetti di scena.

Esercizio 4: modifica una sola variabile

Genera due versioni dello stesso prompt. Modifica solo la videocamera, l'illuminazione o l'azione. Prendi nota di cosa è migliorato e cosa è diventato meno stabile.

Checklist finale prima di generare

Fatti queste domande prima di avviare un altro rendering:

  1. Il soggetto principale è abbastanza specifico da essere riconoscibile?
  2. Il prompt contiene un'azione primaria chiara?
  3. L'ambientazione è visibile e specifica?
  4. La videocamera ha un'istruzione chiara di inquadratura o di movimento?
  5. L'illuminazione e lo stile visivo sono concreti e non generici?
  6. Hai impostato durata e proporzioni dove necessario?
  7. Hai incluso audio o dialoghi solo quando davvero necessario?
  8. Hai specificato cosa deve rimanere coerente?
  9. Il fotogramma finale ha una composizione utilizzabile?
  10. Se il prompt non dà i risultati sperati, sai già quale singola variabile modificare al passaggio successivo?

Domande frequenti

Quanto deve essere lungo un prompt per video AI?

Abbastanza lungo da descrivere chiaramente l'inquadratura, ma sufficientemente breve da mantenere le istruzioni focalizzate. Un paragrafo compatto o una serie strutturata di frasi sono solitamente più facili da perfezionare rispetto a un lungo blocco di aggettivi scollegati.

Quante azioni dovrebbe includere un singolo prompt per video AI?

Usa un'unica azione principale per una clip breve. Se il soggetto deve compiere diverse azioni importanti, suddividi l'idea in più inquadrature o crea prima una pianificazione temporizzata della scena.

I prompt per video AI devono essere scritti in inglese?

Dipende dal modello. Molti strumenti supportano più lingue, ma i fattori più importanti rimangono sostantivi specifici, verbi visibili, istruzioni di ripresa chiare e una struttura solida. Fai delle prove con la lingua che garantisce i risultati più prevedibili nello strumento che hai scelto.

I prompt negativi sono necessari nella generazione di video AI?

Possono aiutare a prevenire errori specifici, ma la loro efficacia varia da modello a modello. Inizia descrivendo chiaramente il risultato desiderato, poi aggiungi vincoli concreti come mantenere invariata l'etichetta di un prodotto o evitare oggetti indesiderati, purché lo strumento supporti tali indicazioni.

Posso usare lo stesso prompt in qualsiasi strumento di video AI?

Il framework a cinque dimensioni si adatta bene ovunque, ma i singoli modelli possono interpretare i movimenti di camera, le istruzioni audio, la durata e i vincoli negativi in modo differente. Considera un prompt multipiattaforma come un punto di partenza e perfezionalo dopo aver effettuato dei test.

Un prompt più lungo è sempre migliore?

No. I dettagli aggiuntivi sono utili solo quando chiariscono qualcosa di visibile o fondamentale per l'inquadratura. Se il prompt richiede troppi soggetti, azioni, stili e movimenti di camera contemporaneamente, le istruzioni rischiano di entrare in conflitto tra loro.

Conclusione

Il modo più affidabile per scrivere prompt per la generazione di video AI è pensare come un regista che redige un breve brief per l'inquadratura. Definisci il soggetto, un'azione chiara, l'ambientazione, la videocamera e il trattamento visivo. Poi aggiungi solo durata, formato, sonoro e regole di continuità strettamente necessari al progetto.

Inizia con una singola inquadratura, esamina il risultato e modifica una sola variabile alla volta. Una logica visiva chiara è molto più efficace di una sfilza di parole chiave generiche, e una piccola libreria di prompt testati acquisirà sempre più valore a ogni nuova generazione.