Scrivi «la telecamera si avvicina alla persona». Premi invio. E l’intelligenza artificiale decide da sola: a volte avanza, a volte zooma, a volte ci gira intorno. Tre video diversi, dalla stessa frase.
Metà del problema è la frase. L’altra metà, come vedrai, è il modello.
Nel cinema «avvicinarsi» si dice in almeno quattro modi, e ognuno racconta una cosa diversa. Un carrello ti porta dentro la scena. Uno zoom ingrandisce lo stesso sguardo. Una gru che scende ti fa atterrare accanto al soggetto. Un dolly zoom ti fa girare la testa. Chi scrive un prompt senza conoscere la differenza sta ordinando un’emozione a caso — e poi si stupisce del risultato.
Higgsfield, una piattaforma che riunisce diversi modelli per generare video con l’AI, da Kling a Seedance, ha messo online una risorsa che risolve proprio questo: il Prompt Bank, una raccolta di 46 movimenti di camera, ognuno con il suo video d’esempio e il prompt pronto da copiare. L’ho studiata voce per voce, l’ho messa alla prova su una bottega inventata e su una persona vera, e qui trovi tutto: cosa sono questi movimenti, come si scrivono, cosa ha funzionato e cosa no.
In breve
Il Prompt Bank di Higgsfield raccoglie 46 prompt per i movimenti di camera, divisi in 6 famiglie. Il metodo sta in due idee: il blocco del movimento descrive soprattutto la macchina da presa, così si riusa cambiando solo i riferimenti alla scena, e dice in modo esplicito anche cosa la macchina deve evitare. Nelle mie cinque prove con Kling 3.0 quattro movimenti sono usciti come chiesti e uno no: lo zoom ottico, che in montaggio si può simulare.
Cos’è il Prompt Bank di Higgsfield
Il Prompt Bank è una galleria di prompt per i movimenti di camera nei video generati con l’AI: 46 voci, ognuna con un video che mostra il movimento e il testo in inglese da copiare.
Sta nella sezione Academy del sito di Higgsfield e oggi è ordinato in sei famiglie: un’inquadratura fissa, otto fra panoramiche e movimenti verticali, sette fra zoom e messa a fuoco, diciassette fra carrelli e inseguimenti, sei aerei o con la gru, sette speciali. Ogni voce ha due pulsanti: uno copia il prompt, l’altro — «Recreate» — apre il generatore video di Higgsfield con il testo già scritto dentro.
La descrizione della pagina parla anche di prompt per gli effetti di camera e per gli effetti visivi. Quando l’ho consultata, l’8 ottobre 2026, c’erano solo i movimenti.
La frase che conta però è un’altra, ed è scritta in cima alla pagina:
La citazione
«The move stays separate from the scene, so the prompt works even when you swap the frame.» Il movimento resta separato dalla scena, così il prompt funziona anche quando cambi l’inquadratura.
Tradotto: il movimento è un pezzo a sé. Lo scrivi una volta, bene, cambi i riferimenti alla scena e lo attacchi a qualsiasi immagine — la bottega di un artigiano, un piatto che esce dalla cucina, tu che parli in camera. È la stessa logica di un buon modello di documento: separi la forma dal contenuto e la forma la riusi.
Un elenco di effetti speciali si consuma. Un vocabolario resta.
Perché l’AI sbaglia i movimenti di camera
L’AI sbaglia i movimenti perché le parole di tutti i giorni sono vaghe, e davanti a una richiesta vaga il modello sceglie da solo.
Su un set vero, quando il regista dice «avviciniamoci», l’operatore chiede: avanzo col carrello o stringo con lo zoom? Salgo o resto all’altezza degli occhi? Mi fermo o continuo? Un modello video questa domanda non te la fa. Prende la tua frase, ne ricava l’interpretazione che gli sembra più probabile e va. A volte indovina. A volte no, e tu non sai nemmeno perché.
I prompt del Prompt Bank provano a fare il contrario: lasciare al modello il minimo spazio di scelta. Descrivono il movimento come lo descriverebbe un operatore — cosa si muove, di quanto, a che velocità, dove finisce — e poi chiudono tutte le porte laterali. Guarda come è scritto «Slow zoom out», lo zoom lento all’indietro:
«NOT a dolly out, NOT a pull-back, NOT a track backward — no rearward travel, no crane, no jib, no pedestal, no drone pull-away, no floating retreat»
Nove divieti di fila, tutti per dire una cosa sola: la macchina sta ferma, cambia solo la focale. Servono a distinguere uno zoom da un passo indietro della macchina, che sullo schermo si somigliano. Nella mia prova sullo zoom in avanti, scritto con la stessa logica, non sono bastati: lo racconto fra poco.
Recintare il campo aiuta il modello. Garantire il risultato è un’altra cosa.
Zoom o carrello: la differenza che si vede
Lo zoom cambia la focale con la macchina ferma, e la prospettiva resta quella; il carrello sposta la macchina e cambia il punto di vista. Con lo zoom tutto cresce insieme, soggetto e sfondo; con il carrello le cose vicine scorrono via in fretta e quelle lontane quasi non cambiano. Questo scorrimento a velocità diverse si chiama parallasse, ed è il segnale con cui il tuo cervello capisce che ti stai muovendo davvero.
In italiano il carrello si chiama carrellata: la macchina da presa montata su un carrello, spesso su binari, che va avanti, indietro, di lato o in circolo. Lo zoom, nel gergo, è la «carrellata ottica», o «zoommata»: la macchina resta dov’è e cambia la lunghezza focale. Sullo schermo sembrano parenti stretti. Nell’effetto sono diversissimi: il carrello ti porta dentro lo spazio, lo zoom ingrandisce lo stesso sguardo da lontano.
I due prompt del Prompt Bank lo dicono in modo esplicito. Lo zoom: «la prospettiva resta costante e non c’è parallasse, lo sfondo mantiene esattamente la stessa misura apparente rispetto al soggetto». Il carrello: «il campo visivo non cambia mai, niente zoom: la prospettiva cambia perché la macchina si avvicina fisicamente, e gli oggetti vicini escono dai bordi con una forte parallasse».
Volevo vedere se un modello rispetta davvero questa differenza. Ho generato una foto di partenza — una ceramista al tornio, in una bottega lunga e stretta piena di scaffali, con una finestra in fondo — e l’ho animata due volte con Kling 3.0, cinque secondi ciascuna. Per entrambe ho tenuto il blocco originale in inglese, ho riempito i segnaposto e ci ho messo davanti una frase su cosa fa la ceramista.
Il carrello è uscito come doveva: a sinistra entra in primissimo piano il montante di uno scaffale, con una ciotola, e scivola via; la ceramista cresce un po’; la finestra in fondo resta quasi della stessa misura. Parallasse da manuale.
Lo zoom no. Fra il primo e l’ultimo fotogramma la ceramista diventa circa 1,8 volte più grande, mentre la finestra alle sue spalle resta praticamente uguale. In uno zoom vero sarebbero cresciute insieme, della stessa proporzione. Il modello ha letto «tripode bloccato, nessuno spostamento, cambia solo l’obiettivo» e ha fatto comunque un passo avanti. Un bel movimento, morbido e pulito. Solo che è un altro movimento.
La lezione è più utile del fallimento. In uno zoom la macchina non si sposta, quindi la geometria dell’immagine resta quella: si stringe l’inquadratura e basta. Un ingrandimento animato in montaggio ottiene la stessa stretta senza parallasse, con la precisione che vuoi e senza spendere un credito. Non è identico a uno zoom ottico: perdi definizione a mano a mano che ingrandisci, e lo sfocato resta quello della ripresa originale. Per questo conviene partire da un video in alta risoluzione e tenere la stretta moderata. Se lavori con un montatore guidato dall’AI, come quello che ho raccontato nell’articolo su ChatCut e il montaggio con Claude Code, gli basta una riga per farlo.
All’AI chiedi quello che da solo non sai fare. Il resto fallo tu.
Come è fatto un prompt di movimento
Molti prompt del Prompt Bank si leggono con quattro domande — cosa fa la macchina, a che velocità, cosa resta nell’inquadratura, come finisce — più un elenco di cose vietate.
Prendi «Pan right», la panoramica verso destra. Apre con il movimento: la macchina ruota in orizzontale da un punto fisso, «come una testa che si gira», partendo da una composizione e attraversando l’ambiente. Poi i divieti: niente spostamento laterale, niente carrello, niente arco, niente zoom, niente inclinazione. Poi tre etichette asciutte: Speed (rotazione costante, che rallenta dolcemente alla fine), Framing (orizzonte in bolla, il nuovo spazio entra solo da destra), End (si ferma su una composizione chiara e la tiene).
È la struttura di un ordine di servizio: ogni frase prova a togliere un’ambiguità. Non tutte le voci la seguono alla lettera, ma quasi tutte rispondono a quelle quattro domande.
Poi ci sono le parentesi quadre, e qui sta il lavoro tuo. In 37 voci su 46 ci sono pezzi fra parentesi che vanno riempiti, di due tipi:
- segnaposto da sostituire con la tua scena — «[the landing subject]», il soggetto su cui atterrare, diventa «the baker at the counter»; «[composition A]» diventa l’inquadratura da cui parti;
- valori numerici già proposti — «[84] degrees», «[1.5] meters» — che puoi tenere o cambiare con le tue misure.
Riempite le parentesi, le parentesi si tolgono. Davanti al blocco del movimento si mette una frase sola su cosa fa il soggetto. Ecco come diventa «Push in», l’avvicinamento lento, per la scena di un panettiere:
«The baker dusts flour off her hands and looks up into the lens. A slow continuous creeping forward drift from 4 meters to 1.5 meters over the full shot — gimbal-smooth floating advance at 1.5-meter height with barely perceptible organic sway, no rails feel, no speed changes, no zoom, no pan, no tilt. The approach should feel like held breath, decelerating into a near-stop at the end framing.»
Nota l’ultima riga: «l’avvicinamento deve sembrare un respiro trattenuto». Dentro un testo tecnicissimo c’è un’istruzione emotiva: aggiunge un’intenzione alle misure, e dice al modello che tipo di avvicinamento cercare.
Un buon prompt di movimento si legge come un ordine di servizio, e finisce come una regia.
I numeri dentro i prompt: gradi, metri, secondi
I prompt sono pieni di numeri perché una misura lascia al modello molto meno spazio di un aggettivo. «Lento», per te e per lui, sono due cose diverse. «Quaranta centimetri» è la stessa cosa per tutti.
I gradi, nei prompt, indicano due cose. A volte una rotazione: i 60 gradi di un arco attorno al soggetto, i 200 di un’orbita col drone, il piccolo rimbalzo di 2 gradi alla fine di una panoramica a schiaffo. Più spesso l’angolo di campo, cioè quanto è largo lo sguardo dell’obiettivo. E lì ricorrono soprattutto quattro valori: 84, 47, 29 e 18 gradi. Ho fatto il conto, e il risultato è curioso.
Il calcolo vale se quegli angoli sono misurati sulla diagonale dell’inquadratura. La pagina non lo dice, ma c’è un indizio: il prompt del «Walk-and-talk» chiama 47 gradi «normal field of view», l’angolo normale, e 47 gradi in diagonale è proprio l’angolo di un 50 millimetri, l’obiettivo che si chiama «normale» da sempre. Se invece fossero gradi orizzontali, le focali sarebbero un po’ più corte: circa 20, 41, 70 e 114 millimetri. Cambia poco: 84 gradi resta un grandangolo, 18 un teleobiettivo.
Con questa lettura, la tabella ti serve per una ragione pratica. Se sai che vuoi «un ritratto con l’85», scrivi 29 gradi. Se vuoi lo sguardo largo di chi entra in una stanza, 84. Pensi in obiettivi, scrivi in gradi.
Poi ci sono i metri. L’altezza della macchina è quasi sempre fra 1,5 e 1,7 metri, cioè l’altezza degli occhi di una persona in piedi. Gli archi attorno al soggetto hanno un raggio di 2,5 metri. Il «Pedestal», la macchina che sale dritta come un ascensore, va da 0,8 a 2,2 metri. Tutti numeri plausibili su un set vero: descrivono un movimento che una troupe potrebbe davvero fare.
Plausibili uno per uno, però, non vuol dire coerenti fra loro. Nel prompt originale del Dolly zoom la macchina avanza da 6 a 2,5 metri mentre l’angolo si allarga da 18 a 84 gradi, e il soggetto dovrebbe restare della stessa misura. Facendo il conto, quei due numeri non si compensano: in teoria il soggetto finirebbe a meno della metà della misura iniziale, circa il 42 per cento. Nella mia prova ho usato valori che tornano — da 4 a 1,5 metri, da 30 a 70 gradi — e il soggetto è rimasto quasi della stessa misura.
E infine i secondi. La panoramica a schiaffo dura 0,4 secondi, lo zoom veloce 1,2, ogni spostamento del braccio robotico circa uno, più le brevi soste. Sono i tempi che danno il carattere al movimento: la stessa panoramica, in tre secondi, diventa un’altra cosa.
Un numero rende la richiesta precisa. Anche quando è sbagliato: per questo si controlla.
Come si usa, passo per passo
Il metodo è questo: una foto di partenza, un blocco di movimento con le parentesi riempite, una frase sul soggetto. Ecco come l’ho applicato io, passo per passo.
- Parti da una foto. Nelle mie prove ho sempre animato un’immagine (image-to-video): la scena ce la mette la foto, e al prompt resta soprattutto il movimento. Se ti serve lo stesso volto in più foto di partenza, i modelli recenti ci riescono sempre meglio: ne ho parlato a proposito di Nano Banana 2.1.
- Scegli il movimento in base a cosa vuoi far provare a chi guarda, più avanti trovi una mappa.
- Copia il blocco in inglese. Io ho tenuto tutti i divieti originali: sono la parte che distingue un movimento dai suoi vicini.
- Riempi le parentesi con la tua scena e le tue misure, poi toglile.
- Davanti, una frase sola sul soggetto: cosa fa mentre la macchina si muove. Io l’ho tenuta corta, per lasciare il peso al movimento.
- Per cominciare, un movimento per clip. Due blocchi diversi rischiano di vietarsi a vicenda: ognuno contiene i divieti che escludono l’altro. Alcune voci della raccolta combinano già due movimenti, come il Dolly zoom o l’Helicopter shot: lì l’incastro l’ha già fatto chi le ha scritte.
- Dai al movimento il tempo che gli serve. Per un avvicinamento o un arco attorno al soggetto a me sono bastati tre secondi. Un giro completo attorno al soggetto, il braccio robotico con le sue quattro posizioni o un time-lapse non li ho provati: partirei da cinque secondi e vedrei.
Due avvertenze. La prima: io ho provato solo Kling 3.0, attraverso Higgsfield. I prompt sono testo, quindi puoi incollarli in qualsiasi generatore, ma ogni modello li legge a modo suo, e qualcuno rende meglio con prompt più corti. La seconda riguarda Higgsfield: quando invii una richiesta, a volte la piattaforma ti propone uno dei suoi effetti preconfezionati, i preset, al posto della generazione. A me è successo con quattro richieste su cinque, al primo invio: niente video, nessun credito scalato, e un preset suggerito al posto del mio prompt. Si rifiuta e si rimanda.
Il prompt è scritto. La prova sulla tua immagine resta da fare.
La prova su una persona vera
Una bottega inventata è comoda. Volevo vedere cosa succede con una persona vera, in un formato vero. Me l’ha prestata Giulia, che lavora con me: un fotogramma preso da un suo video verticale, lei seduta a mezzo busto che guarda in camera, davanti a una parete bianca e liscia. Tre movimenti adatti al verticale, tre secondi ciascuno, Kling 3.0.
Stesso fotogramma di partenza, tre prompt del Prompt Bank, Kling 3.0, tre secondi ciascuna.
Il Push in, l’avvicinamento lento, è riuscito. La macchina avanza morbida, senza scatti, e il viso resta il suo: lineamenti, capelli, espressione. Su una parete bianca è il movimento più sicuro, perché si legge tutto sul soggetto che cresce.
L’Arc right, l’arco attorno al soggetto, è riuscito anche lui. Lei resta seduta e ferma, è la macchina che si sposta: in tre secondi passa dal fronte a una vista di tre quarti, e a destra compare lo schienale della sedia bianca. Ho chiesto un arco di 40 gradi invece dei 60 dell’esempio, per limitare la parte di profilo che il modello deve ricostruire da sé.
Il Dolly zoom è il più spettacolare, e funziona. Giulia resta quasi della stessa misura per tutta la clip — cresce di un quinto, più o meno — mentre lo spazio alle sue spalle si apre e scappa indietro. Con una sorpresa grossa: nella foto dietro di lei c’era solo un muro bianco. Allargando lo sfondo, il modello ha dovuto inventare quello che non c’era, e il muro è diventato un corridoio con una porta, uno stipite e una plafoniera sul soffitto. Nessuno di questi elementi esiste nella foto di partenza.
Messe insieme alle due prove sulla bottega, il bilancio è di quattro movimenti su cinque come chiesti e uno no: lo zoom ottico. In queste cinque generazioni Kling ha spostato volentieri la macchina nello spazio — avanti, attorno, indietro — mentre l’unico movimento da fermo, quello in cui cambia solo la focale, non ha rispettato la richiesta. Una generazione per movimento è poco per farne una regola: è un indizio, e lo tengo d’occhio.
Il corridoio inventato merita due righe in più. Per un video di marca, uno sfondo che non esiste è una piccola bugia. Piccola, ma pur sempre una bugia: e sono proprio dettagli come questi che smascherano un video generato, come ho spiegato in come riconoscere un video falso. Prima di pubblicare si guarda lo sfondo, fotogramma per fotogramma.
Quattro su cinque al primo colpo è un buon punto di partenza. Il resto lo fanno le prove successive.
I 46 movimenti, uno per uno
Qui sotto trovi tutte le voci del Prompt Bank con il nome originale, che è quello da cercare sulla pagina, cosa fa la macchina e a cosa serve. I prompt completi, in inglese, li copi da lì.
L’inquadratura fissa (1)
- Static shot — la macchina non si muove di un millimetro dal primo all’ultimo fotogramma; il movimento, dice il prompt, «viene tutto dalla scena, mai dalla macchina». Per chi parla in camera, per un prodotto, per un momento che deve pesare.
Panoramiche e movimenti verticali (8)
- Pan right e Pan left — panoramica orizzontale: la macchina resta ferma e ruota, come una testa che si gira; il nuovo spazio entra dal bordo. Per scoprire un ambiente e arrivare su qualcuno.
- Tilt up e Tilt down — panoramica verticale: la macchina ruota verso l’alto o verso il basso dallo stesso punto. Per rivelare un palazzo, o una persona dai piedi agli occhi.
- Pedestal up e Pedestal down — tutta la macchina sale o scende in linea retta, sempre in bolla, «come la finestra di un ascensore». Per mostrare un banco di lavoro dall’alto, o scendere all’altezza di un bambino.
- Whip pan right e Whip pan left — panoramica a schiaffo: ferma su un’inquadratura, una frustata di 0,4 secondi tutta mossa, atterra sulla seconda con un piccolo rimbalzo. È una transizione: unisce due scene in un colpo solo.
Zoom e messa a fuoco (7)
- Zoom in — zoom ottico lento e uniforme, dal grandangolo al tele, con la macchina ferma. Nella mia prova, come hai visto, Kling l’ha trasformato in un carrello.
- Slow zoom out — lo stesso all’indietro, con la raffica di divieti che hai letto sopra.
- Fast zoom in e Fast zoom out — inquadratura ferma, uno zoom secco di circa 1,2 secondi, di nuovo ferma. Per l’enfasi.
- Crush zoom — è con ogni probabilità un refuso per «crash zoom», lo zoom violento. Attenzione al verso: questo va all’indietro, da 18 a 84 gradi in 0,4 secondi. Se ti serve lo scatto in avanti, parti da Fast zoom in e accorcia i tempi.
- Dolly zoom — il carrello avanza mentre lo zoom arretra, insieme: il soggetto resta della stessa misura e lo sfondo si deforma. Lo inventò Irmin Roberts, operatore della Paramount, per «La donna che visse due volte» di Hitchcock, nel 1958, e per questo si chiama anche effetto Vertigo, dal titolo originale. «Lo squalo», nel 1975, lo usa sul volto del capo della polizia Brody nell’attimo in cui capisce che in spiaggia c’è uno squalo. Si usa per la vertigine, lo smarrimento, l’attimo in cui un personaggio capisce tutto.
- Rack focus — l’inquadratura resta ferma, il fuoco passa da un piano lontano a uno vicino. Sposta l’attenzione senza muovere niente.
Carrelli e inseguimenti (17)
- Dolly in e Dolly out — carrellata in avanti o all’indietro su binari, altezza fissa, zoom vietato. Quello all’indietro insiste perché la macchina non salga mai: il modello tende a trasformarlo in un volo di drone.
- Push in — avvicinamento lento e fluttuante, da 7 a 2 metri nell’esempio, «come un respiro trattenuto». Per la frase importante di un video.
- Push past — avanza, sfiora la spalla del soggetto, lo supera e scopre cosa c’è oltre, mentre il fuoco passa dal soggetto al punto lontano.
- Truck right e Truck left — carrellata laterale: la macchina scivola di lato guardando sempre dritto, e il soggetto attraversa il quadro.
- Slider right e Slider left — la stessa cosa in miniatura: circa 40 centimetri su una slitta, lentissimo. Per i dettagli di un prodotto.
- Tracking e Side tracking — affiancano il soggetto di profilo, a 90 gradi, con tre piani che scorrono a velocità diverse. Le due voci hanno lo stesso identico testo: sono un doppione.
- Low tracking — affianca il soggetto a livello del suolo, al super-rallentatore, con l’aspetto delle riprese a mille fotogrammi al secondo.
- Follow shot — dietro la spalla del soggetto, a 80 centimetri, segue il suo passo.
- Reverse tracking: Walk-and-talk — la macchina indietreggia davanti a chi cammina parlando, alla sua stessa velocità. È il formato di tanti video in cui qualcuno racconta qualcosa mentre passeggia.
- Arc right e Arc left — un arco di circa 60 gradi attorno al soggetto, che resta fermo e girato sempre dalla stessa parte: è la macchina che si muove.
- Chase shot — inseguimento con la macchina a mano, uno scossone a ogni urto.
- Vehicle tracking — la macchina viaggia con il veicolo alla stessa velocità: il mezzo sta fermo nel quadro, la strada corre.
Riprese aeree e con la gru (6)
- Crane up — il braccio della gru sale, da 1,2 a 9 metri, mentre la macchina guarda giù: il mondo si apre attorno al soggetto. Un finale classico.
- Crane down — scende dall’alto fino all’altezza degli occhi. Un’apertura classica.
- Drone orbit — un giro di drone attorno al soggetto, a 8 metri di distanza e 4 di quota, per circa 200 gradi.
- Aerial pullback — il drone arretra e sale, fino a circa 40 metri di distanza e 25 di quota: il soggetto diventa piccolo nel mondo.
- Drone push in — volo radente e veloce verso un obiettivo, poi una cabrata.
- Helicopter shot — un’orbita lenta da lontano con il teleobiettivo, poi uno scatto di zoom su un dettaglio, nella stessa ripresa. Lo stile delle immagini dei telegiornali.
Movimenti speciali (7)
- Handheld — macchina a spalla: tremolio vero, il respiro dell’operatore, inquadrature imperfette che si riprendono sempre.
- POV — la soggettiva: la macchina sono gli occhi di una persona che cammina, a 1,70 metri d’altezza.
- 360 orbit — un giro completo attorno al soggetto, a velocità costante, fino a tornare all’inquadratura di partenza.
- Bullet time — il tempo si ferma, con gocce e detriti sospesi a mezz’aria, mentre la macchina continua a girare a velocità normale. Il nome l’ha reso famoso «Matrix», nel 1999.
- Robot arm — un braccio robotico veloce che passa per quattro posizioni, circa un secondo per ogni spostamento, con brevi pause a ognuna. L’estetica degli spot di prodotto.
- Body-mounted camera: Snorricam — la macchina legata al petto dell’attore, rivolta verso di lui: la persona resta inchiodata al centro e il mondo ondeggia alle sue spalle. Prende il nome da Einar Snorri ed Eiður Snorri, due registi islandesi che firmavano insieme come Snorri Bros senza essere parenti; il loro attrezzo finì in «π», il film di Darren Aronofsky del 1998.
- Timelapse — un lento allontanamento in cui il mondo scorre veloce, dal giorno alla notte alla pioggia, mentre il soggetto si muove a velocità normale. Due tempi nella stessa inquadratura.
Quarantasei voci: movimenti della macchina, cambi della focale, giochi con il tempo. Il vocabolario c’è. Le frasi le scrivi tu.
Quale movimento per quale emozione
Il movimento è una frase senza parole: contribuisce, spesso più di quanto pensi, a cosa prova chi guarda. La pagina di Higgsfield lo dice nel suo sottotitolo — guarda come ogni movimento cambia la sensazione di un’inquadratura — e il cinema ci lavora da sempre.
Queste sono le corrispondenze che uso io, prese dal linguaggio del cinema. Sono convenzioni, e le convenzioni si possono rompere, ma prima conviene conoscerle:
- autorevolezza e calma — Static shot. Chi resta fermo trasmette controllo;
- vicinanza e attenzione — Push in. Il pubblico si sporge in avanti insieme alla macchina;
- rivelazione e disagio — Dolly zoom, che io userei con parsimonia, nel momento che conta;
- energia e cambio di scena — Whip pan, Fast zoom;
- realismo e urgenza — Handheld, Chase shot;
- importanza — Arc e 360 orbit: girare attorno a qualcosa lo mette al centro del mondo;
- chiusura e respiro — Crane up, Aerial pullback: ci si allontana e la storia finisce;
- coinvolgimento — POV, Follow shot: chi guarda smette di guardare e comincia a esserci.
Per i video verticali, quelli di Instagram e TikTok, una nota mia, da prendere come opinione. Nel formato alto partirei dai movimenti verticali — tilt, pedestal, gru — e da quelli che avanzano dentro la scena, come il push in, scegliendo in base alla composizione. Le carrellate di lato e le panoramiche orizzontali possono funzionare anche lì, ma in uno schermo stretto hanno meno spazio per farsi notare.
La macchina si nota poco. Si sente molto di più.
Le trappole che ho trovato
Sei cose da sapere prima di spendere crediti: due le ho trovate leggendo i testi, tre facendo le prove, l’ultima è buon senso.
- Due voci identiche. «Tracking» e «Side tracking» hanno lo stesso testo, parola per parola. Le voci diverse, quindi, sono 45.
- Il Crush zoom va all’indietro. Il nome fa pensare a uno scatto verso il soggetto; il prompt fa il contrario.
- Il preset al posto del prompt, raccontato sopra: si rifiuta e si rimanda.
- Il modello inventa quello che sta fuori dalla foto. Ogni movimento che allarga l’inquadratura — dolly zoom, pullback, gru — costringe il modello a disegnare ciò che non hai fotografato: nella mia prova un muro bianco è diventato un corridoio. Controlla lo sfondo.
- I movimenti da fermo vanno controllati due volte. Nella mia prova lo zoom ottico è diventato uno spostamento della macchina. Lo zoom puoi simularlo in montaggio.
- Tre secondi non bastano per tutto. Un movimento in quattro tappe stretto in tre secondi rischia di diventare una corsa: per quelli complessi partirei da una clip più lunga.
Meglio scoprirle qui che sul conto dei crediti.
Quanto costa provarli
Il costo dipende dal modello, dalla durata e dalla qualità. Con le impostazioni delle mie prove, rilevate su Higgsfield fra il 7 e il 9 ottobre 2026 — Kling 3.0 in qualità standard, audio spento — una clip di 3 secondi costava 4,5 crediti e una di 5 secondi 7,5. La foto della bottega è costata 2 crediti.
Le mie cinque prove, foto della bottega compresa, sono costate 30,5 crediti, copertina esclusa. Quanto valga un credito in euro dipende dal piano che hai, quindi il conto lo fai sul tuo abbonamento.
Il metodo che consiglio è questo: per i movimenti semplici, una variante a tre secondi finché non trovi quello giusto. Solo allora la versione lunga, in qualità più alta. Generare dieci varianti della stessa scena sperando che una vada bene è il modo più rapido per svuotare il credito e imparare poco.
Si spende per imparare. Poi si spende per produrre. Sono due conti diversi.
Come puoi applicarlo al tuo brand
Un brand ha una voce, dei colori, un carattere tipografico. Ha anche un modo di muoversi, anche quando non ci ha mai pensato. Se i tuoi video li genera l’AI senza istruzioni, quel modo lo sceglie il modello, con le sue abitudini, e rinunci a controllarlo. È lo stesso meccanismo che rende identici i siti fatti con l’AI, di cui ho scritto in perché i siti fatti con l’AI sono tutti uguali: chi non decide eredita le scelte di qualcun altro.
Da domani puoi fare tre cose:
- Scegli tre movimenti firma. Uno per aprire, uno per la frase importante, uno per chiudere. Per esempio: Crane down, Push in, Crane up. Sempre quelli, finché non diventano riconoscibili.
- Scrivili una volta sola, con le tue misure. Riempi le parentesi con i tuoi ambienti e i tuoi tempi e salva i tre blocchi in un documento. Da lì in avanti cambi la scena, il movimento resta.
- Prepara bene la foto di partenza. È lei che decide cosa c’è nella scena: se ti serve correggerne un dettaglio prima di animarla, ci sono strumenti pensati per cambiare un pezzo e lasciare il resto, come ho raccontato parlando di FLUX 3. Dopo la modifica controlla anche le parti che volevi conservare.
Prima di pubblicare, guarda tre cose: il movimento, il volto, lo sfondo. Sono le tre che tradiscono un video fatto in fretta.
Domande frequenti
Cosa sono i movimenti di camera?
Sono i modi in cui la macchina da presa si muove durante un’inquadratura: ruota da ferma (panoramica), si sposta su un carrello (carrellata), sale e scende (gru, pedestal), vola (drone) o cambia solo l’obiettivo (zoom). Ognuno produce un effetto diverso su chi guarda.
Che differenza c’è tra zoom e carrello?
Lo zoom cambia la lunghezza focale con la macchina ferma: soggetto e sfondo crescono insieme. Il carrello sposta fisicamente la macchina: gli oggetti vicini scorrono via più in fretta di quelli lontani, e questa parallasse dà la sensazione di entrare nella scena.
Il Prompt Bank di Higgsfield si paga?
La pagina si consulta liberamente e i prompt si copiano con un clic. Si pagano le generazioni: per animare una foto con quei prompt servono i crediti di Higgsfield o di un altro servizio di video AI.
I prompt funzionano anche fuori da Higgsfield?
Sono semplice testo, quindi puoi incollarli in qualsiasi generatore video. Ogni modello però li interpreta a modo suo: io li ho provati solo con Kling 3.0, attraverso Higgsfield, e anche lì uno su cinque non è uscito come scritto.
Devo scrivere i prompt in inglese?
I prompt del Prompt Bank sono in inglese e io ho tenuto il blocco originale in inglese, riempiendo i segnaposto. Tradurli è possibile, ma non l’ho provato: se cambi lingua, rifai le prove prima di fidarti.
Cos’è l’effetto Vertigo?
È il dolly zoom: la macchina avanza su un carrello mentre l’obiettivo zooma all’indietro, così il soggetto resta della stessa misura e lo sfondo si deforma. Fu creato per «La donna che visse due volte» (Vertigo) di Alfred Hitchcock, nel 1958, e si usa per rendere vertigine, smarrimento o una rivelazione improvvisa.
Quanto deve durare una clip con un movimento di camera?
Nelle mie prove, per un avvicinamento, un arco o un carrello sono bastati 3 secondi. Per i movimenti in più tappe, come un giro completo, il braccio robotico o un time-lapse, che non ho provato, partirei da 5 secondi o più.
Quale movimento conviene per un reel verticale?
Io partirei da push in, tilt, pedestal e gru, scegliendo in base alla composizione dell’immagine. Anche i movimenti laterali possono funzionare, ma in un formato stretto hanno meno spazio per farsi notare.