Video da riferimento universale: AI da immagini, clip e audio

Combina immagini di riferimento, clip video e audio con un prompt per generare un video AI. L'area di caricamento mostra solo ciò che il modello scelto supporta.

Modelli supportati: Seedance 2.5 · Seedance 2.0 · Seedance 2.0 Fast · Seedance 2.0 Mini · MiniMax H3 · Wan 3.0 · Wan 3.0 Prime · Kling v3 · Kling v3 Omni · Veo 3 · Veo 3.1 Fast · Gemini Omni Flash · Grok Video 1.5 · Grok Video 1.0 · Wan 2.6 · Wan 2.6 Flash · HappyHorse 1.0 · HappyHorse 1.1

Cos'è il video da riferimento universale?

Il video da riferimento universale genera un video AI da un prompt di testo e da un mix di riferimenti: immagini per personaggi e stile, clip video per il movimento e audio per ritmo o voce. Il testo in video parte dalle parole e l'immagine in video anima una sola immagine; il video da riferimento ti permette di controllare più aspetti del risultato insieme.

Ogni modello accetta riferimenti diversi. Wan 3.0 prende fino a 21 riferimenti tra immagini, clip e audio; MiniMax H3 accetta fino a 9 immagini, 3 clip video e 3 file audio; HappyHorse 1.0 usa fino a 9 immagini di riferimento. L'area di caricamento si adatta automaticamente e mostra solo gli spazi che il modello scelto può usare.

Cosa puoi fare con il video da riferimento

  • Personaggi coerenti

    Mantieni lo stesso volto, abito e accessori in più inquadrature usando immagini del personaggio come riferimento.

  • Copiare il movimento di una clip

    Usa un video di riferimento per guidare movimento, coreografia o lavoro di camera.

  • Visual guidati dalla musica

    Aggiungi un riferimento audio perché ritmo e atmosfera seguano il brano.

  • Video prodotto da materiale reale

    Combina foto prodotto con un riferimento di scena d'uso per annunci coerenti con il brand.

  • Trasferimento di stile al video

    Applica il look di un'opera o di un'immagine di brand a una nuova scena.

  • Dallo storyboard all'inquadratura finale

    Trasforma tavole di storyboard e una clip grezza in una sequenza finita.

Modelli AI per il video da riferimento

I limiti dei riferimenti variano in base al modello. La colonna Output mostra la gamma di risoluzione e la durata delle clip.

ModelloIdeale perOutput
Wan 3.0Il mix più ampio: fino a 21 riferimenti di immagini, video e audio, clip fino a 30 secondi480p–1080p · 2–30s
MiniMax H3Immagini, clip e audio insieme: fino a 9 immagini, 3 clip e 3 file audio480p–4K · 4–15s
HappyHorse 1.0Riferimenti di personaggio con fino a 9 immagini720p–1080p · 3–15s
Veo 3.1 FastFino a 3 immagini di riferimento con audio generato720p–4K · 4–8s
Wan 2.6Clip video di riferimento che guidano il movimento720p–1080p · 5–10s

Come creare un video dai riferimenti

  1. 1

    Scegli un modello

    Seleziona un modello video. Gli spazi di riferimento si adattano alle immagini, clip e audio che quel modello accetta.

  2. 2

    Aggiungi riferimenti e prompt

    Carica i riferimenti e descrivi come ognuno deve influenzare il video. Se il modello lo consente, digita @ per citare un'immagine aggiunta nel prompt.

  3. 3

    Genera e scarica

    Controlla i crediti stimati, genera e scarica il video finito dalla cronologia.

Consigli per lavorare con i riferimenti

  1. Dai a ogni riferimento un compito nel prompt, per esempio: usa l'immagine 1 per il personaggio e la clip per i passi di danza.
  2. Usa riferimenti puliti: un ritratto frontale o una scheda personaggio funziona meglio di una foto di gruppo affollata.
  3. Mantieni le clip di riferimento brevi e concentrate sull'unico movimento da riprodurre.
  4. Usa i riferimenti audio per ritmo e atmosfera e descrivi nel prompt le immagini che vuoi.
  5. Inizia con pochi riferimenti e aggiungine altri quando il risultato di base funziona.
Prompt
Usa l'immagine 1 come protagonista e la clip di riferimento per i passi di danza; terrazza illuminata al neon di notte, camera a mano, video verticale

Domande frequenti

Cos'è il video da riferimento universale?
Genera un video AI da un prompt di testo più riferimenti di immagini, clip video e audio, dandoti più controllo su personaggi, movimento e atmosfera rispetto al solo testo o a una sola immagine.
In cosa differisce da immagine in video?
L'immagine in video anima una sola immagine e accetta solo immagini. Il video da riferimento combina più riferimenti, come immagini, clip e audio, per guidare una nuova scena.
Quali riferimenti posso aggiungere e quanti?
Dipende dal modello. Wan 3.0 accetta fino a 21 riferimenti in totale, MiniMax H3 fino a 9 immagini, 3 clip video e 3 file audio, HappyHorse 1.0 fino a 9 immagini. L'area di caricamento mostra solo ciò che il modello scelto supporta.
Quali formati di file sono supportati?
Immagini in formati comuni come JPG, PNG e WebP, clip video in MP4, MOV o M4V e file audio come MP3.
Quanti crediti costa?
Il costo dipende da modello, risoluzione e durata; su alcuni modelli la durata delle clip di riferimento si aggiunge alla durata fatturata. La stima compare prima di generare.
Quanto tempo richiede la generazione?
In genere da meno di un minuto a diversi minuti, in base a modello, riferimenti e durata. Avviene in background, così puoi controllare la cronologia più tardi.
I video hanno la filigrana?
I download senza filigrana sono inclusi nei piani a pagamento. Consulta la pagina dei prezzi per vedere cosa include ogni piano.
Posso mantenere lo stesso personaggio in più video?
Sì. Riutilizza le stesse immagini del personaggio come riferimento in ogni generazione e descrivi il personaggio sempre allo stesso modo nei prompt.