Universal-Referenz zu Video: KI aus Bildern, Clips & Audio

Kombiniere Referenzbilder, Videoclips und Audio mit einem Prompt zu einem KI-Video. Der Upload-Bereich zeigt nur, was das gewählte Modell unterstützt.

Unterstützte Modelle: Seedance 2.5 · Seedance 2.0 · Seedance 2.0 Fast · Seedance 2.0 Mini · MiniMax H3 · Wan 3.0 · Wan 3.0 Prime · Kling v3 · Kling v3 Omni · Veo 3 · Veo 3.1 Fast · Gemini Omni Flash · Grok Video 1.5 · Grok Video 1.0 · Wan 2.6 · Wan 2.6 Flash · HappyHorse 1.0 · HappyHorse 1.1

Was ist Universal-Referenz zu Video?

Universal-Referenz zu Video erstellt ein KI-Video aus einem Text-Prompt und einer Mischung von Referenzen: Bilder für Figuren und Stil, Videoclips für Bewegung und Audio für Rhythmus oder Stimme. Text zu Video startet mit Worten, Bild zu Video animiert ein einzelnes Bild – Referenz zu Video steuert mehrere Aspekte des Ergebnisses gleichzeitig.

Jedes Modell akzeptiert andere Referenzen. Wan 3.0 nimmt bis zu 21 Referenzen aus Bildern, Clips und Audio, MiniMax H3 bis zu 9 Bilder, 3 Videoclips und 3 Audiodateien, HappyHorse 1.0 bis zu 9 Referenzbilder. Der Upload-Bereich passt sich automatisch an und zeigt nur die Felder, die das gewählte Modell nutzen kann.

Was du mit Referenz zu Video machen kannst

  • Konsistente Figuren

    Behalte Gesicht, Kleidung und Requisiten über mehrere Einstellungen, indem du Figurenbilder referenzierst.

  • Bewegung aus einem Clip übernehmen

    Nutze ein Referenzvideo, um Bewegung, Choreografie oder Kameraführung vorzugeben.

  • Musikgesteuerte Visuals

    Füge eine Audioreferenz hinzu, damit Tempo und Stimmung dem Track folgen.

  • Produktvideos aus echtem Material

    Kombiniere Produktfotos mit einer Lifestyle-Szenenreferenz für markengerechte Anzeigen.

  • Stilübertragung auf Video

    Übertrage den Look eines Kunstwerks oder Markenbildes auf eine neue Szene.

  • Vom Storyboard zur fertigen Einstellung

    Mach aus Storyboard-Bildern und einem Rohclip eine fertige Sequenz.

KI-Modelle für Referenz zu Video

Die Referenzlimits unterscheiden sich je Modell. Die Spalte Ausgabe zeigt Auflösungsbereich und Cliplängen.

ModellIdeal fürAusgabe
Wan 3.0Die größte Auswahl: bis zu 21 Bild-, Video- und Audioreferenzen, Clips bis 30 Sekunden480p–1080p · 2–30s
MiniMax H3Bilder, Clips und Audio zusammen: bis zu 9 Bilder, 3 Clips und 3 Audiodateien480p–4K · 4–15s
HappyHorse 1.0Figurenreferenzen mit bis zu 9 Bildern720p–1080p · 3–15s
Veo 3.1 FastBis zu 3 Referenzbilder mit generiertem Audio720p–4K · 4–8s
Wan 2.6Referenz-Videoclips, die die Bewegung vorgeben720p–1080p · 5–10s

So erstellst du ein Video aus Referenzen

  1. 1

    Modell wählen

    Wähle ein Videomodell. Die Referenzfelder wechseln zu den Bildern, Clips und Audiodateien, die dieses Modell akzeptiert.

  2. 2

    Referenzen und Prompt hinzufügen

    Lade deine Referenzen hoch und beschreibe, wie jede das Video prägen soll. Wo unterstützt, tippe @, um ein hinzugefügtes Bild im Prompt zu erwähnen.

  3. 3

    Generieren und herunterladen

    Prüfe die geschätzten Credits, generiere und lade das fertige Video aus deinem Verlauf herunter.

Tipps für die Arbeit mit Referenzen

  1. Gib jeder Referenz im Prompt eine Aufgabe, zum Beispiel: Bild 1 für die Figur, den Clip für die Tanzschritte.
  2. Nutze saubere Referenzen: Ein frontales Porträt oder Figurenblatt funktioniert besser als ein unruhiges Gruppenfoto.
  3. Halte Referenzclips kurz und konzentriert auf die eine Bewegung, die du übernehmen willst.
  4. Nutze Audioreferenzen für Tempo und Stimmung und beschreibe die gewünschten Bilder im Prompt.
  5. Starte mit wenigen Referenzen und füge weitere hinzu, sobald das Grundergebnis stimmt.
Prompt
Bild 1 als Hauptfigur und den Referenzclip für die Tanzschritte verwenden; neonbeleuchtete Dachterrasse bei Nacht, Handkamera, Hochformat-Video

Häufig gestellte Fragen

Was ist Universal-Referenz zu Video?
Es erstellt ein KI-Video aus einem Text-Prompt plus Referenzbildern, Videoclips und Audio und gibt dir mehr Kontrolle über Figuren, Bewegung und Stimmung als Text oder ein einzelnes Bild.
Worin unterscheidet es sich von Bild zu Video?
Bild zu Video animiert ein einzelnes Bild und akzeptiert nur Bilder. Referenz zu Video kombiniert mehrere Referenzen – Bilder, Clips und Audio –, um eine neue Szene zu steuern.
Welche Referenzen kann ich hinzufügen und wie viele?
Das hängt vom Modell ab. Wan 3.0 akzeptiert insgesamt bis zu 21 Referenzen, MiniMax H3 bis zu 9 Bilder, 3 Videoclips und 3 Audiodateien, HappyHorse 1.0 bis zu 9 Bilder. Der Upload-Bereich zeigt nur, was das gewählte Modell unterstützt.
Welche Dateiformate werden unterstützt?
Bilder in gängigen Formaten wie JPG, PNG und WebP, Videoclips als MP4, MOV oder M4V und Audiodateien wie MP3.
Wie viele Credits kostet es?
Die Kosten hängen von Modell, Auflösung und Länge ab; bei manchen Modellen zählt die Länge der Referenzclips zur abgerechneten Dauer. Die Schätzung wird vor dem Generieren angezeigt.
Wie lange dauert die Generierung?
Meist weniger als eine Minute bis einige Minuten, je nach Modell, Referenzen und Länge. Sie läuft im Hintergrund, du kannst später im Verlauf nachsehen.
Haben die Videos ein Wasserzeichen?
Downloads ohne Wasserzeichen sind in den kostenpflichtigen Tarifen enthalten. Was jeder Tarif umfasst, steht auf der Preisseite.
Kann ich dieselbe Figur in mehreren Videos behalten?
Ja. Verwende in jeder Generierung dieselben Figurenbilder als Referenz und beschreibe die Figur in deinen Prompts einheitlich.