Referensi Serbaguna ke Video: AI dari Gambar, Klip & Audio

Gabungkan gambar referensi, klip video, dan audio dengan prompt untuk membuat satu video AI. Area unggahan hanya menampilkan yang didukung model pilihan.

Model yang didukung: Seedance 2.5 · Seedance 2.0 · Seedance 2.0 Fast · Seedance 2.0 Mini · MiniMax H3 · Wan 3.0 · Wan 3.0 Prime · Kling v3 · Kling v3 Omni · Veo 3 · Veo 3.1 Fast · Gemini Omni Flash · Grok Video 1.5 · Grok Video 1.0 · Wan 2.6 · Wan 2.6 Flash · HappyHorse 1.0 · HappyHorse 1.1

Apa itu referensi serbaguna ke video?

Referensi serbaguna ke video membuat satu video AI dari prompt teks ditambah campuran referensi: gambar untuk karakter dan gaya, klip video untuk gerakan, dan audio untuk ritme atau suara. Teks ke video berangkat dari kata-kata dan gambar ke video menghidupkan satu gambar, sedangkan referensi ke video memungkinkan Anda mengarahkan beberapa aspek hasil sekaligus.

Setiap model menerima referensi yang berbeda. Wan 3.0 menerima hingga 21 referensi dari gambar, klip, dan audio; MiniMax H3 hingga 9 gambar, 3 klip video, dan 3 file audio; HappyHorse 1.0 hingga 9 gambar referensi. Area unggahan menyesuaikan otomatis dan hanya menampilkan slot yang bisa dipakai model pilihan.

Yang bisa Anda lakukan dengan referensi ke video

  • Karakter konsisten

    Jaga wajah, pakaian, dan properti tetap sama di berbagai shot dengan mereferensikan gambar karakter.

  • Meniru gerakan dari klip

    Gunakan video referensi untuk mengarahkan gerakan, koreografi, atau kerja kamera.

  • Visual yang mengikuti musik

    Tambahkan referensi audio agar tempo dan suasana mengikuti lagu.

  • Video produk dari aset nyata

    Gabungkan foto produk dengan referensi adegan pemakaian untuk iklan yang sesuai merek.

  • Transfer gaya ke video

    Terapkan tampilan karya seni atau gambar merek ke adegan baru.

  • Dari storyboard ke shot akhir

    Ubah frame storyboard dan klip kasar menjadi rangkaian yang jadi.

Model AI untuk referensi ke video

Batas referensi berbeda di tiap model. Kolom Output menampilkan rentang resolusi dan durasi klip.

ModelPaling cocok untukOutput
Wan 3.0Kombinasi paling luas: hingga 21 referensi gambar, video, dan audio, klip hingga 30 detik480p–1080p · 2–30s
MiniMax H3Gambar, klip, dan audio sekaligus: hingga 9 gambar, 3 klip, dan 3 file audio480p–4K · 4–15s
HappyHorse 1.0Referensi karakter dengan hingga 9 gambar720p–1080p · 3–15s
Veo 3.1 FastHingga 3 gambar referensi dengan audio yang dihasilkan720p–4K · 4–8s
Wan 2.6Klip video referensi yang mengarahkan gerakan720p–1080p · 5–10s

Cara membuat video dari referensi

  1. 1

    Pilih model

    Pilih model video. Slot referensi berubah sesuai gambar, klip, dan audio yang diterima model tersebut.

  2. 2

    Tambahkan referensi dan prompt

    Unggah referensi, lalu jelaskan bagaimana masing-masing membentuk video. Jika didukung, ketik @ untuk menyebut gambar yang sudah ditambahkan di prompt.

  3. 3

    Buat dan unduh

    Periksa perkiraan kredit, buat, lalu unduh video yang sudah jadi dari riwayat.

Tips bekerja dengan referensi

  1. Beri setiap referensi tugas di prompt, misalnya: gambar 1 untuk karakter dan klip untuk gerakan tari.
  2. Gunakan referensi yang bersih: potret tampak depan atau lembar karakter lebih efektif daripada foto grup yang ramai.
  3. Buat klip referensi singkat dan fokus pada satu gerakan yang ingin ditiru.
  4. Gunakan referensi audio untuk tempo dan suasana, lalu jelaskan visual yang diinginkan di prompt.
  5. Mulai dengan sedikit referensi, lalu tambah setelah hasil dasarnya sudah pas.
Prompt
Gunakan gambar 1 sebagai tokoh utama dan klip referensi untuk gerakan tari; atap gedung bercahaya neon di malam hari, kamera handheld, video vertikal

Pertanyaan yang sering diajukan

Apa itu referensi serbaguna ke video?
Fitur ini membuat satu video AI dari prompt teks ditambah gambar referensi, klip video, dan audio, sehingga karakter, gerakan, dan suasana lebih terkendali dibanding hanya teks atau satu gambar.
Apa bedanya dengan gambar ke video?
Gambar ke video menghidupkan satu gambar dan hanya menerima gambar. Referensi ke video menggabungkan beberapa referensi, seperti gambar, klip, dan audio, untuk mengarahkan adegan baru.
Referensi apa saja yang bisa ditambahkan, dan berapa banyak?
Tergantung model. Wan 3.0 menerima total hingga 21 referensi, MiniMax H3 hingga 9 gambar, 3 klip video, dan 3 file audio, dan HappyHorse 1.0 hingga 9 gambar. Area unggahan hanya menampilkan yang didukung model pilihan.
Format file apa yang didukung?
Gambar dalam format umum seperti JPG, PNG, dan WebP, klip video MP4, MOV, atau M4V, serta file audio seperti MP3.
Berapa kreditnya?
Biaya tergantung model, resolusi, dan durasi; pada beberapa model, durasi klip referensi ikut dihitung dalam durasi yang ditagih. Perkiraannya ditampilkan sebelum membuat.
Berapa lama proses pembuatannya?
Biasanya kurang dari satu menit hingga beberapa menit, tergantung model, referensi, dan durasi. Proses berjalan di latar belakang sehingga riwayat bisa dicek nanti.
Apakah video memiliki watermark?
Unduhan tanpa watermark sudah termasuk dalam paket berbayar. Lihat halaman harga untuk mengetahui isi setiap paket.
Bisakah karakter yang sama dipakai di beberapa video?
Bisa. Gunakan gambar karakter yang sama sebagai referensi di setiap pembuatan dan jelaskan karakter dengan cara yang sama di prompt.