Referensi Serbaguna ke Video: AI dari Gambar, Klip & Audio
Gabungkan gambar referensi, klip video, dan audio dengan prompt untuk membuat satu video AI. Area unggahan hanya menampilkan yang didukung model pilihan.
Model yang didukung: Seedance 2.5 · Seedance 2.0 · Seedance 2.0 Fast · Seedance 2.0 Mini · MiniMax H3 · Wan 3.0 · Wan 3.0 Prime · Kling v3 · Kling v3 Omni · Veo 3 · Veo 3.1 Fast · Gemini Omni Flash · Grok Video 1.5 · Grok Video 1.0 · Wan 2.6 · Wan 2.6 Flash · HappyHorse 1.0 · HappyHorse 1.1
Apa itu referensi serbaguna ke video?
Referensi serbaguna ke video membuat satu video AI dari prompt teks ditambah campuran referensi: gambar untuk karakter dan gaya, klip video untuk gerakan, dan audio untuk ritme atau suara. Teks ke video berangkat dari kata-kata dan gambar ke video menghidupkan satu gambar, sedangkan referensi ke video memungkinkan Anda mengarahkan beberapa aspek hasil sekaligus.
Setiap model menerima referensi yang berbeda. Wan 3.0 menerima hingga 21 referensi dari gambar, klip, dan audio; MiniMax H3 hingga 9 gambar, 3 klip video, dan 3 file audio; HappyHorse 1.0 hingga 9 gambar referensi. Area unggahan menyesuaikan otomatis dan hanya menampilkan slot yang bisa dipakai model pilihan.
Yang bisa Anda lakukan dengan referensi ke video
Karakter konsisten
Jaga wajah, pakaian, dan properti tetap sama di berbagai shot dengan mereferensikan gambar karakter.
Meniru gerakan dari klip
Gunakan video referensi untuk mengarahkan gerakan, koreografi, atau kerja kamera.
Visual yang mengikuti musik
Tambahkan referensi audio agar tempo dan suasana mengikuti lagu.
Video produk dari aset nyata
Gabungkan foto produk dengan referensi adegan pemakaian untuk iklan yang sesuai merek.
Transfer gaya ke video
Terapkan tampilan karya seni atau gambar merek ke adegan baru.
Dari storyboard ke shot akhir
Ubah frame storyboard dan klip kasar menjadi rangkaian yang jadi.
Model AI untuk referensi ke video
Batas referensi berbeda di tiap model. Kolom Output menampilkan rentang resolusi dan durasi klip.
| Model | Paling cocok untuk | Output |
|---|---|---|
| Wan 3.0 | Kombinasi paling luas: hingga 21 referensi gambar, video, dan audio, klip hingga 30 detik | 480p–1080p · 2–30s |
| MiniMax H3 | Gambar, klip, dan audio sekaligus: hingga 9 gambar, 3 klip, dan 3 file audio | 480p–4K · 4–15s |
| HappyHorse 1.0 | Referensi karakter dengan hingga 9 gambar | 720p–1080p · 3–15s |
| Veo 3.1 Fast | Hingga 3 gambar referensi dengan audio yang dihasilkan | 720p–4K · 4–8s |
| Wan 2.6 | Klip video referensi yang mengarahkan gerakan | 720p–1080p · 5–10s |
Cara membuat video dari referensi
- 1
Pilih model
Pilih model video. Slot referensi berubah sesuai gambar, klip, dan audio yang diterima model tersebut.
- 2
Tambahkan referensi dan prompt
Unggah referensi, lalu jelaskan bagaimana masing-masing membentuk video. Jika didukung, ketik @ untuk menyebut gambar yang sudah ditambahkan di prompt.
- 3
Buat dan unduh
Periksa perkiraan kredit, buat, lalu unduh video yang sudah jadi dari riwayat.
Tips bekerja dengan referensi
- Beri setiap referensi tugas di prompt, misalnya: gambar 1 untuk karakter dan klip untuk gerakan tari.
- Gunakan referensi yang bersih: potret tampak depan atau lembar karakter lebih efektif daripada foto grup yang ramai.
- Buat klip referensi singkat dan fokus pada satu gerakan yang ingin ditiru.
- Gunakan referensi audio untuk tempo dan suasana, lalu jelaskan visual yang diinginkan di prompt.
- Mulai dengan sedikit referensi, lalu tambah setelah hasil dasarnya sudah pas.
Gunakan gambar 1 sebagai tokoh utama dan klip referensi untuk gerakan tari; atap gedung bercahaya neon di malam hari, kamera handheld, video vertikal
Coba alat AI lainnya
- AI Gambar ke VideoHidupkan foto dengan AI gambar ke video. Unggah gambar, jelaskan gerakannya, lalu buat dengan Wan 3.0 Prime, Kling v3, HappyHorse, atau Veo 3.1 Fast.
- AI Teks ke VideoBuat video AI dari teks. Bandingkan MiniMax H3, Wan 3.0, Kling v3, dan Veo 3.1 Fast, atur durasi dan resolusi, lalu lihat kredit sebelum membuat.
- Editor Video AIEdit video online dengan AI: ubah gaya, koreksi warna, dan remix klip dalam hitungan menit tanpa perlu memasang software.
Pertanyaan yang sering diajukan
- Apa itu referensi serbaguna ke video?
- Fitur ini membuat satu video AI dari prompt teks ditambah gambar referensi, klip video, dan audio, sehingga karakter, gerakan, dan suasana lebih terkendali dibanding hanya teks atau satu gambar.
- Apa bedanya dengan gambar ke video?
- Gambar ke video menghidupkan satu gambar dan hanya menerima gambar. Referensi ke video menggabungkan beberapa referensi, seperti gambar, klip, dan audio, untuk mengarahkan adegan baru.
- Referensi apa saja yang bisa ditambahkan, dan berapa banyak?
- Tergantung model. Wan 3.0 menerima total hingga 21 referensi, MiniMax H3 hingga 9 gambar, 3 klip video, dan 3 file audio, dan HappyHorse 1.0 hingga 9 gambar. Area unggahan hanya menampilkan yang didukung model pilihan.
- Format file apa yang didukung?
- Gambar dalam format umum seperti JPG, PNG, dan WebP, klip video MP4, MOV, atau M4V, serta file audio seperti MP3.
- Berapa kreditnya?
- Biaya tergantung model, resolusi, dan durasi; pada beberapa model, durasi klip referensi ikut dihitung dalam durasi yang ditagih. Perkiraannya ditampilkan sebelum membuat.
- Berapa lama proses pembuatannya?
- Biasanya kurang dari satu menit hingga beberapa menit, tergantung model, referensi, dan durasi. Proses berjalan di latar belakang sehingga riwayat bisa dicek nanti.
- Apakah video memiliki watermark?
- Unduhan tanpa watermark sudah termasuk dalam paket berbayar. Lihat halaman harga untuk mengetahui isi setiap paket.
- Bisakah karakter yang sama dipakai di beberapa video?
- Bisa. Gunakan gambar karakter yang sama sebagai referensi di setiap pembuatan dan jelaskan karakter dengan cara yang sama di prompt.