Reference to Video AI: Semua Model, Batasan, dan Harganya
AI reference-to-video menjaga karakter, produk, dan suara Anda tetap konsisten di shot baru. Semua model di Reelina, jumlah referensi yang diterima tiap model, dan harganya.

Image-to-video dimulai dari satu gambar. Reference-to-video berbeda: Anda memberi model beberapa hal untuk dipertahankan — karakter, produk, outfit, tempat, kadang suara — dan model membangun shot baru di sekitarnya. Ini adalah hal yang paling mendekati konsep casting dalam dunia AI video.
Reelina menjalankan 26 model reference-to-video. Perbedaannya bukan pada apa yang mereka janjikan, melainkan pada apa yang mereka terima: berapa banyak gambar, apakah referensi video diperbolehkan, apakah ada suara yang menyertainya, dan seberapa panjang hasilnya bisa dibuat. Panduan ini mendaftar semuanya dari katalog Reelina per Oktober 2026, lengkap dengan harga satu generasi dalam coin pada durasi default masing-masing model.
Cara kerja reference-to-video
Anda mengunggah referensi — biasanya satu gambar per subjek — lalu menulis prompt yang menjelaskan apa yang mereka lakukan. Model tidak dilatih dengan referensi Anda; model hanya membacanya untuk generasi itu saja. Ini membawa dua konsekuensi:
- Konsistensi didapat dari penggunaan referensi yang sama berulang kali. Simpan potret bersih tiap karakter dan gunakan di setiap shot.
- Satu subjek per gambar memberi hasil terbaik. Latar belakang polos dan cahaya yang rata mencegah model ikut menyalin pencahayaan tersebut ke dalam scene.
Model-model, berdasarkan apa yang diterima
| Model | Coin | Referensi | Durasi |
|---|---|---|---|
| PixVerse v6 Reference-to-Video | 38 | Referensi | 1–15 dtk |
| PixVerse c1 Reference-to-Video | 46 | Referensi | 1–15 dtk |
| Wan 3.0 Reference-to-Video | 60 | Referensi | 2–30 dtk |
| Vidu Q3 Reference-to-Video | 64 | Referensi, audio opsional | — |
| Seedance 2.0 Mini Reference-to-Video | 68 | Hingga 9 gambar, 3 video (total 15 dtk), audio referensi | 4–15 dtk |
| Grok Imagine Video Reference-to-Video | 76 | 1–7 gambar (orang, objek, gaya) | — |
| Wan 3.0 Prime Reference-to-Video | 92 | Referensi | 2–30 dtk |
| Vidu Q2 Reference-to-Video | 96 | 1–7 subjek, audio opsional | — |
| Kling Video O3 Std Reference-to-Video | 108 | "Elemen" subjek | 3–15 dtk |
| Seedance 2.0 Fast Reference-to-Video | 110 | Hingga 9 gambar, 3 video, audio referensi | 4–15 dtk |
| MiniMax H3 Fast Reference-to-Video | 112 | Referensi | 5–15 dtk (default 8 dtk) |
| Grok Imagine Video v1.5 Reference-to-Video | 122 | 1–7 gambar | — |
| Vidu Q2-Pro Reference-to-Video | 128 | 1–7 subjek, audio opsional | — |
| Seedance 2.0 Reference-to-Video | 136 | Hingga 9 gambar, 3 video, audio referensi | 4–15 dtk |
| Kling Video O3 Pro Reference-to-Video | 144 | "Elemen" subjek | 3–15 dtk |
| Wan 2.7 Reference-to-Video | 152 | Hingga 3 video — satu per karakter, yang bisa membawa suaranya sendiri | — |
| MiniMax H3 Reference-to-Video | 152 | Referensi | 4–15 dtk (default 8 dtk) |
| Seedance 2.5 Reference-to-Video | 204 | Hingga 30 gambar, 10 video, audio referensi | 4–30 dtk |
| Veo 3.1 Reference-to-Video | 484 | Referensi, audio opsional | 8 dtk |
Juga tersedia di katalog: Vidu Q3-Mix (160), Gemini Omni Flash (204), HappyHorse 1.1 (106) dan 1.0 (212), Vidu Reference-to-Video 2.0 (304), Vidu Q1 (516) dan Vidu Reference-to-Video Q1 (606). Tanda "—" berarti durasi ditetapkan oleh model, bukan dipilih sendiri. Harga berlaku untuk durasi default masing-masing model; klip yang lebih panjang berbiaya lebih tinggi secara proporsional, dan biaya pastinya ditampilkan sebelum Anda melakukan generate.
Model mana yang sebaiknya dipilih
- Cara termurah untuk mencoba ide: PixVerse v6 (38 coin) atau Wan 3.0 (60 coin, hingga 30 detik).
- Sekumpulan karakter plus referensi bergerak: Seedance 2.0 — hingga 9 gambar dan 3 video referensi, dengan audio referensi. Buat draf di Mini (68), lalu finalisasi di model penuh (136).
- Shot panjang dengan banyak referensi: Seedance 2.5 — hingga 30 gambar dan 10 video, klip hingga 30 detik.
- Karakter yang harus mempertahankan suaranya sendiri: Wan 2.7, di mana setiap video referensi mewakili satu karakter dan bisa membawa suaranya sendiri.
- Hingga tujuh subjek berbeda: Vidu Q2 / Q2-Pro atau Grok Imagine Video.
- Pendekatan Kling untuk ini: Kling Video O3, dengan "elemen" subjek.
Gambar referensi untuk gambar, juga ada
Jika yang Anda butuhkan adalah gambar diam, Nano Banana 2 Reference-to-Image (24 coin) dan versi Lite-nya (13 coin) membangun gambar dari referensi, dan keduanya juga menerima klip video sebagai referensi.
Cara melakukannya di Reelina
- Buka Video Studio dan pilih model reference-to-video — misalnya Seedance 2.0 Reference-to-Video atau Seedance 2.5 Reference-to-Video.
- Unggah referensi Anda dan jelaskan shot-nya: siapa melakukan apa, di mana, dan bagaimana kamera bergerak.
- Periksa harga yang ditampilkan pada tombol lalu generate. Simpan referensinya — menggunakannya kembali adalah kunci agar shot berikutnya tetap konsisten.
Untuk satu episode penuh, bukan hanya satu shot, AI drama generator melakukan ini untuk Anda: ia memakai potret referensi untuk setiap karakter dan melanjutkan setiap shot dari frame terakhir shot sebelumnya.
FAQ
Apa itu AI reference-to-video? Model video yang menerima beberapa input referensi — gambar, dan pada beberapa model juga video serta audio — lalu menghasilkan shot baru yang mempertahankan subjek-subjek tersebut, bukan sekadar menganimasikan satu gambar awal.
Berapa banyak gambar referensi yang bisa saya gunakan? Tergantung modelnya: hingga 30 di Seedance 2.5, 9 di Seedance 2.0, 1–7 di Vidu Q2 dan Grok Imagine Video. Wan 2.7 justru menerima hingga 3 video referensi.
Model reference-to-video mana yang paling murah? Di Reelina, PixVerse v6 Reference-to-Video dengan 38 coin per generasi.
Apakah model ini mempelajari wajah saya? Tidak. Referensi hanya dibaca untuk generasi itu saja; tidak ada pelatihan yang terjadi. Konsistensi didapat dari memberikan referensi yang sama di setiap shot.
Apakah saya perlu API key? Tidak. Setiap model berjalan langsung di browser menggunakan saldo coin Reelina Anda. Tidak ada paket gratis.
Try it yourself
Every model on one credit balance, straight in your browser. No install, no watermark.
Start creatingKeep reading
Kling 3.0 vs Veo 3.1: Perbandingan Durasi Klip, Audio, dan BiayaKling 3.0 vs Veo 3.1: klip 3–15 detik vs 4, 6, atau 8 detik, rasio aspek, resolusi, tingkat mana yang menghasilkan suara, dan biaya per detik untuk setiap varian.
Seedance 2.0 vs Kling 3.0: Spesifikasi, Harga, dan Kapan Memakai Masing-masingSeedance 2.0 dan Kling 3.0 sama-sama bisa text-to-video, image-to-video, dan menghasilkan suara bersama gambarnya. Perbandingan ini memetakan tingkatan, pengaturan, fitur andalan, dan biaya per detik dalam koin di Reelina.
Seedance vs Seedream: Model ByteDance Mana yang Anda Butuhkan?Seedance membuat video, Seedream membuat gambar — keduanya dari ByteDance. Bandingkan varian, ukuran, audio, dan harga coin, serta cara menggabungkan keduanya.
