Reference-to-Video AI: elk model, de limieten en de prijs
Reference-to-video AI behoudt je personages, producten en stemmen in een nieuwe shot. Alle modellen op Reelina, hoeveel referenties elk model accepteert en wat het kost.

Image-to-video begint met één foto. Reference-to-video werkt anders: je geeft het model meerdere dingen om te behouden — een personage, een product, een outfit, een locatie, soms een stem — en het bouwt daar een nieuwe shot omheen. Het is wat AI-video het dichtst benadert bij casting.
Reelina draait 26 reference-to-video-modellen. Ze verschillen minder in wat ze beloven dan in wat ze accepteren: hoeveel afbeeldingen, of een referentievideo is toegestaan, of er geluid bij komt en hoe lang het resultaat mag zijn. Deze gids vermeldt ze uit de Reelina-catalogus van oktober 2026, met de prijs van één generatie in coins bij de standaardlengte van elk model.
Hoe reference-to-video werkt
Je uploadt referenties — meestal één afbeelding per onderwerp — en schrijft een prompt die beschrijft wat ze doen. Het model wordt niet getraind op je referenties; het leest ze alleen voor die ene generatie. Dat heeft twee gevolgen:
- Consistentie ontstaat door steeds dezelfde referenties te gebruiken. Houd een duidelijk portret van elk personage bij en gebruik dat bij elke shot.
- Eén onderwerp per afbeelding werkt het best. Een neutrale achtergrond en gelijkmatig licht voorkomen dat het model de belichting overneemt in de scene.
De modellen, ingedeeld naar wat ze accepteren
| Model | Coins | Referenties | Lengte |
|---|---|---|---|
| PixVerse v6 Reference-to-Video | 38 | Referenties | 1–15 s |
| PixVerse c1 Reference-to-Video | 46 | Referenties | 1–15 s |
| Wan 3.0 Reference-to-Video | 60 | Referenties | 2–30 s |
| Vidu Q3 Reference-to-Video | 64 | Referenties, optionele audio | — |
| Seedance 2.0 Mini Reference-to-Video | 68 | Tot 9 afbeeldingen, 3 video's (totaal 15 s), referentieaudio | 4–15 s |
| Grok Imagine Video Reference-to-Video | 76 | 1–7 afbeeldingen (personen, objecten, stijlen) | — |
| Wan 3.0 Prime Reference-to-Video | 92 | Referenties | 2–30 s |
| Vidu Q2 Reference-to-Video | 96 | 1–7 onderwerpen, optionele audio | — |
| Kling Video O3 Std Reference-to-Video | 108 | Onderwerp-"elementen" | 3–15 s |
| Seedance 2.0 Fast Reference-to-Video | 110 | Tot 9 afbeeldingen, 3 video's, referentieaudio | 4–15 s |
| MiniMax H3 Fast Reference-to-Video | 112 | Referenties | 5–15 s (standaard 8 s) |
| Grok Imagine Video v1.5 Reference-to-Video | 122 | 1–7 afbeeldingen | — |
| Vidu Q2-Pro Reference-to-Video | 128 | 1–7 onderwerpen, optionele audio | — |
| Seedance 2.0 Reference-to-Video | 136 | Tot 9 afbeeldingen, 3 video's, referentieaudio | 4–15 s |
| Kling Video O3 Pro Reference-to-Video | 144 | Onderwerp-"elementen" | 3–15 s |
| Wan 2.7 Reference-to-Video | 152 | Tot 3 video's — één per personage, die ook de stem kan bevatten | — |
| MiniMax H3 Reference-to-Video | 152 | Referenties | 4–15 s (standaard 8 s) |
| Seedance 2.5 Reference-to-Video | 204 | Tot 30 afbeeldingen, 10 video's, referentieaudio | 4–30 s |
| Veo 3.1 Reference-to-Video | 484 | Referenties, optionele audio | 8 s |
Ook in de catalogus: Vidu Q3-Mix (160), Gemini Omni Flash (204), HappyHorse 1.1 (106) en 1.0 (212), Vidu Reference-to-Video 2.0 (304), Vidu Q1 (516) en Vidu Reference-to-Video Q1 (606). "—" betekent dat de lengte door het model vastligt in plaats van gekozen wordt. De prijzen gelden voor de standaardlengte van elk model; langere clips kosten proportioneel meer, en de exacte kosten worden getoond voordat je genereert.
Welk model je kiest
- Goedkoopste manier om het idee uit te proberen: PixVerse v6 (38 coins) of Wan 3.0 (60 coins, tot 30 seconden).
- Een cast aan personages plus een bewegende referentie: Seedance 2.0 — tot 9 afbeeldingen en 3 referentievideo's, met referentieaudio. Maak een eerste versie met Mini (68) en werk die af met het volledige model (136).
- Lange shots met veel referenties: Seedance 2.5 — tot 30 afbeeldingen en 10 video's, clips tot 30 seconden.
- Personages die hun eigen stem moeten behouden: Wan 2.7, waarbij elke referentievideo één personage is en de stem kan bevatten.
- Tot zeven afzonderlijke onderwerpen: Vidu Q2 / Q2-Pro of Grok Imagine Video.
- De aanpak van Kling: Kling Video O3, met onderwerp-"elementen".
Ook referentieafbeeldingen voor afbeeldingen
Als je alleen een stilstaand beeld nodig hebt, bouwen Nano Banana 2 Reference-to-Image (24 coins) en de bijbehorende Lite-versie (13 coins) een afbeelding op basis van referenties, en beide accepteren ook een videoclip als referentie.
Zo doe je dit op Reelina
- Open de Video Studio en kies een reference-to-video-model — bijvoorbeeld Seedance 2.0 Reference-to-Video of Seedance 2.5 Reference-to-Video.
- Upload je referenties en beschrijf de shot: wie doet wat, waar, en hoe de camera beweegt.
- Controleer de prijs die op de knop wordt getoond en genereer. Bewaar de referenties — door ze opnieuw te gebruiken blijft de volgende shot consistent.
Voor een hele aflevering in plaats van één shot regelt de AI-dramagenerator dit voor je: hij cast elk personage als referentieportret en laat elke shot verdergaan vanaf het laatste frame van de vorige.
FAQ
Wat is reference-to-video AI? Een videomodel dat meerdere referentie-inputs gebruikt — afbeeldingen, en bij sommige modellen video's en audio — en een nieuwe shot genereert waarin die onderwerpen behouden blijven, in plaats van één startafbeelding te animeren.
Hoeveel referentieafbeeldingen kan ik gebruiken? Dat hangt af van het model: tot 30 bij Seedance 2.5, 9 bij Seedance 2.0, 1–7 bij Vidu Q2 en Grok Imagine Video. Wan 2.7 werkt in plaats daarvan met tot 3 referentievideo's.
Welk reference-to-video-model is het goedkoopst? Op Reelina is dat PixVerse v6 Reference-to-Video, voor 38 coins per generatie.
Leert het model mijn gezicht? Nee. Referenties worden alleen gelezen voor die ene generatie; er wordt niets getraind. Consistentie ontstaat door steeds dezelfde referenties aan elke shot te geven.
Heb ik een API-key nodig? Nee. Elk model draait in de browser op één Reelina-coinsaldo. Er is geen gratis laag.
Try it yourself
Every model on one credit balance, straight in your browser. No install, no watermark.
Start creatingKeep reading
Kling 3.0 vs Veo 3.1: cliplengte, audio en kosten vergelekenKling 3.0 vs Veo 3.1: clips van 3–15 s versus 4, 6 of 8 s, beeldverhoudingen, resoluties, welke tiers geluid maken, en de kosten per seconde van elke variant.
Seedance 2.0 vs Kling 3.0: Specs, Prijzen en Wanneer Je Welke GebruiktSeedance 2.0 vs Kling 3.0: tiers, cliplengte, beeldverhoudingen, audio, reference-to-video versus multi-shot en motion control, en kosten per seconde in coins.
Seedance vs Seedream: Welk ByteDance-model heb je nodig?Seedance maakt video, Seedream maakt afbeeldingen — allebei van ByteDance. Varianten, formaten, audio en coinprijzen naast elkaar, en hoe je ze samen gebruikt.
