HET KORTE ANTWOORD
DE KORTE VERSIE
- Een pilot is gepaard: dezelfde bronclips gaan door de huidige workflow en door de kandidaat, in twee of drie doeltalen.
- De acceptatiecriteria liggen vast voordat iemand luistert: één norm per dimensie, zes gemeten dimensies plus twee operationele rijen.
- Native reviewers beoordelen blind waar het format dat toelaat en markeren de seconde waarop ze eruit vielen.
- De controlestap telt de correcties: hoeveel vertaalde regels de reviewer vóór het renderen heeft gewijzigd, en van welke klasse.
- Twee operationele meetwaarden rijden mee naast kwaliteit: revisierondes per aflevering, en de tijd van een bronwijziging tot een goedgekeurde vervanging.
01.Waarvoor dient een pilot?
Een demo toont de beste clip van de leverancier. Een pilot toont het moeilijkste materiaal van de opdrachtgever door twee workflows.
- De eenheid is een beslissing. De pilot beantwoordt of een seizoen, een catalogus of een MCN over kan; één schone scène zegt niets over aflevering zestig.
- De norm komt eerst. Criteria die vastliggen voordat iemand luistert, kunnen niet verschuiven naar de dub die de zaal toevallig het mooist vond.
- De opzet is gepubliceerd. De gepaarde studies van Familiar op /benchmark gebruiken hem; de pilot draait hem opnieuw op de eigen clips van de opdrachtgever.
02.Welk materiaal gaat erin?
- Een aaneengesloten reeks, bij een serie. Twee of drie opeenvolgende afleveringen met een terugkerende hoofdrol, zodat stem, namen en aanspreekvormen op continuïteit over de reeks worden getest.
- De scènes die dubs breken. Snelle dialogen, een grap, een emotionele wending, eigennamen, muziek onder de spraak, en twee of drie mensen in beeld die door elkaar praten.
- Eén late wijziging. Een gewijzigde regel of een opnieuw gemonteerde scène, ingediend na de eerste dub; een gewijzigde bron is een nieuw dubverzoek, nagekeken op de controlestap.
- Twee of drie prioritaire talen, uit de drie gepubliceerde kwaliteitsniveaus op /docs/languages, het beste niveau eerst.
03.Wat staat er in de acceptatiecriteria?
Eén vraag die een native reviewer bij elke clip beantwoordt, één norm per dimensie, en de meetwaarde die de benchmark van Familiar voor hetzelfde gebruikt.
| DIMENSIE | DE VRAAG VAN DE REVIEWER | DE BENCHMARK VAN FAMILIAR MEET |
|---|---|---|
| Gesproken betekenis | Zegt de regel wat er gezegd is? Een moedertaalspreker of een terugvertaling controleert het. | Ernstige vertaalfouten per output, tegenover één goedgekeurde doelbetekenis |
| Voice cloning | Ogen dicht: is dit dezelfde persoon? | Gelijkenis met de echte spreker |
| Geluid van de scène | Staan de muziek, de lach en de ruimte er nog onder de nieuwe spraak? | Fouten in het achtergrondgeluid tegenover de bronscène, in dB |
| Het gezicht | Kloppen de mond en het hele gezicht met de nieuwe woorden, bij elke spreker in beeld? | Beoordeeld op de gepaarde luistervoorbeelden; de audiometingen scoren het niet, en tools met alleen audio slaan de dimensie over |
| Stemgeluiden en timing | Landen lachen, zuchten en reacties waar en hoe ze landden? | Vormcorrelatie van de events; F1 voor de timing van transiënten |
| Dekking | Accepteerde de tool elke clip, in elke lengte, in elke gevraagde taal? | Een geweigerde clip scoort nul op die clip; minimumlengtes en batchlimieten tellen tegen |
| Revisierondes | Hoeveel rondes voordat elke taal was goedgekeurd? | Niet in de benchmark; per aflevering geteld in de pilot |
| Tijd tot een goedgekeurde vervanging | Hoe lang van de late wijziging tot een goedgekeurde vervangende dub? | Niet in de benchmark; één keer getimed, op de late wijziging |
- Een norm is een getal. Nul vertaalfouten in namen en getallen; de spreker met dichte ogen herkend door drie van de vier reviewers; geen scène waarin de muziek wegvalt; één revisieronde per aflevering.
04.Hoe draait de pilot?
- Gepaard en blackbox. Elke bronclip en doeltaal gaat door beide workflows, en alleen de afgeronde dub wordt beoordeeld, zoals de gepubliceerde methode alleen de uiteindelijke audio beoordeelt.
- Blind waar het format het toelaat. Voorkeurscores schuiven naar wat vertrouwd klinkt; wat standhoudt, is de seconde waarop de kijker eruit viel, en wat dat veroorzaakte.
- Een panel uit de doeltaal naast de eigen reviewers. Buitenstaanders vangen slang, register en een late grap; de eigen kant vangt een naam of een huisterm.
- De controlestap is de correctieteller. Reviewers blijven in de lus omdat de pipeline voor hen pauzeert: elke vertaalde regel wordt op de controlestap bewerkt vóór het renderen, en het aantal en de klasse van de bewerkte regels is een kwaliteitsmaat.
- Tag elke gewijzigde regel. De klassen laten zien wat een Niet-vertalen-lijst en één regel context bij de tweede run zouden hebben voorkomen.
05.Hoe leest u de resultaten?
Een winst telt als hij standhoudt over soorten materiaal en talen; een muzikale scène of een reeks snelle cuts kan een eigen drempel nodig hebben.
- Rapporteer soorten materiaal als aparte rijen. Schone scènes van één camera en scènes met snelle cuts samen gemiddeld verbergen de rij die over de catalogus beslist.
- Rapporteer per taal. Winst in twee van de drie talen is een contract voor twee talen tot de derde opnieuw is getest.
- Tel de operationele rijen. Revisierondes per aflevering en de tijd van een bronwijziging tot een goedgekeurde vervanging bepalen of een dagelijks releaseschema houdbaar is.
- De gepubliceerde cijfers zijn de referentie; de pilot is het bewijs. De resultaten van Familiar op dezelfde dimensies:
ElevenLabs had 270% meer fouten in het achtergrondgeluid: de lach, de muziek, de sfeer.
ELEVENLABS DUBBING V2 (ALPHA) · 111 GEPAARDE OUTPUTS · MANDARIJN, SPAANS, JAPANS · 11.92 VS 3.22 DB · 5 AUGUSTUS 2026Familiar klinkt 27.8% meer als de echte spreker; in alle 11 talen dichterbij.
ELEVENLABS DUBBING V1 · 418 GEPAARDE OUTPUTS · 11 TALEN · 0.4605 VS 0.3604 · 5 AUGUSTUS 2026Familiar maakte 54.7% minder ernstige vertaalfouten (29 tegenover 64).
ELEVENLABS DUBBING V2 (ALPHA) · 111 GEPAARDE OUTPUTS · HETZELFDE COHORT ALS DE 270% · 5 AUGUSTUS 2026De productievertaling van Familiar evenaart de kwaliteit van de eerste versie van de professional, gemiddeld over Frans, Chinees, Hindi en Indonesisch.
STUDIE PRODUCTIEVERTALING VS EERSTE VERSIE VAN PROFESSIONELE VERTALERS · VIER TALEN · AUGUSTUS 202606.Van pilot naar contract
Toegang loopt via een Studio-contract, afgestemd op de catalogus, met 30 dagen geld terug bij een getekend jaarcontract; de talen van de pilot worden de eerste talen van het contract.
- De correcties gaan mee. Namen en zinnen die in de pilot zijn rechtgezet, blijven bewaard in de Niet-vertalen-lijst en de contextregel op creatorniveau; de eerste productieaflevering begint daarmee.
- Livesessies worden bij het contract geactiveerd: talen, verwachte gelijktijdigheid en een repetitie op de echte setup van de opdrachtgever via SRT, RTMP of WHIP; uitzendingen lopen daarna 5 tot 9 seconden achter op het origineel, elke spreker in zijn eigen stem.
- De andere draaiboeken pakken het hier op: studio's, streamingplatforms, microdrama's, lanceringen in meerdere landen en MCN's.
VRAGEN
Hoe lang moet een pilot voor AI-nasynchronisatie duren?
Lang genoeg om een aaneengesloten reeks in twee of drie talen te dubben, met moedertaalsprekers na te kijken en één late wijziging te verwerken. Twee of drie opeenvolgende afleveringen met een terugkerende hoofdrol testen continuïteit én kwaliteit.
Wat moet een nasynchronisatiepilot meten?
Zes dimensies, elk beoordeeld door een native reviewer tegen criteria die vastliggen voordat iemand luistert: gesproken betekenis, stem, geluid van de scène, het gezicht, timing en dekking. Twee operationele rijen rijden mee: revisierondes per aflevering en de tijd van een bronwijziging tot een goedgekeurde vervanging.
Moeten reviewers weten welke dub welke is?
Blind waar het format het toelaat. Voorkeurscores schuiven naar wat vertrouwd klinkt, dus het bruikbare record is het moment waarop de kijker eruit viel: de tijdcode, en of een grap, een naam, een stem of twee mensen die tegelijk praten dat veroorzaakte.
Kan de controlestap deel uitmaken van de pilot?
Ja. De pipeline van Familiar pauzeert op een controlestap waar elke vertaalde regel vóór het renderen wordt bewerkt; het aantal en de soort regels die de reviewer wijzigt, is een kwaliteitsmaat, en de correcties gaan mee in de afgeronde dub. Live dubs vertalen ter plekke, zonder controlestap.
Wat publiceert Familiar voor dezelfde dimensies?
Gepaarde studies, augustus 2026. ElevenLabs Dubbing v2 (Alpha) had 270% meer fouten in het achtergrondgeluid: de lach, de muziek, de sfeer. Familiar klonk 27.8% meer als de echte spreker dan ElevenLabs Dubbing v1, in alle 11 talen dichterbij. De vertalingen van Familiar evenaarden de eerste versie van de professional met 100.3% over Frans, Chinees, Hindi en Indonesisch.
BRONNEN
- [1]Benchmarkhub nasynchronisatie: de drie gepaarde studies
- [2]De beste AI-nasynchronisatie ter wereld: zo meet u het (de zes dimensies)
- [3]Familiar vs ElevenLabs Dubbing: twee gepaarde studies (de methode)
- [4]AI vs menselijke vertaling: getest tegen professionals (2026)
- [5]API-referentie: transcript en controle (de controlestap)
Nasynchronisatie is eindelijk goed. Bekijk de metingen en praat dan met het team over uw catalogus.
FAMILIAR · DE LANCERINGSFILM · 2:31
