LA RESPOSTA BREU
LA VERSIÓ CURTA
- Una prova pilot és aparellada: els mateixos clips d'origen passen pel flux de treball actual i pel candidat, en dues o tres llengües de destinació.
- Els criteris d'acceptació s'escriuen abans que ningú escolti: un llindar d'aprovació per dimensió, sis dimensions mesurades més dues files operatives.
- Els revisors nadius puntuen a cegues on el format ho permet i marquen el segon en què es trenca la immersió.
- El pas de revisió compta les correccions: quantes línies traduïdes ha canviat el revisor abans de renderitzar, i de quina classe.
- Dues mètriques operatives acompanyen la qualitat: rondes de correcció per episodi, i el temps des d'un canvi a l'original fins a una substitució aprovada.
01.Per a què serveix una prova pilot?
Una demo mostra el millor clip del proveïdor. Una prova pilot mostra les imatges més difícils del comprador a través de dos fluxos de treball.
- La unitat és una decisió. La prova pilot respon si una temporada, un catàleg o una xarxa de creadors poden fer el pas; una escena neta no diu res de l'episodi seixanta.
- El llindar d'aprovació va primer. Uns criteris fixats abans que ningú escolti no poden derivar cap al doblatge que a la sala li ha agradat més.
- El disseny està publicat. Els estudis aparellats de Familiar a /benchmark el fan servir; la prova pilot el repeteix amb els clips del comprador.
02.Quines imatges hi entren?
- Episodis consecutius, per a una sèrie. Dos o tres episodis seguits amb un protagonista recurrent, perquè la veu, els noms i els tractaments es provin en continuïtat al llarg de la sèrie.
- Les escenes que trenquen els doblatges. Diàleg ràpid, un acudit, un gir emocional, noms propis, música sota la parla, i dues o tres persones en pantalla parlant-se a sobre.
- Un canvi d'última hora. Una línia canviada o una escena remuntada enviada després del primer doblatge; un origen modificat és una nova petició de doblatge, comprovada al pas de revisió.
- Dues o tres llengües prioritàries, dels tres nivells de qualitat publicats a /docs/languages, primer el nivell més alt.
03.Què diuen els criteris d'acceptació?
Una pregunta que un revisor nadiu respon a cada clip, un llindar d'aprovació per dimensió, i la mètrica que el benchmark de Familiar fa servir per al mateix.
| DIMENSIÓ | LA PREGUNTA DEL REVISOR | EL BENCHMARK DE FAMILIAR MESURA |
|---|---|---|
| Significat parlat | La línia diu el que es va dir? Ho comprova un parlant nadiu o una retrotraducció. | Errors de traducció importants per resultat, contra un sol significat aprovat de destinació |
| Clonació de veu | Amb els ulls tancats: és la mateixa persona? | Semblança amb el parlant real |
| So de l'escena | La música, les rialles i la sala continuen sota la nova parla? | Error en el so de fons respecte a l'escena d'origen, en dB |
| La cara | La boca i tota la cara coincideixen amb les noves paraules, en cada parlant en pantalla? | Jutjat amb els exemples aparellats per escoltar; les mesures d'àudio no el puntuen, i les eines només d'àudio se salten la dimensió |
| Esdeveniments vocals i tempo | Les rialles, els sospirs i les reaccions cauen on i com queien? | Correlació de la forma dels esdeveniments; F1 del tempo dels transitoris |
| Cobertura | L'eina ha acceptat tots els clips, de totes les durades, en totes les llengües demanades? | Un clip rebutjat puntua zero en aquell clip; els mínims de durada i els límits per lot compten en contra |
| Rondes de correcció | Quantes passades fins que cada llengua s'ha aprovat? | No és al benchmark; es compta per episodi a la prova pilot |
| Temps fins a una substitució aprovada | Quant temps des del canvi d'última hora fins a un doblatge de substitució aprovat? | No és al benchmark; es cronometra un sol cop, amb el canvi d'última hora |
- Un llindar d'aprovació és un nombre. Zero errors de traducció en noms i xifres; el parlant reconegut amb els ulls tancats per tres de cada quatre revisors; cap escena on la música desaparegui; una ronda de correcció per episodi.
04.Com es fa?
- Aparellada i de caixa negra. Cada clip d'origen i llengua de destinació passa pels dos fluxos de treball, i només es jutja el doblatge acabat, tal com el mètode publicat jutja només l'àudio final.
- A cegues on el format ho permet. Les puntuacions de preferència deriven cap al que ja sona conegut; el registre que aguanta és el segon en què s'ha trencat la immersió, i què l'ha trencada.
- Un panell en llengua de destinació al costat dels revisors interns. Els de fora detecten l'argot, el registre i un acudit tardà; els de dins detecten un nom o un terme de la casa.
- El pas de revisió és el comptador de correccions. Els revisors continuen dins del procés perquè el pipeline s'atura per a ells: qualsevol línia traduïda s'edita al pas de revisió abans de renderitzar, i el nombre i la classe de línies editades és una mesura de qualitat.
- Etiquetar cada línia canviada. Les classes mostren què hauria evitat a la segona passada una llista «No traduir» i una nota de context d'una sola frase.
05.Com es llegeixen els resultats?
Una millora compta quan es manté entre tipus d'imatges i llengües; una escena musical o una seqüència de talls ràpids pot necessitar el seu propi llindar.
- Informar dels tipus d'imatges en files separades. Les escenes netes d'una sola càmera i les escenes de talls ràpids fetes mitjana juntes amaguen la fila que decideix el catàleg.
- Informar per llengua. Una millora en dues de tres llengües és un contracte de dues llengües fins que la tercera es torna a provar.
- Comptar les files operatives. Les rondes de correcció per episodi i el temps des d'un canvi a l'original fins a una substitució aprovada decideixen si un calendari de publicació diària aguanta.
- Les xifres publicades són la referència; la prova pilot és la prova. Els resultats de Familiar en les mateixes dimensions:
ElevenLabs tenia un 270% més d'error en el so de fons: les rialles, la música, l'ambient.
ELEVENLABS DUBBING V2 (ALPHA) · 111 RESULTATS APARELLATS · MANDARÍ, ESPANYOL, JAPONÈS · 11.92 VS 3.22 DB · 5 D'AGOST DE 2026Familiar s'assembla un 27.8% més al parlant real; les 11 llengües van afavorir Familiar.
ELEVENLABS DUBBING V1 · 418 RESULTATS APARELLATS · 11 LLENGÜES · 0.4605 VS 0.3604 · 5 D'AGOST DE 2026Familiar va fer un 54.7% menys d'errors de traducció importants en el discurs (29 vs 64).
ELEVENLABS DUBBING V2 (ALPHA) · 111 RESULTATS APARELLATS · LA MATEIXA COHORT QUE EL 270% · 5 D'AGOST DE 2026La traducció en producció de Familiar iguala la qualitat de la primera versió d'un traductor professional expert, de mitjana entre francès, xinès, hindi i indonesi.
ESTUDI DE TRADUCCIÓ EN PRODUCCIÓ VS PRIMERA VERSIÓ DE TRADUCTORS PROFESSIONALS EXPERTS · QUATRE LLENGÜES · AGOST DE 202606.De la prova pilot al contracte
L'accés és per contracte Studio, a la mida del catàleg, amb 30 dies de garantia de devolució en els contractes anuals signats; les llengües de la prova pilot es converteixen en les primeres llengües del contracte.
- Les correccions es conserven. Els noms i les frases corregits a la prova pilot persisteixen a la llista «No traduir» i a la nota de context a l'àmbit de creador; el primer episodi de producció comença a partir d'aquí.
- Les sessions en directe s'activen amb el contracte: llengües, concurrència prevista i un assaig amb la configuració real del comprador per SRT, RTMP o WHIP; les retransmissions van llavors entre 5 i 9 segons per darrere de l'original, cada parlant amb la seva pròpia veu.
- Les guies germanes continuen a partir d'aquí: estudis, plataformes de streaming, microdrames, llançaments multipaís i xarxes de creadors.
PREGUNTES
Quant hauria de durar una prova pilot de doblatge amb IA?
Prou per doblar uns episodis consecutius en dues o tres llengües, revisar-los amb parlants nadius i processar un canvi d'última hora. Dos o tres episodis seguits amb un protagonista recurrent proven la continuïtat a més de la qualitat.
Què hauria de mesurar una prova pilot de doblatge?
Sis dimensions, cadascuna puntuada per un revisor nadiu contra criteris escrits abans que ningú escolti: significat parlat, veu, so de l'escena, la cara, tempo i cobertura. Dues files operatives les acompanyen: rondes de correcció per episodi i temps des d'un canvi a l'original fins a una substitució aprovada.
Els revisors haurien de saber quin doblatge és quin?
A cegues on el format ho permet. Les puntuacions de preferència deriven cap al que ja sona conegut, així que el registre útil és el moment en què s'ha trencat la immersió: la marca de temps, i si l'ha trencada un acudit, un nom, una veu o dues persones parlant alhora.
El pas de revisió pot formar part de la prova pilot?
Sí. El pipeline de Familiar s'atura en un pas de revisió on qualsevol línia traduïda s'edita abans de renderitzar; el nombre i el tipus de línies que el revisor canvia és una mesura de qualitat, i les correccions surten al doblatge acabat. Els doblatges en directe es tradueixen al vol, sense pas de revisió.
Què publica Familiar per a les mateixes dimensions?
Estudis aparellats, agost de 2026. ElevenLabs Dubbing v2 (Alpha) tenia un 270% més d'error en el so de fons: les rialles, la música, l'ambient. Familiar s'assemblava un 27.8% més al parlant real que ElevenLabs Dubbing v1, més a prop en les 11 llengües. Les traduccions de Familiar van igualar la primera versió d'un traductor professional expert amb un 100.3% entre francès, xinès, hindi i indonesi.
REFERÈNCIES
- [1]Centre de benchmarks de doblatge: els tres estudis aparellats
- [2]El millor doblatge amb IA del món: com mesurar-lo (les sis dimensions)
- [3]Familiar vs ElevenLabs Dubbing: dos estudis aparellats (el mètode)
- [4]IA vs traducció humana: provada contra professionals (2026)
- [5]Referència de l'API: transcripció i revisió (el pas de revisió)
El doblatge per fi és bo. Mira les xifres i després parla del teu catàleg amb l'equip.
FAMILIAR · EL VÍDEO DE LLANÇAMENT · 2:31
