LA RESPUESTA CORTA
LA VERSIÓN CORTA
- Una sola solicitud de doblaje lleva un título a hasta 29 idiomas de destino; con la revisión manual, cada idioma se retiene en un paso de revisión hasta que un revisor lo aprueba.
- Cada idioma se renderiza con su propia aprobación, así que el español puede publicarse mientras el japonés sigue en revisión.
- Los webhooks informan de cada cambio de estado: un doblaje listo para revisar, la salida de cada idioma lista, el doblaje completo o un fallo con su error.
- Medido con los mismos clips el 5 de agosto de 2026, ElevenLabs Dubbing v2 (Alpha) tuvo un 270% más de errores en el sonido de fondo: las risas, la música, el ambiente.
01.¿Por qué la cobertura es el cuello de botella?
Un catálogo suma títulos cada semana; un proceso que hace el casting, graba y mezcla un título a la vez suma idiomas a un ritmo fijo, así que la cola decide cuánto catálogo puede ver un mercado en su propio idioma.
de los 100 canales más grandes de YouTube no están en inglés.
- El doblaje humano completo cuesta entre $70 y $150 por minuto terminado, traducción más voz: entre $4,200 y $9,000 por un título de 60 minutos en un solo idioma (¿Cuánto cuesta el doblaje en 2026?).
- Cada idioma es su propia cola en un proceso título a título: diez idiomas para un título son diez trabajos de casting, grabación y mezcla, y el más lento fija la fecha de estreno.
- El doblaje solo de audio deja la boca hablando el idioma original; el espectador lee unos labios que contradicen las palabras que oye (Por qué el doblaje no convence fuera y cómo lo arreglan los estudios).
02.¿Cómo es doblar al subir?
Una sola integración cubre el ciclo: el flujo de subida hace una solicitud, la API informa en cada paso y los archivos terminados se sirven desde el reproductor de la propia plataforma.
| PASO | QUÉ OCURRE | QUÉ RECIBE LA PLATAFORMA |
|---|---|---|
| Subida | POST /v1/dubs con el archivo o una URL de origen, hasta 29 códigos de idioma de destino y review=manual; el idioma de origen se detecta o se fija. | dub_id, estado queued, una entrada en outputs[] por idioma |
| Transcripción y traducción | Voz a texto con marcas de tiempo por palabra, con cada voz separada; cada línea se traduce aplicando la lista de no traducir y la línea de contexto. | estado transcribing, después translating |
| Revisión | El doblaje se pausa en in_review. GET de la transcripción por idioma, PATCH de cualquier línea, POST /render para un idioma o para todos. | dub.ready_for_review, después la transcripción editable |
| Renderizado | La voz y la sincronización labial se generan juntas, por idioma; cada idioma lleva su propio estado. | dub.output_ready por idioma; dub.completed cuando todos los idiomas están renderizados |
| Entrega | Una salida por idioma: el mp4 terminado, subtítulos .srt y .vtt a partir de la transcripción revisada, la mezcla de audio completa o la pista de voz sola, y el título y la descripción traducidos. | GET /v1/dubs/{dub_id}/output/{lang} con format=mp4, srt, vtt, audio o voice |
- Los fallos también son eventos. dub.failed lleva el idioma y el error; una entrega sin confirmación de recepción en 10 segundos se reintenta durante 24 horas, y los duplicados se descartan por el id del evento (Webhooks).
- Los nombres y las frases características se mantienen. Una lista de no traducir los conserva exactamente como se dicen; una línea de contexto de una sola frase (quién aparece en pantalla, de qué va la serie) afina cada línea; ambas se aplican a un perfil de creador, a una transmisión o a un solo título (Lista de no traducir, Contexto).
- Los metadatos viajan con el título. El título y la descripción traducidos llegan por idioma; los enlaces, los @, los #hashtags, los códigos promo y los capítulos se quedan tal cual (Traducción de metadatos).
03.¿Por qué un solo modelo cambia la cuenta de la cobertura?
Los procesos de herramientas encadenadas cambian capacidad por calidad: cada herramienta extra es otra pasada y otra factura, y dos modelos no pueden sostener una misma identidad. Un solo modelo unificado genera la voz, los labios y la escena a la vez.
ElevenLabs tuvo un 270% más de errores en el sonido de fondo: las risas, la música, el ambiente.
11.92 FRENTE A 3.22 DB · ELEVENLABS DUBBING V2 (ALPHA) · 111 PARES DE RESULTADOS · MANDARÍN, ESPAÑOL, JAPONÉS · 5 DE AGOSTO DE 2026Familiar suena un 27.8% más parecido a la voz real de quien habla; los 11 idiomas favorecieron a Familiar.
0.4605 FRENTE A 0.3604 · ELEVENLABS DUBBING V1 · 418 PARES DE RESULTADOS · 11 IDIOMAS · 5 DE AGOSTO DE 2026Familiar cometió un 54.7% menos de errores importantes en la traducción hablada (29 frente a 64).
ELEVENLABS DUBBING V2 (ALPHA) · LOS MISMOS 111 PARES DE RESULTADOS QUE LA TARJETA DEL 270% · 5 DE AGOSTO DE 2026- La calidad de traducción se mantiene. Las traducciones de Familiar alcanzaron el 100.3% de la calidad de la primera versión del profesional experto, promediando francés, chino, hindi e indonesio, con evaluación a ciegas frente a revisiones de referencia de expertos (6 de agosto de 2026): un empate (el estudio).
- La escena sobrevive al doblaje. La música nunca se dobla; una canción pasa intacta, y las risas, los efectos de sonido y el ambiente de la sala se quedan bajo el nuevo diálogo; todos los que aparecen en cámara quedan doblados, cada uno con su propia voz.
04.¿Qué títulos primero?
La publicación por idioma convierte la unidad de planificación en un título en un idioma: un mercado sale con los idiomas que ya se aprobaron (Lanzamientos en varios países: doblar todos los mercados a la vez).
| NIVEL | IDIOMAS |
|---|---|
| Nivel 1 (14) | alemán, cantonés, coreano, español, francés, indonesio, inglés, italiano, japonés, mandarín, portugués, ruso, tailandés y vietnamita |
| Nivel 2 (9) | búlgaro, catalán, croata, eslovaco, griego, lituano, neerlandés, noruego y sueco |
| Nivel 3 (7) | árabe, bielorruso, danés, kazajo, letón, serbio y ucraniano |
- Los formatos más limpios primero. Pódcasts y entrevistas con 2 o 3 personas en cámara, videos hablando a cámara, conferencias, presentaciones y escenas limpias de una sola cámara.
- Primero el Nivel 1, después ampliar. Cada uno de los 30 idiomas se dobla desde y hacia todos los demás, así que el orden de los niveles es un orden de despliegue (Idiomas).
- Enrutar según el riesgo. review=manual retiene un título en in_review hasta que el revisor del mercado lo renderiza; review=auto (el valor por defecto) renderiza directo; los trabajos con subtítulos siempre se detienen, porque su texto proviene del paso de revisión.
- Las transmisiones son una vía aparte. Las sesiones en vivo doblan una emisión entre 5 y 9 segundos por detrás del original por SRT, RTMP o WHIP, desde 11 idiomas de origen hacia los otros 29, con la señal de cada idioma enviada a su propio destino; en vivo no hay paso de revisión (Doblaje en tiempo real para transmisiones en vivo).
05.¿Cómo se hace un piloto con el propio catálogo?
- Elegir el título más difícil. Un episodio representativo o una tanda de episodios conectados en dos o tres idiomas prioritarios, con diálogo rápido, un chiste, música bajo el diálogo, nombres propios y un cambio tardío.
- Escribir los criterios de aceptación antes de que nadie escuche. Las palabras, la voz, la escena, el rostro y los tiempos, cada uno puntuado por un revisor nativo; más las rondas de corrección y el tiempo desde un cambio en el origen hasta un reemplazo aprobado.
- Contar las correcciones. Las líneas que un revisor cambia en el paso de revisión, por número y por tipo, son una medida directa de calidad; cada cambio sale en el doblaje y en sus subtítulos.
Diseño pareado, tabla de evaluación y cómo leer los resultados: Cómo hacer un piloto de doblaje con IA (2026). El acceso es por acuerdo de Studio, a la medida del catálogo, con 30 días de garantía de devolución en contratos anuales firmados.
PREGUNTAS
¿Qué usan los servicios de streaming para añadir doblajes en idioma local más rápido?
Doblaje al subir a través de una API: una sola solicitud por título hacia hasta 29 idiomas de destino, un paso de revisión por idioma, webhooks que informan de cada cambio de estado, y el video terminado, los subtítulos, las pistas de audio y el título y la descripción traducidos servidos desde el reproductor de la propia plataforma.
¿Doblar más rápido significa doblar peor?
No cuando la voz, la sincronización labial y la escena salen de un solo modelo. Con los mismos clips (5 de agosto de 2026), ElevenLabs Dubbing v2 (Alpha) tuvo un 270% más de errores en el sonido de fondo que Familiar. Las traducciones de Familiar alcanzaron el 100.3% de la calidad de la primera versión del profesional experto en francés, chino, hindi e indonesio: un empate.
¿Podemos publicar un idioma antes que los demás?
Sí. Con review=manual cada idioma se retiene en in_review y se renderiza con su propia aprobación: POST /render con una lista langs publica el español hoy y el resto cuando sus revisores den el visto bueno; cada idioma dispara su propio webhook dub.output_ready cuando sus archivos están descargables.
¿Cuánto cuesta el doblaje humano completo, como referencia?
El doblaje humano completo, traducción más voz, cuesta entre $70 y $150 por minuto terminado: entre $4,200 y $9,000 por un título de 60 minutos en un solo idioma. La traducción por sí sola cuesta entre $22 y $45 por minuto hablado a las tarifas por palabra publicadas.
¿A qué idiomas puede doblar una plataforma?
30 idiomas, de cualquiera a cualquiera: un título en cualquiera de los 30 se dobla a los otros 29, en tres niveles de calidad publicados, de mayor a menor. El Nivel 1 tiene 14 idiomas; el Nivel 2, nueve; el Nivel 3, siete, en orden alfabético dentro de cada nivel.
REFERENCIAS
- [1]La API de Familiar: introducción, inicio rápido y el ciclo de vida del doblaje
- [2]Transcripción y revisión: retener, editar y renderizar por idioma
- [3]Webhooks: el catálogo de eventos, la entrega y los reintentos
- [4]Benchmarks de doblaje de Familiar: tres estudios pareados, datos completos y ejemplos para escuchar
- [5]¿Cuánto cuesta el doblaje en 2026? (todas las tarifas de doblaje publicadas, por minuto terminado)
- [6]Documentación de ElevenLabs Dubbing: se factura por minuto de material de origen, por idioma de destino (consultado el 6 de septiembre de 2026)
El doblaje por fin es bueno. Primero, las mediciones; después, hablar con el equipo sobre su catálogo.
FAMILIAR · EL VIDEO DE LANZAMIENTO · 2:31
