네트워크 플레이북

크리에이터 네트워크(MCN) 더빙: 워크플로 하나로 모든 크리에이터를

FAMILIAR 연구전체 글

핵심 답변

네트워크가 워크플로 하나로 여러 크리에이터를 더빙할 수 있는 것은, 크리에이터별 차이가 파이프라인이 읽는 데이터일 때입니다: 크리에이터마다 번역 제외 목록과 컨텍스트를 담은 프로필 하나, 그 프로필을 태그한 모든 더빙 요청과 라이브 세션, 모든 렌더링을 보고하는 웹훅 스트림 하나. Familiar의 API는 이렇게 동작하며, 각 크리에이터 본인의 목소리와 립싱크를 최대 29개 언어로 유지합니다. 인터페이스는 네트워크 자체 제품이 그대로 맡습니다.

요점 정리

  • 크리에이터 프로필 하나(creator_id와 네트워크 자체 external_id)가 그 크리에이터의 번역 제외 목록과 컨텍스트를 모든 더빙과 라이브 세션에 실어 나릅니다.
  • 항목은 크리에이터, 스트림, 작업 세 범위에 붙으며, 더 좁은 범위가 우선합니다.
  • 더빙된 목소리는 크리에이터 본인의 클립에서 나옵니다: 418쌍(2026년 8월 5일)에서 Familiar는 ElevenLabs Dubbing v1보다 실제 화자와 27.8% 더 닮게 들렸습니다.
  • 모든 언어가 완성본 영상, .srt와 .vtt 자막, 오디오 파일 두 개, 링크와 해시태그가 그대로인 번역된 제목과 설명으로 도착합니다.

01.크리에이터마다 워크플로를 두면 왜 무너질까요?

40명의 크리에이터를 6개 언어로 더빙하는 멀티 채널 네트워크(MCN)는 더빙 채널 240개를 운영하게 되고, 크리에이터마다 자기만의 이름, 유행어, 반복되는 농담, 스폰서 코드를 가져옵니다.

  • 크리에이터별 프로세스가 실패하는 지점. 문서로 관리하는 용어집은 그것을 읽는 사람에 따라 적용되고, 한 크리에이터의 목록을 바꿔도 누군가 옮겨 주지 않으면 다음 더빙에 반영되지 않습니다.
  • 놓치는 시청자. YouTube 상위 100개 채널 중 64개는 영어를 쓰지 않는 채널입니다.

02.크리에이터별 설정은 어떻게 연동 하나에 실릴까요?

네트워크는 조직의 API 키로 한 번 연동하고, 크리에이터는 파이프라인이 요청마다 읽는 프로필이 됩니다.

  • 크리에이터당 프로필 하나. POST /v1/creators가 creator_id를 돌려주고, 네트워크는 프로필에 자체 external_id를 저장해 그것으로 크리에이터를 찾습니다 (크리에이터 프로필).
  • 목록과 컨텍스트가 프로필을 따라갑니다. creator_id를 태그한 더빙이나 라이브 세션은 그 크리에이터의 번역 제외 목록과 컨텍스트를 받아, 더빙, 자막, 번역된 메타데이터에 대소문자 구분 없이 적용합니다 (번역 제외 목록).
  • 세 범위, 더 좁은 범위가 우선. 항목은 크리에이터(계속 유지되는 기본값), 스트림(라이브 세션에 저장되어 다음 방송에 재사용), 작업(업로드 하나) 범위에 붙습니다. 작업 항목은 그 영상에서만 크리에이터 기본값을 덮어씁니다.
  • 기본 항목, 컨텍스트 한 문장. 새 프로필은 플랫폼 이름과 흔한 게임·인터넷 용어가 보호된 상태로 시작합니다. “체스 채널: 오프닝, 블런더, 스피드런” 같은 컨텍스트가 이름을 이름으로 남게 합니다 (컨텍스트).
  • 목록 하나, 웹훅 스트림 하나. GET /v1/dubs는 creator_id와 status로 필터링되고, 모든 상태 변화는 엔드포인트 하나로 서명되어 도착하며 24시간 동안 재시도됩니다 (웹훅).
TABLE 01 · 네트워크 공용 vs 크리에이터별
설정네트워크 공용크리에이터별
API 키모든 요청에 조직 키 하나없음: 크리에이터는 그 키 아래의 프로필이며, 크리에이터별 로그인은 없음
번역 제외 목록기본 항목: 플랫폼 이름, 흔한 게임·인터넷 용어creator_id로 연결된 크리에이터 자체 항목. 작업 항목은 영상 하나만 덮어씀
컨텍스트없음크리에이터당 한 문장. 스트림이나 작업 문장이 이를 덮어씀
타겟 언어더빙당 최대 29개요청마다 선택
검토 단계review=auto는 바로 렌더링, review=manual은 in_review에서 멈춤더빙마다 선택
웹훅기본 엔드포인트 하나, 서명, 24시간 재시도더빙 또는 라이브 세션별 webhook_url 재정의
더빙 목록조직 전체에 대한 GET /v1/dubscreator_id 필터로 크리에이터 한 명으로 좁힘
기본 한도분당 요청 100건, 동시 렌더링 10건, 라이브 세션 2건, 파일당 10 GB, 원본 24시간크리에이터별 한도 없음. 조직 담당자를 통해 상향

03.크리에이터는 여전히 자기 목소리로 들릴까요?

더빙의 목소리는 크리에이터 본인의 클립에서 나오고, 눈, 눈썹, 볼, 고개까지 얼굴 전체가 새로운 언어로 연기합니다. 기성 내레이터 목소리라면 시청자에게 다른 사람을 파는 셈입니다.

FIG. 01 · 장면과 목소리 · vs ElevenLabs 두 건의 쌍 비교 연구 · 2026년 8월 5일
270%

ElevenLabs는 웃음, 음악, 현장음 같은 배경음 오류가 270% 더 많았습니다 (11.92 vs 3.22 dB).

ElevenLabs Dubbing v2 (Alpha) · 111쌍 · 중국어, 스페인어, 일본어 · 2026년 8월 5일
+27.8%

Familiar의 목소리는 실제 화자와 27.8% 더 닮게 들렸고(0.4605 vs 0.3604), 11개 언어 전부에서 Familiar가 더 가까웠습니다.

ElevenLabs Dubbing v1 · 418쌍 · 11개 언어 · 2026년 8월 5일
  • vs YouTube 자동 더빙, 별도 연구. 고정된 50쌍 코호트(정렬된 31쌍; 아랍어, 스페인어, 프랑스어, 힌디어, 한국어; 2026년 8월 8일 수집)에서 Familiar의 화자 유사도는 182.9% 더 높게 측정되었습니다(0.399 vs 0.141) (해당 연구).

04.라이브 스트림도 같은 구조에 맞을까요?

creator_id를 태그한 라이브 세션은 같은 목록과 컨텍스트를 적용하고, 세션과 함께 보낸 컨텍스트는 스트림 범위에 기록됩니다. 라이브 세션은 11개 원본 언어에서 나머지 29개 언어로, 원본보다 5~9초 늦게, 화면에 나오는 모든 사람이 각자 자기 목소리로 더빙됩니다. 방송은 WHIP(WebRTC), RTMP, SRT로 들어오고, 각 언어별 피드는 전용 채널로 송출됩니다. 라이브에는 검토 단계가 없으며, 목록과 컨텍스트가 제어 수단입니다 (라이브 스트림 실시간 더빙, 라이브 스트리밍).

05.네트워크는 언어별로 무엇을 게시하게 될까요?

  • 완성본 영상(mp4). 해당 언어의 dub.output_ready가 호출되는 순간 다운로드할 수 있습니다 (결과물과 자막).
  • 자막은 .srt와 .vtt로, 검토를 마친 스크립트에서 만들어 모든 더빙에 무료로 제공됩니다.
  • 오디오 파일 두 개. 추가 오디오 트랙을 지원하는 플랫폼용 전체 믹스(m4a), 크리에이터 자체 믹싱용 목소리 단독(wav).
  • 번역된 제목과 설명. 링크, @핸들, #해시태그, 프로모 코드, 챕터 타임스탬프는 작성한 그대로 유지됩니다 (메타데이터 번역).
  • 검토는 더빙마다 선택. review=manual은 in_review에서 멈춰 렌더링 전에 어떤 줄이든 수정하게 하고, 기본값인 review=auto는 바로 렌더링합니다.
MP4.SRT + .VTT전체 믹스목소리 단독제목 + 설명

06.네트워크는 계약 전에 무엇을 테스트해야 할까요?

  • 가장 어려운 크리에이터를 고르세요. 이름, 스폰서 코드, 반복되는 농담이 가장 많은 두세 명. 목록을 먼저 올린 뒤 쌍 비교 클립을 더빙합니다 (AI 더빙 파일럿 진행 가이드).
  • 검토 단계에서 수정 건수를 세세요. review=manual에서 원어민 검토자가 고친 줄이 측정값입니다. 검토자가 보호한 구절은 이후 모든 더빙을 위해 크리에이터 목록에 올라갑니다.
  • 소속 크리에이터들의 포맷을 확인하세요. 깨끗하고 안정적인 영상이 가장 잘 더빙됩니다: 카메라에 2~3명이 나오는 팟캐스트와 인터뷰, 강의. 화면에 나오는 모든 사람이 더빙됩니다.

질문

네트워크는 크리에이터마다 워크플로를 따로 두지 않고 어떻게 여러 크리에이터를 더빙하나요?

크리에이터당 프로필 하나가 그 크리에이터의 번역 제외 목록과 컨텍스트를 담습니다. 모든 더빙 요청과 라이브 세션이 프로필의 creator_id를 실어 나르므로, 네트워크는 연동 하나로 크리에이터별 더빙 목록을 보고 모든 상태 변화를 웹훅 엔드포인트 하나로 받습니다.

크리에이터의 유행어와 팬들만 아는 농담도 유지되나요?

네. 크리에이터의 번역 제외 목록이 유행어, 이름, 시그니처 슬랭을 더빙, 자막, 번역된 제목과 설명에서 말한 그대로 지킵니다. 농담은 타겟 언어에서 통하도록 다시 쓰고, 컨텍스트가 반복되는 농담의 설정을 지켜 줍니다.

더빙에서도 크리에이터가 자기 목소리로 들리나요?

목소리는 크리에이터 본인의 클립에서 나옵니다. ElevenLabs Dubbing v1 연구(418쌍, 11개 언어, 2026년 8월 5일)에서 Familiar의 목소리는 실제 화자와 27.8% 더 닮게 들렸고, 11개 언어 전부에서 Familiar가 더 가까웠습니다.

크리에이터마다 Familiar 계정이 따로 필요하나요?

아니요. 크리에이터는 네트워크 연동 아래의 프로필입니다: POST /v1/creators에 표시 이름과 네트워크 자체 external_id를 보내면 더빙과 세션에 넘길 creator_id가 돌아옵니다. 누가 어떤 설정 화면을 열 수 있는지는 네트워크 자체 제품에서 정합니다.

참고 자료

  1. [1]크리에이터 프로필: creator_id, external_id, 세 범위 (API 레퍼런스)
  2. [2]번역 제외 목록: 매칭, 범위, 기본 항목 (API 레퍼런스)
  3. [3]컨텍스트: 크리에이터, 스트림, 영상별 한 문장 컨텍스트 (API 레퍼런스)
  4. [4]메타데이터 번역: 그대로 유지되는 것 (API 레퍼런스)
  5. [5]Familiar vs YouTube 자동 더빙: 고정된 50쌍 코호트, 전체 데이터
  6. [6]Familiar vs ElevenLabs: 두 건의 쌍 비교 연구, 신뢰구간, 직접 들어볼 샘플

더빙, 드디어 좋아졌다. 측정 결과를 확인하신 뒤, 보유 카탈로그에 대해 팀과 상담해보세요.

FAMILIAR · 론칭 영상 · 2:31