發行實戰指南

多國同步推出:所有市場一次配音

FAMILIAR 研究全部文章

簡短回答

同時在多個國家推出,令配音從逐個市場的項目變成一個請求:來源影片一併配成最多 29 種目標語言,每種語言各自審閱、各自確認後放行,每次狀態變化都由 Webhook 回報。Familiar 用一個模型渲染說話者自己的聲音、唇形同步和場景聲音,覆蓋 30 種語言;多一個市場,只是請求裡多一個語言代碼。

重點摘要

  • 一個配音請求把來源影片配成最多 29 種目標語言;來源語言自動偵測或指定。
  • 每種語言在該市場的審閱人員批准後才渲染,先通過的市場可以先發佈。
  • 完整的人工配音,每種語言每分鐘成片要 $70 至 $150:一部 90 分鐘的電影配到十個市場,就是 $63,000 至 $135,000。
  • 母版一旦改動,就是一次新的配音請求;不翻譯清單和背景簡介保存在創作者層級,無需重新交代。

01.「無法擴展」通常指甚麼?

介面字串和網頁文案屬於翻譯管理系統,那是另一種資產用的另一種工具;本指南只涵蓋影片和廣播這一邊。

  • 每種語言一家供應商。選角、錄音室時間、混音和質素把關在每個市場重複一遍:十個市場,十個時間表。
  • 最慢的市場決定日期。同日推出要等最後一條配音通過,否則部分市場只能先靠字幕上線。
  • 多一個市場,多一家供應商。每個新國家都帶來自己的錄音室、簡介和交付規格。

02.一個請求,所有市場

逐個市場 → 一個請求 · 每一步過去需要甚麼,一個配音請求現在按語言交回甚麼
步驟逐個市場一個配音請求
翻譯每種語言一位譯者,分別交代所有目標語言出自同一來源和同一句背景簡介
聲音每個市場選角並錄音說話者自己的聲音,來自片段本身
畫面嘴仍在說原文語言每種語言重新演出唇形同步
混音每個市場一次錄音室混音場景聲音保留;音樂絕不配音
質素把關每家供應商一輪,按供應商的時間表每種語言在渲染前有一個審閱步驟
交付檔案按各供應商的時間表送達每種語言完成後隨即送出檔案,同一條 Webhook 串流
每種語言一個 MP4.SRT + .VTT完整混音只有人聲翻譯好的標題 + 描述
  • 每個請求最多 29 種目標語言。一次 POST 到建立配音,可帶最多 10 GB、24 小時的來源,加上語言代碼。
  • 按語言審閱。review 設為 manual 時,每種語言停在審閱步驟;該市場的審閱人員修改任何一句,然後渲染放行一種語言或整條配音,流程見串流平台實戰指南
  • 每種語言一個事件。每種語言完成時發出 dub.output_ready,最後一種完成時發出 dub.completed;送達附有簽名,24 小時內重試(Webhook)。
  • 廣播形式的推出。直播工作階段透過 SRT、RTMP 或 WHIP 接收訊號,把每種語言的訊號推送到各自的目的地,比原聲慢 5 至 9 秒,每位說話者都用自己的聲音。

03.一次配成多種語言,質素守得住嗎?

三個公開的質素級別就是規劃工具:推出時如果要取捨,第一級語言先行。

  • 第一級。日語、印尼語、西班牙語、法語、英語、俄語、泰語、普通話、越南語、粵語、意大利語、葡萄牙語、德語、韓語。
  • 第二級。加泰羅尼亞語、立陶宛語、克羅地亞語、希臘語、保加利亞語、挪威語、荷蘭語、斯洛伐克語、瑞典語。
  • 第三級。丹麥語、白俄羅斯語、阿拉伯語、拉脫維亞語、哈薩克語、烏克蘭語、塞爾維亞語。
圖 01 · 三項公開研究 · 每格標明自己的樣本組 · 2026 年 8 月
270%

ElevenLabs 的背景聲音錯誤多 270%:笑聲、音樂、環境聲。

ElevenLabs Dubbing v2 (Alpha) · 111 組配對輸出 · 普通話、西班牙語、日語 · 2026 年 8 月 5 日
+27.8%

Familiar 的聲音像真人說話者的程度高 27.8%;測試的 11 種語言全部更接近。

ElevenLabs Dubbing v1 · 418 組配對輸出 · 11 種語言 · 2026 年 8 月 5 日
100.3%

Familiar 與專業譯者初稿的質素旗鼓相當,法語、中文、印地語、印尼語平均計算,以專家修訂稿為標準盲測評分。

生產流程翻譯研究 vs 專業譯者初稿 · 2026 年 8 月
  • 完整的人工配音,每種語言每分鐘成片要 $70 至 $150,翻譯加聲音:一部 90 分鐘的電影配到十個市場,就是 $63,000 至 $135,000(2026 年配音要多少錢?)。

04.推出前母版改動了怎麼辦?

  • 母版一旦改動,就是一次新的配音請求。新的剪接版本連同相同的目標語言送入。
  • 改動的台詞在審閱步驟核對。新版本到達審閱時發出 dub.ready_for_review;每種語言再修改、再批准一次。
  • 不翻譯清單和背景簡介保存在創作者層級。名字、地名和口頭禪完全照原話保留,一句背景簡介對重新上載的版本仍然生效;任務層級的條目只為某一個版本覆寫(不翻譯清單背景簡介)。
  • 失敗會指明語言。dub.failed 帶有語言和錯誤原因;其他語言保持各自的狀態。

05.先用兩個市場試行

  • 一種第一級語言,加一種較低級別的語言。兩者審閱結果的差距,就是其餘市場推出的規劃數字。
  • 最難的作品,完整一部。快對白、笑話、對白下的音樂、專有名詞,以及一次經審閱步驟處理的後期改動。
  • 在任何人試聽之前先定驗收標準。點算每個市場的審閱人員在渲染前改動的句數;方法見如何進行 AI 配音試行(2026)

常見問題

同時配音到多個國家,用甚麼處理?

一個配音請求把來源影片配成最多 29 種目標語言;每種語言停在審閱步驟,各自確認後才渲染,每種完成時發出一個 Webhook。多一個市場,只是請求裡多一個語言代碼。

所有市場一定要一起推出嗎?

不必。每種語言在自己的審閱人員簽核後才渲染,先通過的市場可以先發佈;渲染呼叫可附上語言清單,或不附以批准整條配音。每個市場的上線日期仍由發行商決定。

推出前一星期母版改動了怎麼辦?

新母版作為一次新的配音請求送入,目標語言不變。審閱人員在審閱步驟核對改動的台詞;不翻譯清單和背景簡介從創作者層級自動沿用。

這也適用於我們的網站和應用程式字串嗎?

不適用。介面字串、網頁文案和應用商店頁面屬於翻譯管理系統。Familiar 涵蓋影片和廣播這一邊:用說話者自己的聲音說出的譯文、唇形同步、場景聲音、字幕,以及翻譯好的標題和描述。

參考資料

  1. [1]建立配音:一個請求,最多 29 種目標語言
  2. [2]文字稿與審閱:修改任何一句、按語言渲染
  3. [3]語言:30 種語言按質素級別排列
  4. [4]Familiar vs ElevenLabs 基準測試:完整結果、置信區間與試聽範例
  5. [5]Familiar vs 專業人工翻譯:質素與價格

配音終於好了。先看實測數據,再跟團隊談談你的內容庫。

FAMILIAR · 發佈影片 · 2:31