Dubformer是什麼
Dubformer是一套面向影視、媒體與本地化公司的AI配音生產平台,官網主張「AI Dubbing You Direct」。它強調由專業團隊逐句指導和審核,而不是上傳影片後就完全自動完成配音。
平台可以轉寫素材、識別說話人、翻譯台詞、匹配音色、生成多次表演並輸出多個語言版本。官網目前標明支援140多種語言和1000多種音色。
主要功能
1. 自動轉寫與說話人識別
上傳影片並選擇目標語言後,系統會轉寫原始音訊、辨別不同的說話者,並建立帶有時間碼的cue sheet。在正式生成之前,可檢查分段、角色與素材的一致性。
2. 多語言影片配音
Dubformer支援140多種語言,可在同一專案中同時處理多個語言版本。每種語言都可以擁有獨立的角色、聲音、審校狀態以及交付的檔案。
3. 角色聲音匹配
團隊可從1000多種音色中為每位角色選聲,系統也會推薦接近原角色的候選並給出評分。受限制的音色可按資料夾和專案權限進行隔離。
4. Emotion Transfer
情緒轉移用於將原始表演的情緒與節奏帶到目標語言中,而非僅僅朗讀翻譯後的文本。它適合保留影視對白中的停頓、強調以及情緒變化。
5. 逐句配音指導
編輯者可以為每個短語選擇憤怒、開心、耳語、悲傷、驚訝等情緒,也能輸入自定的表演提示。系統會生成多個版本,團隊試聽後選擇最合適的版本。
6. 發音、節奏與穩定性控制
平台支援逐句調整發音、表達、時長以及聲音變化程度。穩定性滑塊則可讓使用者在角色一致性與更豐富的表現之間取得平衡。
7. 多人協作與審批
編輯、審校和管理人員可以在同一工作流中留言、複核並簽字放行。角色權限、專案權限和語言狀態讓多個版本可以平行推進。
8. 電台級導出
Studio可導出44.1kHz分語言音軌、帶原始音樂和效果的最終混音、M&E軌道,以及內嵌配音的MP4。官網還列出VTT、SRT、TTML、XLSX和CSV字幕檔案。
9. API介面
官方文件提供了自助式影片配音 Platform API以及專業的文字轉語音 API。開發團隊可透過這些介面,建立自動上傳、配音、狀態查詢及結果取得的流程。
適合哪些用戶
- 製作電視劇、紀錄片、動畫和網路節目的本地化公司。
- 需要批量發行多語言頻道的媒體與流媒體團隊。
- 需要保留角色情緒和表演細節的影視製作團隊。
- 需要多人審校、權限控制及可追蹤流程的企業。
- 希望透過API整合影片配音或語音合成的開發者。
產品版本與價格
截至2026年8月24日,官網已公開了Studio Pilot的固定價格,但正式的Studio、Self-Service Dubbing API以及TTS API則沒有公佈統一的價格。以下的比較內容僅為目前能從官方頁面確認的資訊,最終的費用、稅金及續約條款則以簽約或結帳頁面所顯示的內容為準。
| 產品 | 公開價格 | 適用對象 | 主要內容 |
|---|---|---|---|
| Studio Pilot | 400美元/兩週 | 評估專業工作流的團隊 | 120學分、額外3美元/學分、無限席位、指導式入門、每段6維品質評分 |
| Professional Studio | 聯絡銷售 | 本地化與影視製作公司 | 複雜項目管理、專業編輯、多人審校、權限和廣播級交付 |
| Self-Service Dubbing API | 註冊後查看 | 需要自動影片配音的開發者 | 透過API提交影片、配置處理參數並獲取結果 |
| Professional TTS API | 聯繫銷售或控制台確認 | 需要多語言語音合成的產品團隊 | 按語言與地區代碼生成專業語音 |
官網並未在公開頁面說明一個credit對應多少分鐘、語言、角色或生成次數。購買前應以Pilot協議或控制台中的準確計量規則來估算真正的項目成本。
購買前應確認
- 120信用點的準確消耗方式及失敗任務是否扣費。
- 翻譯、轉寫、情緒生成、重新生成和導出是否分別計費。
- 兩週Pilot結束後的正式方案、最低用量和續用方式。
- 源語言、目標語言、影片時長和聲道對費用的影響。
- 專屬音色、聲音克隆與Lip-sync是否另行收費。
- 服務等級、併發、交付時間和支援範圍。
Dubformer使用教學
- 準備擁有配音與翻譯權的影片、腳本和音樂效果素材。
- 上傳源影片,選擇源語言以及一個或多個目標語言。
- 檢查自動識別的說話人、時間碼和臺詞分段。
- 修正轉寫文本,並由母語人員審核目標語言翻譯。
- 為每位角色選擇庫音色或獲得授權的專屬音色。
- 逐句設定情緒、發音、節奏、時長和穩定性。
- 試聽多個take,選擇符合角色和場景的版本。
- 由語言審校、聲音導演和項目負責人完成品質檢查。
- 生成最終語言版本,並導出音軌、混音、影片與字幕。
- 在真實播放環境檢查響度、同步、發音和字幕時間。
提高配音品質的方法
- 先修正源語言轉寫,避免錯誤繼續傳遞到翻譯和配音。
- 為姓名、品牌、地名和專業詞建立統一發音表。
- 由目標語言母語人員檢查語義、口語習慣和文化適配。
- 角色選聲時同時比較年齡感、音色、語速和情緒範圍。
- 先處理關鍵情緒段落,再批量生成普通對白。
- 把過長句拆為符合呼吸與畫面節奏的短語。
- 在手機、電視、耳機和揚聲器上分別試聽最終混音。
產品優勢
- 覆蓋140多種語言並提供1000多種音色。
- 支援逐句情緒、發音、節奏和穩定性控制。
- 每個短語可生成多個take供人工選擇。
- 保留人工導演、母語審校和最終簽字流程。
- 支援多語言並行項目與精細權限控制。
- 可輸出音軌、最終混音、M&E、影片及多種字幕格式。
- 同時提供專業Studio、影片配音API和TTS API。
使用限制與注意事項
- 140多種語言並不代表每種語言、口音和音色品質都完全相同。
- 自動轉寫、翻譯、說話人識別和時間對齊都可能出錯。
- 情緒遷移無法取代母語配音導演和文化審校。
- 官網沒有公開正式Studio與API的完整價格。
- 聲音克隆必須獲得說話人的明確、可證明的授權。
- 上傳內容不得違法、侵權或違反第三方權利。
- 正式播出前仍需完成語言、音頻、同步和合規檢查。
資料安全與隱私
官網聲明,客戶資料不會用於訓練AI,而來源媒體在傳輸及靜態儲存時則會使用AES-256加密技術。Studio還提供角色權限管理、專案訪問控制功能,以及Google或Microsoft的單點登入與音訊隔離功能。
官方的資料處理協議中,將客戶視為資料控制者,而Dubformer則被視為資料處理者。該協議還規定了在面對GDPR相關要求時應如何處理、如何通知分包商,以及需要在何時之前通知資料洩漏的情況。此外,官網還聲明自己符合SOC 2 Type II的標準,因此企業在採購時仍應要求獲得最新的審計證明及分包商名單。
- 只上傳已獲授權的聲音、肖像、影片和字幕。
- 為專案成員配置最小必要權限。
- 確認數據地區、跨境傳輸和保存期限。
- 項目終止後及時導出內容並發起刪除。
- 對政治、醫療、新聞和未成年人內容採用更嚴格審批。
內容權利與輸出歸屬
官方條款說明,客戶保留上傳內容的權利,所生成的配音成果歸客戶所有,但仍受原始內容的授權限制。平台則擁有系統、軟體、模型及文件的所有權。
這意味著購買服務無法自動取得影片、劇本、音樂、演員聲音或翻譯的使用權。用戶應保存內容許可、配音授權、聲音同意及交付地區記錄。
API說明
官方開發文件將介面分為自助影片配音 Platform API、專業 Dubformer Studio 和 TTS API。API 使用者需要註冊帳戶,並依照介面文件取得可用的語言和地區代碼。
- 根據需求選擇整段影片配音或單獨TTS介面。
- 在測試帳戶中確認語言、文件、時長和輸出限制。
- 把密鑰保存在服務端,不寫入網頁或客戶端。
- 加入任務隊列、超時、失敗重試和費用上限。
- 建立聲音授權、內容審核和輸出複核流程。
- 上線前驗證併發、延遲、資料刪除和服務等級。
開源情況
沒有發現Dubformer主平台、模型或Studio的官方開源倉庫及源碼許可證。它應標記為非開源商業服務,提供API並不代表核心模型或產品代碼已開放。
GitHub上的通用配音專案或Dubformer同名內容沒有可核驗的官方產品關係,不能作為其官方源碼或私有化部署依據。
常見問題
Dubformer支援多少種語言
官網目前標明支援140多種語言,具體語言、地區及功能支援應在專案或API選項中確認。
Studio Pilot多少錢
截至2026年8月24日,Pilot的費用為400美元,週期為兩週,包含120個點數,且可享有無限次使用權;此外,每多使用一個點數還需支付3美元。
可以逐句控制情緒嗎
可以。用戶可選擇情緒預設或填寫自訂提示,並從多個生成版本中選擇。
能導出哪些檔案
平台可導出音軌、最終混音、M&E、配音MP4,以及VTT、SRT、TTML、XLSX和CSV字幕。
客戶內容會用於訓練嗎
官網明確表示,客戶資料不會用於訓練AI,並聲明在傳輸與靜態儲存時會進行加密。
Dubformer開源嗎
不是。目前尚未發現主產品的官方開源源碼或許可證,但平台提供商業API。
總結
Dubformer適合重視表演品質、需要多人共同審校以及進行廣播播放的專業配音團隊,其優點在於能提供逐句指導、幫助調整情緒表達、支援多語言專案管理,並且有豐富的輸出功能。在採購之前,應特別確認信用點數的計算方式、正式方案的報價、聲音授權條件、資料處理方式以及最終的語言品質。
桂公網安備45132202000164號