Dubformer是什么
Dubformer是一套面向影视、媒体与本地化公司的AI配音生产平台,官网主张“AI Dubbing You Direct”。它强调由专业团队逐句指导和审核,而不是上传视频后完全自动交付。
平台可以转写素材、识别说话人、翻译台词、匹配音色、生成多次表演并输出多个语言版本。官网当前标明支持140多种语言和1000多种音色。
主要功能
1. 自动转写与说话人识别
上传视频并选择目标语言后,系统会转写源音频、识别不同说话人并建立带时间码的cue sheet。正式生成前可检查分段、角色与素材一致性。
2. 多语言视频配音
Dubformer支持140多种语言,可在同一项目中推进多个语言版本。每种语言可以拥有独立角色、声音、审校状态和交付文件。
3. 角色声音匹配
团队可从1000多种音色中为每位角色选声,系统也会推荐接近原角色的候选并给出评分。受限制音色可按文件夹和项目权限隔离。
4. Emotion Transfer
Emotion Transfer用于把源表演的情绪与节奏带到目标语言,而不是只朗读翻译文本。它适合保留影视对白中的停顿、强调和情绪变化。
5. 逐句配音指导
编辑者可以为每个短语选择愤怒、开心、耳语、悲伤、惊讶等情绪,也能输入自定义表演提示。系统会生成多个take,团队试听后选择最合适版本。
6. 发音、节奏与稳定性控制
平台支持逐句调整发音、表达、时长和声音变化程度。稳定性滑块可在角色一致性与更丰富的表现之间取舍。
7. 多人协作与审批
编辑、审校和管理人员可以在同一工作流中留言、复核并签字放行。角色权限、项目权限和语言状态让多个版本可以并行推进。
8. 广播级导出
Studio可导出44.1kHz分语言音轨、带原始音乐和效果的最终混音、M&E轨道以及内嵌配音的MP4。官网还列出VTT、SRT、TTML、XLSX和CSV字幕文件。
9. API接口
官方文档提供自助视频配音Platform API和专业文字转语音API。开发团队可以通过接口建立自动上传、配音、状态查询与结果获取流程。
适合哪些用户
- 制作电视剧、纪录片、动画和网络节目的本地化公司。
- 需要批量发行多语言频道的媒体与流媒体团队。
- 需要保留角色情绪和表演细节的影视制作团队。
- 需要多人审校、权限控制和可追踪流程的企业。
- 希望通过API集成视频配音或语音合成的开发者。
产品版本与价格
截至2026年8月24日,官网公开了Studio Pilot的固定价格,但正式Studio、Self-Service Dubbing API和TTS API没有展示统一公开价。以下对比只写入目前能够从官方页面核验的内容,最终费用、税费和续用条款以签约或结账页面为准。
| 产品 | 公开价格 | 适用对象 | 主要内容 |
|---|---|---|---|
| Studio Pilot | 400美元/两周 | 评估专业工作流的团队 | 120 credits、额外3美元/credit、无限席位、指导式上手、每段6维质量评分 |
| Professional Studio | 联系销售 | 本地化与影视制作公司 | 复杂项目管理、专业编辑、多人审校、权限和广播级交付 |
| Self-Service Dubbing API | 注册后查看 | 需要自动视频配音的开发者 | 通过API提交视频、配置处理参数并获取结果 |
| Professional TTS API | 联系销售或控制台确认 | 需要多语言语音合成的产品团队 | 按语言与地区代码生成专业语音 |
官网没有在公开页面解释一个credit对应多少分钟、语言、角色或生成次数。购买前应以Pilot协议或控制台中的准确计量规则测算真实项目成本。
购买前应确认
- 120 credits的准确消耗方式和失败任务是否扣费。
- 翻译、转写、情绪生成、重新生成和导出是否分别计费。
- 两周Pilot结束后的正式方案、最低用量和续用方式。
- 源语言、目标语言、视频时长和声道对费用的影响。
- 专属音色、声音克隆与Lip-sync是否另行收费。
- 服务等级、并发、交付时间和支持范围。
Dubformer使用教程
- 准备拥有配音与翻译权的视频、脚本和音乐效果素材。
- 上传源视频,选择源语言和一个或多个目标语言。
- 检查自动识别的说话人、时间码和台词分段。
- 修正转写文本,并由母语人员审核目标语言翻译。
- 为每位角色选择库音色或获得授权的专属音色。
- 逐句设置情绪、发音、节奏、时长和稳定性。
- 试听多个take,选择符合角色和场景的版本。
- 由语言审校、声音导演和项目负责人完成质量检查。
- 生成最终语言版本,并导出音轨、混音、视频与字幕。
- 在真实播放环境检查响度、同步、发音和字幕时间。
提高配音质量的方法
- 先修正源语言转写,避免错误继续传递到翻译和配音。
- 为姓名、品牌、地名和专业词建立统一发音表。
- 由目标语言母语人员检查语义、口语习惯和文化适配。
- 角色选声时同时比较年龄感、音色、语速和情绪范围。
- 先处理关键情绪段落,再批量生成普通对白。
- 把过长句拆为符合呼吸与画面节奏的短语。
- 在手机、电视、耳机和扬声器上分别试听最终混音。
产品优势
- 覆盖140多种语言并提供1000多种音色。
- 支持逐句情绪、发音、节奏和稳定性控制。
- 每个短语可生成多个take供人工选择。
- 保留人工导演、母语审校和最终签字流程。
- 支持多语言并行项目和精细权限控制。
- 可输出音轨、最终混音、M&E、视频和多种字幕格式。
- 同时提供专业Studio、视频配音API和TTS API。
使用限制与注意事项
- 140多种语言不代表每种语言、口音和音色质量完全相同。
- 自动转写、翻译、说话人识别和时间对齐都可能出错。
- 情绪迁移不能替代母语配音导演和文化审校。
- 官网没有公开正式Studio与API的完整价格。
- 声音克隆必须获得说话人的明确、可证明授权。
- 上传内容不得违法、侵权或违反第三方权利。
- 正式播出前仍需完成语言、音频、同步和合规检查。
数据安全与隐私
官网称客户数据不会用于训练AI,源媒体在传输和静态存储时使用AES-256加密。Studio还提供角色权限、项目访问控制、Google或Microsoft单点登录和声音隔离。
官方数据处理协议将客户视为数据控制者、Dubformer视为处理者,并列出GDPR请求协助、分包商通知和72小时内数据泄露通知。官网还声明保持SOC 2 Type II合规,企业采购时仍应索取最新审计证明与分包商清单。
- 只上传已获授权的声音、肖像、视频和字幕。
- 为项目成员配置最小必要权限。
- 确认数据地区、跨境传输和保存期限。
- 项目终止后及时导出内容并发起删除。
- 对政治、医疗、新闻和未成年人内容采用更严格审批。
内容权利与输出归属
官方条款说明客户保留上传内容的权利,生成的配音输出归客户所有,但仍受源内容授权限制。平台拥有系统、软件、模型和文档的权利。
这意味着购买服务不能自动取得影片、剧本、音乐、演员声音或翻译的使用权。用户应保存内容许可、配音授权、声音同意和交付地区记录。
API说明
官方开发文档将接口分为自助视频配音Platform API、专业Dubformer Studio和TTS API。API用户需要注册账户,并按接口文档获取可用语言和地区代码。
- 根据需求选择整段视频配音或单独TTS接口。
- 在测试账户中确认语言、文件、时长和输出限制。
- 把密钥保存在服务端,不写入网页或客户端。
- 加入任务队列、超时、失败重试和费用上限。
- 建立声音授权、内容审核和输出复核流程。
- 上线前验证并发、延迟、数据删除和服务等级。
开源情况
没有发现Dubformer主平台、模型或Studio的官方开源仓库及源码许可证。它应标记为非开源商业服务,提供API并不代表核心模型或产品代码开放。
GitHub上的通用配音项目或Dubformer同名内容没有可核验的官方产品关系,不能作为其官方源码或私有化部署依据。
常见问题
Dubformer支持多少种语言
官网当前标明支持140多种语言,具体语言、地区和功能支持应在项目或API选项中确认。
Studio Pilot多少钱
截至2026年8月24日,Pilot为400美元、周期两周,含120 credits、无限席位,额外额度为3美元/credit。
可以逐句控制情绪吗
可以。用户可选择情绪预设或填写自定义提示,并从多个生成版本中选择。
能导出哪些文件
平台可导出音轨、最终混音、M&E、配音MP4,以及VTT、SRT、TTML、XLSX和CSV字幕。
客户内容会用于训练吗
官网明确称客户数据不会用于训练AI,并声明媒体在传输和静态存储时加密。
Dubformer开源吗
不是。当前没有发现主产品的官方开源源码或许可证,但平台提供商业API。
总结
Dubformer适合重视表演质量、多人审校和广播交付的专业配音团队,优势是逐句指导、情绪迁移、多语言项目管理和丰富导出。采购前应重点确认credit计量、正式方案报价、声音授权、数据处理与实际语言质量。
桂公网安备45132202000164号