Cleanvoice AI是什么?
Cleanvoice AI是一款面向播客、访谈、有声书、课程、旁白和视频节目的AI后期处理平台。用户上传音频或视频后,可以自动识别并移除口头禅、长静音、口水声、明显呼吸、结巴和背景噪声,再进行音量标准化、语音增强、转写和内容摘要。
它的特点是把重复性的音频清理组合成预设,不要求用户逐帧寻找波形。Cleanvoice更适合对白型内容,不是完整数字音频工作站;
需要精细音乐混音、音效设计、插件自动化或母带处理时,仍应把结果导入专业软件复核。
自动移除口头禅
Filler Words Remover用于识别“嗯、啊、呃”及不同语言中的填充词,并删除对应音频。它可以减少演讲和访谈中的犹豫感,适合主持人口播、课程和商务内容。
并非所有口头禅都应该删除。某些词承担语气、节奏或情绪作用,机械地全部移除可能让对话显得急促,也可能在词与词之间产生跳切。
建议保留原始文件,并试听每个说话人的典型语速。
长静音与停顿清理
Silence Remover会缩短过长的空白和Dead Air,减少等待、思考和设备切换带来的无内容片段。对长篇播客,它能显著缩短人工查找停顿的时间。
正常呼吸、笑声前后的节奏以及教学中的思考时间不一定属于多余静音。访谈和叙事节目应采用较保守设置;
如果要输出视频,还要检查画面跳切是否自然。
口水声、呼吸与结巴处理
平台可检测嘴唇开合、咂嘴、点击声、明显吸气和部分重复音节,并尝试静音或删除。它适合近距离麦克风产生的口腔噪声,以及有声书和旁白中容易暴露的细小杂音。
这些声音经常与辅音、词尾和情绪性呼吸重叠。过度处理可能吃掉爆破音或让句子失去自然感。
正式发布前应检查统计列表和关键剪辑点,不应把自动清理当成无需试听的一键母带。
背景噪声移除
Background Noise Remover用于降低风扇、空调、电脑、房间底噪和相对稳定的环境声。用户可只启用降噪,也可与口头禅、口水声、静音清理组合成自己的处理模板。
交通声、音乐、人群和其他说话人与目标人声重叠时,算法可能产生水下感或残留。严重削波和远距离录音无法通过降噪完全恢复,录制阶段仍应控制环境、麦克风距离和输入电平。
Audio Enhancer与Studio Sound
Audio Enhancer可提高对白清晰度,Studio Sound用于让普通录音更接近经过处理的录音棚声音。响度标准化可统一不同说话人与片段的电平,并允许开发者在API中设置目标LUFS。
播客常使用约负16 LUFS作为立体声参考,但不同平台、单声道节目和客户规范可能不同。标准化只解决整体响度,不等于消除所有瞬时峰值、频率冲突和动态问题。
音频与视频播客编辑
Cleanvoice可以直接处理音频和视频。视频模式会清理对白并保持媒体输出,适合访谈视频、网络课程、会议回放和短视频。
可从本地设备、文件地址、录制或屏幕录制等入口导入素材。
删除词句和停顿会同时改变时间线。视频项目可能出现画面跳切、字幕错位或口型不连续,因此需要在导出后通看全片,而不是只试听音轨。
多轨项目与时间线导出
平台支持播客多轨工作流。分开的主持人和嘉宾轨道可一起上传并处理,当前公开计费说明表示多轨文件暂不额外收费,但官方明确提示这一规则未来可能改变。
Timeline Export可把自动识别的剪辑决定带到兼容编辑环境继续调整。多轨素材应保持相同起点、采样率和明确轨道命名,上传前也应保留未经处理的原始分轨。
转写、摘要与章节
Cleanvoice可以返回完整转写、段落和词级时间信息,并生成节目标题、摘要、章节、关键学习点和节目描述。它适合制作Show Notes、课程笔记和内容检索。
自动转写会受口音、专有名词、多人重叠与噪声影响;摘要也可能忽略条件或把观点写成事实。
人名、数据、广告声明、医学法律内容和直接引语必须人工核对。
社交内容生成
API与当前内容流程还可生成Newsletter、社交短文和职业社交平台文案,帮助把一期节目拆成推广素材。输出应视为草稿,发布前需调整品牌语气、事实、长度和平台规则。
支持格式
官方Python SDK列出的音频格式包括WAV、MP3、OGG、FLAC、M4A、AIFF和AAC,视频格式包括MP4、MOV、WebM、AVI与MKV。导出可选择自动匹配、MP3、WAV、FLAC或M4A。
格式可被读取不代表所有编码、可变帧率和损坏文件都能正常处理。上传失败不会扣除额度;
遇到异常时可先转为标准WAV或MP4,并检查文件是否能在本地完整播放。
免费试用
Cleanvoice提供无需信用卡的免费试用,适合先上传短样本比较处理前后效果。官方定价页没有把免费试用描述为长期固定的免费套餐,也没有在当前公开文本中承诺永久不变的试用分钟数。
因此目录将价格类型标记为免费试用、按量付费、订阅与企业定制。需要持续制作的用户应根据每月实际素材时长选择付费方式。
价格与版本对比
| 套餐或版本 | 价格、额度与核心权益 |
|---|---|
| 按量付费价格 | Pay as You Go适合一次性项目和低频使用,当前美元公开价格为:5小时11美元,约2.20美元/小时;10小时20美元,约2美元/小时;30小时45美元,约1.50美元/小时。按量Credits自购买之日起有效2年。所有公开档位均包含口头禅、噪声、静音、视频、口水声与呼吸清理、Studio Sound、时间线导出、转写和摘要,不需要为了单项功能升级。 |
| 月订阅价格 | 月订阅适合每周或稳定更新的节目,当前美元公开价格为:10小时11美元,约1.10美元/小时;30小时30美元,约1美元/小时;100小时90美元,约0.90美元/小时。官网还可切换年付,实际折扣以结算页为准。订阅未用额度可在保持订阅期间结转,最多结转到月套餐额度的3倍。例如10小时/月方案,可从以前月份累计最多30小时结转额度,并继续获得当月的新额度。 |
| Credits计费规则 | 计费按输入媒体时长计算,最低计费单位为1分钟并向上取整。例如10分20秒会按11分钟扣除。 上传失败不扣费;如果同时拥有订阅与按量额度,系统先消耗订阅额度,不足时再使用按量Credits。取消订阅后,未使用的订阅额度只能使用到当前计费周期结束;按量额度仍按原购买日期计算2年有效期。公开价格不含VAT,销售税或增值税会因所在地而异。 |
按量付费价格
Pay as You Go适合一次性项目和低频使用,当前美元公开价格为:5小时11美元,约2.20美元/小时;10小时20美元,约2美元/小时;
30小时45美元,约1.50美元/小时。
按量Credits自购买之日起有效2年。所有公开档位均包含口头禅、噪声、静音、视频、口水声与呼吸清理、Studio Sound、时间线导出、转写和摘要,不需要为了单项功能升级。
月订阅价格
月订阅适合每周或稳定更新的节目,当前美元公开价格为:10小时11美元,约1.10美元/小时;30小时30美元,约1美元/小时;
100小时90美元,约0.90美元/小时。官网还可切换年付,实际折扣以结算页为准。
订阅未用额度可在保持订阅期间结转,最多结转到月套餐额度的3倍。例如10小时/月方案,可从以前月份累计最多30小时结转额度,并继续获得当月的新额度。
Credits计费规则
计费按输入媒体时长计算,最低计费单位为1分钟并向上取整。例如10分20秒会按11分钟扣除。
上传失败不扣费;如果同时拥有订阅与按量额度,系统先消耗订阅额度,不足时再使用按量Credits。
取消订阅后,未使用的订阅额度只能使用到当前计费周期结束;按量额度仍按原购买日期计算2年有效期。
公开价格不含VAT,销售税或增值税会因所在地而异。
企业与高用量方案
每月处理200小时以上、需要定制API端点、优先支持或特殊账单的组织可申请Custom Plan。每月上千小时的批量工作流需要单独沟通折扣、并发、文件保留、服务保障和数据条款。
官方还提供面向符合条件创业公司的计划,可申请100小时处理额度;资格和开放状态应以申请页面为准。
API
Cleanvoice提供正式API,可通过API Key提交本地文件或媒体地址、选择清理参数、轮询任务并下载结果。公开套餐同时适用于网页应用和API,高用量客户可申请定制端点。
API可控制fillers、long silences、mouth sounds、breath、stutters、noise removal、studio sound、normalize、target LUFS、transcription、summary、social content与导出格式。
生产环境应把API Key保存在服务端,并处理上传、任务轮询、超时、重复提交和下载链接过期。
Python与JavaScript SDK
官方Python SDK可通过cleanvoice-sdk软件包安装,支持同步、异步、批量、本地文件、内存音频、自动轮询和结果下载,要求Python 3.8或更高版本。官方JavaScript SDK支持Node.js和TypeScript,可通过对应npm包安装。
官方GitHub还提供n8n社区节点,便于在自动化工作流中监听任务完成并串联存储、发布和通知服务。SDK与节点公开并不意味着Cleanvoice核心AI模型开源。
开源状态
Cleanvoice平台、语音处理模型、训练代码和模型权重未开源,主要以云服务形式提供。官方Python SDK采用MIT许可证,JavaScript SDK和集成代码用于访问商业API,应分别查看仓库许可证与API条款。
GitHub上名称相似的CleanVoice、ClearVoice或音频增强项目可能与Cleanvoice AI公司无关,不能视为其本地离线版本。
文件保存与隐私
当前定价FAQ说明,原始与编辑后的文件保存7天,之后永久移除。用户仍应主动下载结果并保留本地备份,不能把Cleanvoice任务页当作长期云盘。
处理客户访谈、员工会议、医疗、法律和未发布商业内容时,应确认参与者同意、数据传输地区、组织合规和删除要求。API工作流还应限制公开下载地址和日志中的敏感信息。
Cleanvoice AI使用教程
完成一次基础任务
- 确认录音、声音、音乐及参与者授权;
- 把清晰音频上传或录入Cleanvoice AI;
- 选择语言、说话人和自动移除口头禅等处理设置;
- 使用长静音与停顿清理生成转录、配音或清理结果;
- 逐段检查姓名、数字、停顿、音量和情绪;
- 导出前确认格式、响度、版权和隐私要求;
建立可复用的专业工作流
- 用真实噪声、口音和多人片段建立测试集;
- 比较自动移除口头禅、长静音与停顿清理和口水声、呼吸与结巴处理的处理差异;
- 保留原始录音和未经修改的转录;
- 对外发布前安排人工听审;
- 统计处理时长、错误率和额度消耗;
- 定期更新术语表、声音授权和删除策略;
适合哪些用户?
- 定期制作访谈和对话节目的播客团队;
- 清理有声书、旁白、网课与会议回放的创作者;
- 需要批量减少口头禅、停顿和口腔噪声的剪辑师;
- 希望自动生成转写、章节、摘要与推广文案的运营人员;
- 通过API、Python、JavaScript或n8n构建音视频处理流程的开发者。
产品优势
- 把多种对白清理任务组合在同一流程中;
- 公开套餐均提供完整功能,主要按处理时长区分;
- 同时支持按量包、订阅和企业定制;
- 订阅额度可结转,按量额度有效2年;
- 支持音频、视频、多轨、时间线与多种导出格式;
- 提供正式API及Python、JavaScript SDK。
限制与注意事项
- 自动删除可能误伤语气词、呼吸、辅音和自然停顿,视频还会产生跳切;
- 平台按输入时长向上取整计费,不按最终缩短后的时长收费;
- 订阅取消后未用订阅额度不会长期保留;
- 云端结果只保存7天,核心模型不能本地部署;
- 转写、摘要和社交文案可能出错,正式节目仍需要人工听审、事实核对、响度检查和版权确认;
常见问题
Cleanvoice AI免费吗?
提供无需信用卡的免费试用,但当前官网未把它描述为永久免费套餐。持续使用需要购买按量Credits、月度或年度订阅。
Cleanvoice AI多少钱?
按量包从5小时11美元起;月订阅从10小时11美元起。
30小时订阅30美元,100小时订阅90美元,均为未含VAT的公开美元价。
未用额度会过期吗?
按量额度购买后有效2年。订阅额度在持续订阅时最多结转月套餐额度的3倍;
取消后只能使用到当前计费周期结束。
支持中文口头禅吗?
产品强调多语言口头禅检测,实际准确度取决于普通话、方言、口音和录音质量。中文正式项目应先用短样本测试并人工试听。
Cleanvoice有API吗?
有。官方提供API文档、Python SDK、JavaScript SDK和n8n节点,网页套餐与API均按处理时长使用Credits。
Cleanvoice开源吗?
核心平台与AI模型不开源;官方Python SDK采用MIT许可证,开放SDK只负责调用云端服务。
桂公网安备45132202000164号