Cleanvoice AI是什麼?
Cleanvoice AI是一種用於播客、訪談、有聲書、課程、旁白以及影片節目的AI後期處理平台。使用者上傳音頻或影片後,該平台就能自動辨別並移除口頭禪、長時間的靜音、口水聲、明顯的呼吸聲、結巴的聲音以及背景雜音,接著還可以進行音量調整、語音強化、文字轉錄以及內容摘要的生成。
它的特點是將重複性的音訊進行整理,並設定為預設模式,如此一來,使用者就不必逐幀尋找波形了。Cleanvoice更適合用於對白類型的內容,它並非完整的數位音訊工作站。
需要精細音樂混音、音效設計、插件自動化或母帶處理時,仍應把結果導入專業軟體復核。
自動移除口頭禪
Filler Words Remover用於識別「嗯、啊、呃」以及不同語言中的填充詞,並刪除對應的音頻。它能減少演講和訪談中的猶豫感,適合主持人口播、課程和商務內容。
並非所有的口頭禪都應該被刪除。有些詞語具有表達語氣、節奏或情緒的功能,如果機械地將它們全部移除,可能會讓對話顯得過於急促,同時也會導致詞與詞之間的銜接不順暢。
建議保留原始檔案,並試聽每個說話人的典型語速。
長靜音與停頓清理
Silence Remover可以縮短過長的空白時間以及無內容的間隔,從而減少因等待、思考或設備切換所造成的無內容片段。對於長篇播客而言,它還能大幅縮短人工尋找停頓時段的時間。
正常呼吸、笑聲前後的節奏以及教學中的思考時間不一定屬於多餘的靜音。訪談和敘事節目應採用較保守的設定;
如果要輸出影片,還要檢查畫面跳切是否自然。
口水聲、呼吸與結巴處理
平台能夠偵測嘴唇的開合動作、咂嘴的聲音、按鍵的聲音、明顯的吸氣聲,以及一些重複出現的音節,並試著將這些聲音靜音或刪除。它很適用於處理由近距離麥克風所錄製的口腔噪音,以及有聲書和旁白中常出現的細微雜音。
這些聲音經常與輔音、詞尾以及情緒性的呼吸聲重疊。過度處理可能會影響爆破音的表達,或是讓句子失去自然感。
正式發布前應檢查統計列表和關鍵剪輯點,不應把自動清理當成無需試聽的一鍵母帶。
背景雜音移除
背景噪音去除器用於降低風扇、空調、電腦所產生的噪音,以及房間內的各種環境噪音。使用者可以僅使用降噪功能,或是將其與口頭語、唾液聲等聲音一起處理,從而打造出屬於自己的處理模板。
當交通聲、音樂、人群以及其他人的說話聲與目標人聲重疊時,算法可能會產生水下感或殘留雜音。嚴重的削波現象以及從遠距離錄製的音訊,無法透過降噪功能完全恢復,因此在錄製階段仍應控制周圍環境、麥克風的距離以及輸入電平。
Audio Enhancer與Studio Sound
Audio Enhancer可提高對白的清晰度,Studio Sound則用於讓普通錄音更接近經過處理的錄音室聲音。響度標準化可統一不同說話者與片段的電平,並允許開發者在API中設定目標LUFS。
播客通常以約負16 LUFS作為立體聲的參考值,但不同的平台、單聲道節目以及用戶需求可能有所不同。標準化只能解決整體的音量問題,無法消除所有的瞬時峰值、頻率衝突以及動態範圍上的問題。
音頻與影片播客編輯
Cleanvoice可直接處理音頻和視頻。視頻模式會清理對白並保持媒體輸出,適合訪談影片、網路課程、會議回放和短影片。
可從本地設備、檔案地址、錄製或螢幕錄製等入口導入素材。
刪除詞句和停頓會同時改變時間線。影片可能出現畫面跳切、字幕錯位或口型不連續的情況,因此需要在導出後完整觀看整部影片,而非僅聽音軌。
多軌專案與時間線導出
平台支援播客的多軌工作流程。分開的主持人與嘉賓軌道可以一起上傳並處理,目前的公開費用說明指出,多軌檔案暫時不會收取額外費用,但官方明確提示此規則未來可能會改變。
Timeline Export可把自動識別的剪輯決定帶到相容的編輯環境繼續調整。多軌素材應保持相同的起點、採樣率以及明確的軌道名稱,上傳前也應保留未經處理的原始分軌。
轉寫、摘要與章節
Cleanvoice可以回傳完整的轉寫內容、段落及單字層級的時間資訊,並能產生節目標題、摘要、章節、重點學習內容以及節目描述。它很適用於製作節目筆記、課程筆記以及進行內容搜尋。
自動轉寫會受口音、專有名詞、多人重疊與雜音影響;摘要也可能忽略條件或把觀點寫成事實。
人名、數據、廣告聲明、醫學法律內容及直接引語必須人工核對。
社交內容生成
API與現有內容流程還可生成Newsletter、社交短文和職業社交平台文案,幫助把一期節目拆成推廣素材。輸出應視為草稿,發布前需調整品牌語氣、事實、長度和平台規則。
支援格式
官方Python SDK列出的音頻格式包括WAV、MP3、OGG、FLAC、M4A、AIFF和AAC,影片格式則包括MP4、MOV、WebM、AVI與MKV。導出時可選擇自動匹配、MP3、WAV、FLAC或M4A。
格式可被讀取並不代表所有編碼、可變幀率及損壞的檔案都能正常處理。上傳失敗不會扣除額度;
遇到異常時可先轉為標準WAV或MP4,並檢查檔案是否能在本地完整播放。
免費試用
Cleanvoice提供無需信用卡的免費試用服務,適合先上傳短樣本來比較處理前後的效果。官方定價頁面並未將免費試用描述為長期固定的免費套餐,也沒有在目前的公開文本中承諾試用時長會永遠不變。
因此目錄將價格類型標記為免費試用、按量付費、訂閱與企業定製。需要持續製作的用戶應根據每月實際素材時長選擇付費方式。
價格與版本對比
| 套餐或版本 | 價格、額度與核心權益 |
|---|---|
| 按量付費價格 | 按需付費的方案適用於一次性任務或低頻使用的情況。目前以美元計算的價格為:5小時11美元,約2.20美元/小時;10小時20美元,約2美元/小時;30小時45美元,約1.50美元/小時。而按量計費的Credit則從購買之日起有效2年。所有套餐都包含口頭禪、噪音處理、靜音功能、影片播放、唾液及呼吸聲的處理、Studio Sound效果、時間軸導出、文字轉錄及摘要等功能,因此不需要為了單一功能而額外升級。 |
| 月訂閱價格 | 月度訂閱適合那些每週或定期更新的節目。目前的美元價格為:10小時11美元,約1.10美元/小時;30小時30美元,約1美元/小時;100小時90美元,約0.90美元/小時。官方網站還提供年度訂閱選項,實際折扣以結帳頁面所示為準。未使用的訂閱時數可在保持訂閱期間內累積,最多可累積到月度套餐時數的3倍。例如,若選擇10小時/月的方案,則可以從之前的月份累積最多30小時的時數,並繼續享有當月的額外時數。 |
| Credits計費規則 | 計費是根據所輸入的媒體長度來計算的,最低計費單位為1分鐘,且會向上取整。例如,10分20秒的內容將被視為11分鐘來計費。 如果上傳失敗,則不會產生費用;如果同時擁有訂閱服務和按量計費的額度,系統會先使用訂閱服務的額度,若不足才會使用按量計費的額度。取消訂閱後,尚未使用的訂閱額度只能用到當前的計費週期結束為止;而按量計費的額度則仍保持原來的2年有效期。公開價格不含VAT、銷售稅或增值稅,這些稅金會因地區而有所不同。 |
按量付費價格
按次付費的方式適用於一次性任務或低頻使用的情況。目前以美元計算的價格為:5小時11美元,約2.20美元/小時;10小時20美元,約2美元/小時。
30小時45美元,約1.50美元/小時。
按量Credits自購買之日起有效2年。所有公開檔位均包含口頭禪、雜音、靜音、影片、口水聲與呼吸清理、Studio Sound、時間軸導出、轉寫和摘要,不需要為了單項功能升級。
月訂閱價格
月度訂閱適合那些每週都有更新或定期更新的節目。目前的美元價格為:10小時11美元,約1.10美元/小時;30小時30美元,約1美元/小時。
100小時90美元,約0.90美元/小時。官網還可切換年付,實際折扣以結算頁為準。
未使用的訂閱額度可以在保持訂閱期間繼續累積,最多可累積到月度套餐額度的3倍。例如,若為每月10小時的方案,則可以從過去幾個月累積的額度中再獲得最多30小時的額度,並繼續享有當月的額度。
Credits計費規則
計費是根據輸入的媒體時長來計算的,最低計費單位為1分鐘,並會向上取整。例如10分20秒就會按11分鐘來計算費用。
上傳失敗不扣費;如果同時擁有訂閱與按量額度,系統先消耗訂閱額度,不足時再使用按量Credits。
取消訂閱後,未使用的訂閱額度僅能使用到當前計費週期結束;按量額度仍按原購買日期計算2年有效期。
公開價格不含VAT,銷售稅或增值稅會因所在地而異。
企業與高用量方案
每月處理時長超過200小時、需要訂製API端點、且需要優先支援或特殊結賬方式的組織,可申請Custom Plan。對於每月需處理上千小時的批量工作流程,則需要另行協商折扣、併發處理能力、檔案保留期、服務保障以及數據相關條款。
官方還為符合條件的創業公司提供相關計劃,這些公司可申請100小時的處理時數;具體資格及開放狀態請以申請頁面為準。
API
Cleanvoice提供正式的API,可透過API Key提交本地檔案或媒體地址、選擇清理參數、輪詢任務並下載結果。公開套餐同時適用於網頁應用與API,高用量客戶可申請訂製端點。
API可控制fillers、長時間的沉默、口部發聲、呼吸聲、口吃、雜音去除、錄音室音效、數值標準化、目標LUFS、轉寫、摘要、社交內容以及導出格式。
生產環境應將API Key儲存在服務端,並處理上傳、任務輪詢、超時、重複提交以及下載連結過期等問題。
Python與JavaScript SDK
官方的 Python SDK 可透過 cleanvoice-sdk 這個軟體套件來安裝,它支援同步、異步、批次處理、本地檔案、記憶體中的音頻資料,以及自動輪詢與結果下載等功能。使用時需要 Python 3.8 或更高版本。至於官方的 JavaScript SDK 則支援 Node.js 和 TypeScript,可透過對應的 npm 套件來安裝。
官方的 GitHub 還提供了 n8n 社區節點,這些節點可用於在自動化工作流程中監聽任務的完成情況,並將儲存、發布及通知等服務相互連接起來。不過,SDK 與節點的公開並不意味著 Cleanvoice 的核心 AI 模型也是開源的。
開源狀態
Cleanvoice平台、語音處理模型、訓練代碼以及模型權重並未開源,主要以雲服務的形式提供。官方的Python SDK採用MIT許可證,而JavaScript SDK及用於存取商業API的整合代碼則需分別參考相關的許可證條款與API規定。
GitHub上名稱相似的CleanVoice、ClearVoice或音頻增強專案可能與Cleanvoice AI公司無關,不能視為其本地離線版本。
文件保存與隱私
目前定價的常見問題說明為:原始檔案及編輯後的檔案都會被保存 7 天,之後就會被永久刪除。使用者仍應主動下載結果並在本地建立備份,不能將 Cleanvoice 的任務頁面當作長期的雲端儲存空間。
在處理客戶訪談、員工會議、醫療、法律相關事務,以及尚未公開的商業內容時,必須確認參與者已給予同意、了解資料傳輸的地點、組織的合規要求,以及資料刪除的相關規定。此外,API工作流程還應限制公開下載的地址,並避免日誌中出現敏感資訊。
Cleanvoice AI使用教學
完成一次基礎任務
- 確認錄音、聲音、音樂及參與者授權;
- 把清晰音頻上傳或錄入Cleanvoice AI;
- 選擇語言、說話人以及自動移除口頭禪等處理設定;
- 使用長靜音與停頓清理生成轉錄、配音或清理結果;
- 逐段檢查姓名、數字、停頓、音量與情緒;
- 導出前確認格式、響度、版權和隱私要求;
建立可重複使用的專業工作流
- 用真實噪聲、口音和多人片段建立測試集;
- 比較自動移除口頭禪、長靜音與停頓清理以及口水聲、呼吸與結巴處理的處理差異;
- 保留原始錄音和未經修改的轉錄;
- 對外發布前安排人工聽審;
- 統計處理時長、錯誤率及額度消耗;
- 定期更新術語表、聲音授權和刪除策略;
適合哪些用戶?
- 定期製作訪談和對話節目的播客團隊;
- 清理有聲書、旁白、網課與會議回放的創作者;
- 需要批量減少口頭禪、停頓和口腔噪聲的剪輯師;
- 希望自動生成轉寫、章節、摘要與推廣文案的運營人員;
- 透過API、Python、JavaScript或n8n來建構音視頻處理流程的開發者。
產品優勢
- 把多種對白清理任務組合在同一流程中;
- 公開套餐均提供完整功能,主要按處理時長區分;
- 同時支援按量包、訂閱和企業定制;
- 訂閱額度可結轉,按量額度有效2年;
- 支援音頻、影片、多軌、時間軸與多種導出格式;
- 提供正式API及Python、JavaScript SDK。
限制與注意事項
- 自動刪除可能誤傷語氣詞、呼吸、輔音和自然停頓,影片還會產生跳切;
- 平台按輸入時長向上取整計費,不按最終縮短後的時長收費;
- 訂閱取消後未用訂閱額度不會長期保留;
- 雲端結果只保存7天,核心模型不能本地部署;
- 轉寫、摘要和社交文案可能出錯,正式節目仍需要人工聽審、事實核對、響度檢查和版權確認;
常見問題
Cleanvoice AI免費嗎?
提供無需信用卡的免費試用,但目前官網並未將其描述為永久免費的方案。若要持續使用,則需要購買按用量計算的點數,或是選擇每月或每年的訂閱服務。
Cleanvoice AI多少錢?
按量包從5小時11美元起;月訂閱從10小時11美元起。
30小時訂閱30美元,100小時訂閱90美元,均為未含VAT的公開美元價。
未用額度會過期嗎?
按量額度購買後有效2年。訂閱額度在持續訂閱時最多結轉月套餐額度的3倍;
取消後只能使用到目前計費週期結束。
支持中文口頭禪嗎?
產品強調多語言口頭禪檢測,實際準確度取決於普通話、方言、口音和錄音品質。中文正式專案應先以短樣本測試並人工試聽。
Cleanvoice有API嗎?
有。官方提供API文件、Python SDK、JavaScript SDK和n8n節點,網頁套餐與API均按處理時長使用Credits。
Cleanvoice是開源的嗎?
核心平台與AI模型不開源;官方Python SDK採用MIT許可證,開放的SDK僅負責調用雲端服務。
桂公網安備45132202000164號