LALAL.AI是什麼?
LALAL.AI是一個基於神經網路的音樂與語音分離平台,能將混合的音頻或影片拆分成人聲、伴奏以及不同的樂器聲部。它同時提供Voice Cleaner、去回聲與混響功能、主唱與和聲的分離功能、Voice Changer、Voice Cloner等工具,且適用於網頁、桌面端、手機、VST插件以及開發者API。
它適合用於製作伴奏、混音、採樣、練習軌、對白清理以及內容的再編輯。AI分軌並不能獲得原始的錄音資料:當多個聲音在相同的頻率與時間上重疊時,輸出結果仍可能出現串音、相位問題,以及高頻損失的現象。
Vocal Remover人聲與伴奏分離
Vocal Remover可將歌曲拆成人聲與伴奏兩軌,用於卡拉OK、翻唱練習、Remix、對白提取和參考分析。用戶可先試聽預覽,再決定是否處理並下載完整結果。
混響較大的主唱、多人合唱、失真吉他和人聲頻段接近時,伴奏中可能殘留人聲,獨立人聲中也可能帶入鑼片或合成器。對發布級項目應比較多個網路和處理設定。
10類Stem分離
目前雲端可供選擇的10種分離類型包括:人聲與器樂、鼓、貝斯、電吉他、原聲吉他、鋼琴、合成器、人聲與雜音、絃樂器以及管樂器。
用戶可在同一個上傳的檔案上切換目標,而不必每次重新上傳。
這些選項多為目標Stem與其餘內容的兩軌結果,並不等同於一次生成完整的10軌工程。目前的計算還會乘以所選分離類型的數量,因此同時選擇多類Stem時耗費會增加。
Andromeda神經網路
Andromeda是LALAL.AI目前重點使用的新一代Audio Transformer網絡,它在Vocal and Instrumental、Voice and Noise以及相關工具中皆被設定為預設選項,且其應用範圍已擴展到Drums和Bass。官方表示,其訓練數據量約為Perseus的4倍,處理速度最高可快約40%,而SDR方面的表現則可提升約10%。
這些是官方測試結果,並不代表每首歌曲的提升幅度都相同。平台仍保留Perseus、Orion等網路用於部分任務的比較;
用戶應以自己的困難素材試聽,而不是只按模型新舊選擇。
Voice Cleaner語音清理
Voice Cleaner用於從錄音中分離Voice與Noise,可降低背景音樂、麥克風的雜音、爆破音、環境噪聲及其他干擾,適合播客、訪談、網課、會議與影視對白。
當雜音與語音高度重疊,或錄音已經出現削波現象時,清理後的結果可能會失真。Voice Cleaner並非用於即時會議降噪的工具,也無法恢復那些未被麥克風捕捉到的語音資訊。
Echo與Reverb Remover
「去回聲與混響工具」可以讓那些在房間中產生過多回聲的人聲、歌曲或影片對白變得更乾淨,從而便於重新混音或提升可理解度。在「Stem Splitter」中,也提供了用於控制人聲回聲的相關設定。
混響本身可能是音樂作品的一部分,完全去除會改變氣氛、尾音和音色。建議先預覽不同強度,並保留原始檔案用於A/B比較。
主唱與和聲分離
Lead/Back Splitter可進一步把主唱與和聲拆開,適合製作練習軌、重編人聲層次和分析編曲。官方桌面雲端工作流可以生成主唱、和聲及其對應剩餘內容。
疊唱、齊唱、聲音與影像的重疊,以及大量的效果器,都會降低辨別的準確度。如此得出的結果無法證明是哪位歌手所演唱的,也無法自動獲得該人聲表演的使用權。
Voice Changer與Voice Cloner
Voice Changer可對音樂、錄音和影片中的聲音進行轉換,費用是按生成的輸出時長來計算的。Voice Cloner則讓使用者能夠用自己的錄音來訓練個人語音模組,從而獲得一致的合成聲音。
只能克隆自己或已獲得明確授權的聲音。不得利用名人、員工、客戶或普通人的聲音進行冒充、詐騙、誤導或未經同意的商業代言;
敏感場景還應標註合成語音。
輸入與輸出格式
桌面端公開支援的音頻格式包括MP3、OGG、WAV、FLAC、AIFF、AAC和M4A,影片則包括AVI、MP4、MKV、MOV和M4V。在雲端上,音頻可以轉換為MP3、WAV、FLAC、OGG、AAC或AIFF格式,或者保持原來的格式。
有損源文件中的壓縮偽影會被分離模型進一步放大。重要的音樂製作應優先使用無損源,並在下載後檢查採樣率、位深度、響度、同步以及頭尾長度。
Starter免費方案
Starter服務永久免費,每月可享受10分鐘的Relaxed Queue服務,單個檔案的大小上限為200MB,且可免費預覽結果。不過,無法下載完整的結果,也不支援批量處理功能。它適合用於檢驗短篇幅的難度較高的素材品質,而不適合用於完成正式的專案。
Starter沒有Fast Queue。Relaxed Queue會按伺服器空閒容量處理,等待時間隨負載變化;
免費分鐘的具體刷新及使用狀態以帳戶顯示為準。
價格與版本對比
| 套餐或版本 | 價格、額度與核心權益 |
|---|---|
| Lite訂閱價格 | Lite的年費為90美元,相當於每月7.5美元。此方案包含無限次数的Relaxed Queue服務、每月90分鐘的Fast Queue服務、單個檔案大小上限為2GB,此外還可下載完整結果並進行批量處理。使用者可在網路、桌面端和行動裝置上共享帳戶額度。不過,Lite版本不包含VST插件、本地Lyra處理功能以及API。那些需要低頻率處理資料,但又不急於完成處理任務的使用者,可以選擇使用無限次數的Relaxed Queue服務;當Fast Queue的時間用完後,系統會自動切換到Relaxed Queue模式,雖然品質相同,但處理速度則有所差異。 |
| Pro訂閱價格 | Pro年付總價180美元,折算為15美元/月,包含無限次Relaxed Queue服務、每月250分鐘的Fast Queue服務、2GB的檔案儲存空間、結果下載功能、批量處理功能、新功能的優先體驗權,以及VST插件、API和桌面端Lyra本地處理功能。Pro適合製作人、開發者以及那些重視離線處理功能的用戶。官網上也可能按月顯示不同的價格,而價格則以當前的年付折算價為準;稅費、貨幣種類及促銷活動的詳情則以結帳頁面所示為準。 |
Lite訂閱價格
Lite年付總價90美元,折算為7.5美元/月。現行方案包含無限次Relaxed Queue服務、每月90分鐘的Fast Queue服務、單個檔案最大大小為2GB,還可下載完整結果並進行批量處理,且可在網路、桌面端和行動端共享帳戶額度。
Lite不包含VST插件、本地Lyra處理和API。需要低頻但不急於處理的用戶可以依靠無限Relaxed Queue;
Fast分鐘用完後系統自動轉入Relaxed Queue,品質相同但速度優先級不同。
Pro訂閱價格
Pro年付總價180美元,折算為15美元/月,包含無限Relaxed Queue、每月250分鐘Fast Queue、2GB的檔案儲存空間、結果下載功能、批次處理功能、新功能的優先體驗權,以及VST插件、API和桌面端Lyra本地處理功能。
Pro適合製作人、開發者以及重視離線處理的用戶。官網也可能按月顯示不同的金額,目錄則採用當前的年付折算價;
稅費、幣種和促銷以結算頁面為準。
Fast與Relaxed Queue
兩種隊列使用相同的分離品質。每個計費月開始時,付費任務會先消耗Fast分鐘;
Fast額度用完後會自動進入不限時長的Relaxed Queue,用戶無法手動在兩者之間切換。
未使用的Fast分鐘不會結轉,將在下一個週期重新開始計算。若取消此功能,則可繼續使用付費功能及剩餘的點數,直到當前週期結束為止,之後又會回到Starter模式,此時剩餘的Fast分鐘將失效,且也不再享有無限的Relaxed Queue服務。
訂閱不可按剩餘期退款。
分鐘如何計算?
一般情況下,是根據檔案的長度來計算費用。而Vocal Remover和Stem Splitter則是按照「檔案長度乘以所選的分離類型數量」來計算的,例如,10分鐘長度的歌曲,如果選擇了3種分離方式,那麼費用就會是30分鐘的數值。
Voice Changer按生成輸出的時長扣除。
因此Fast分鐘並不簡單等於可上傳歌曲的總時長。在開始進行多Stem批次處理之前,應先計算目標軌道的數量,必要時還需透過預覽來確認網路與設定是否正常。
Top-Up額外分鐘
無需更換訂閱方案,即可購買一次性的 Fast Queue 补充包:Master 版 750 分鐘售價 50 美元、Premium 版 3000 分鐘售價 190 美元、Enterprise 版 5000 分鐘售價 300 美元。補充的分鐘數、適用功能及有效期限,請在購買頁面確認。
舊資料常把LALAL.AI描述為Lite、Plus、Pro一次性永久分鐘包,這已經不符合目前官網的主定價。現行主方案為Starter、Lite和Pro訂閱,再加Top-Up補充Fast分鐘。
桌面應用
LALAL.AI 桌面版支援 Windows 10/11、macOS 10.15或更高版本,以及 Ubuntu 22.04或更高版本。其雲端模式的功能與網頁版相似,可一次選擇多達20個音訊或影片檔案,並可在本地設定輸出目錄。
桌面應用可免費下載,但完整下載仍需要付費帳戶。雲端處理需要上網並消耗共享分鐘;
帳戶可在多台設備登入。
Lyra本地離線分軌
Pro用戶可以在桌面端使用Lyra本地模型,素材不會上傳到伺服器,可離線處理,也不會扣除Fast或Relaxed模式下的使用時間,僅需偶爾連網以驗證訂閱狀態。Lyra最多可同時啟動3台電腦。
本地Lyra目前支援7種類型:人聲、器樂、鼓聲、貝斯、鋼琴、原聲吉他以及電吉他,類型數量少於雲端的10種,也沒有所有雲端才有的專屬設定。硬體可透過GPU或NPU來加速處理,實際速度則取決於裝置的性能。
VST插件
VST Plugin屬於Pro方案,可在相容的DAW中直接進行本地Stem提取,適合Logic、Ableton Live、FL Studio、Cubase、Reaper等製作流程。該插件使用Lyra離線模型,不會上傳音頻,也不會消耗流量。
插件格式、DAW相容性、操作系統以及可使用的裝置數量,應以下載頁面及EULA中的說明為準。離線模型更適合用於快速迭代,而複雜的模型則可以再與雲端上的Andromeda成果進行比較。
行動應用
官方提供iPhone、iPad和Android應用,可上傳歌曲與影片、預覽並下載分離後的結果。訂閱服務可與分鐘數以及Web、桌面端共享,並非在每個平台上單獨發放。
行動裝置適合快速擷取及試聽,而長型檔案的管理、批次處理以及專業後期製作則較適合在電腦端進行。透過應用商店購買時,其價格與訂閱管理的位置可能會與網頁上有所不同。
API
LALAL.AI提供Public API v1,可上傳檔案以獲得source ID、提交分離任務、查詢狀態、取得結果,並刪除伺服器上的源文件與Stem。該API支援多Stem、Voice Cleaner、Voice Changer、Voice Cloning等功能,Pro方案則開放使用。
API使用License令牌進行認證。在生產環境中,應將令牌儲存在伺服器端,並處理文件過期、異步輪詢、併發、失敗重試、刪除請求以及用戶版權聲明等相關事項。
高用量或嵌入式產品可聯絡企業方案。
GitHub與開源狀態
官方運營主體OmniSale GmbH在GitHub上公開了LALAL.AI API的範例以及與OpenAPI相關的資源,這些資源有助於開發者實現上傳、分離、清理以及任務查詢等功能。不過,這些範例並不等同於核心模型的開源版本。
Andromeda、Perseus、Orion、Lyra的訓練代碼與完整權重並未公開,LALAL.AI整體屬於專有的商業服務。Demucs等同類開源項目與LALAL.AI之間並沒有官方上的從屬關係。
版權與商業使用
分離技術不會為用戶創造原歌曲、人聲、伴奏或採樣的版權。翻唱、Remix、影視配樂、廣告、訓練數據及商業發行仍需獲得錄音、詞曲、表演、人格與樣本的許可。
即使只提取幾秒,也可能構成受保護素材。未發布的母帶及保密專案,應優先考慮使用Pro的Lyra進行本地處理,並確認相關產品條款及組織的安全要求。
LALAL.AI使用教學
完成一次基礎任務
- 註冊LALAL.AI並創建僅用於測試環境的API Key;
- 根據輸入類型、上下文、品質、速度和價格選擇模型;
- 先調用Vocal Remover人聲與伴奏分離完成最小請求並檢查返回結構;
- 再用10類Stem分離測試流式輸出、參數和異常響應;
- 記錄Tokens、呼叫次數、延遲、錯誤率及單次成本;
- 把密鑰移入服務端密鑰管理器後再接入正式應用;
建立可重複使用的專業工作流
- 為開發、測試與生產環境使用不同密鑰與額度;
- 按Vocal Remover人聲與伴奏分離、10類Stem分離和Andromeda神經網絡建立代表性評測集;
- 設定超時、併發、重試、限流和預算上限;
- 對輸出執行事實、安全、格式和敏感資訊檢查;
- 監控模型版本、價格、延遲和失敗率變化;
- 準備降級模型、熔斷和人工接管方案;
適合哪些用戶?
- 製作卡拉OK伴奏、Remix和採樣的音樂人;
- 提取鼓、貝斯、吉他、鋼琴等練習軌的路學者;
- 清理對白、播客和課程錄音的內容團隊;
- 需要主唱與和聲分離、去混響及多模型比較的製作人;
- 透過VST、本地離線模型或API建立工作流的專業用戶。
產品優勢
- 雲端提供10類Stem選項和多種神經網路;
- 覆蓋音樂分軌、語音降噪、去混響和人聲層次拆分;
- 支援Web、三大桌面系統、iOS和Android;
- Pro提供不扣分的Lyra離線處理與VST;
- 付費方案提供無限Relaxed Queue;
- 有正式API、文件與官方GitHub範例。
限制與注意事項
- 免費Starter不能下載完整結果;
- Fast分鐘不結轉,多Stem按文件時長乘以類型數量扣費;
- RelaxedQueue的等待時間不固定;
- AI分離仍可能產生串音、相位和音色損失;
- 本地Lyra只屬於Pro且Stem與設定少於雲端;
- 核心模型不開源,使用分離結果也不會自動獲得版權和商業許可;
常見問題
LALAL.AI免費嗎?
Starter永久免費,每月有10分鐘的Relaxed Queue時長,可以上傳及預覽,但無法下載完整結果。若要下載完整內容,則需要Lite或Pro版本。
LALAL.AI多少錢?
Lite版每年需支付90美元,相當於每月7.5美元;Pro版則每年需支付180美元,相當於每月15美元。
另有750、3000和5000 Fast分鐘Top-Up。
可以一次分成10條完整音軌嗎?
平台支援10類目標分離,但通常會依選定的Stem與其餘內容一起輸出,而且每種分離類型都會增加時間消耗,並非一次就能生成完整的10軌。
可以離線使用嗎?
可以。Pro用戶可在桌面應用或VST中使用Lyra本地模型,音頻不上傳且不扣分鐘,但本地可用的Stem數量少於雲端。
LALAL.AI有API嗎?
有。Pro開放Public API v1,官方提供文件、OpenAPI說明和GitHub範例。
LALAL.AI是開源的嗎?
不開源。官方僅公開API範例等整合資源,Andromeda與Lyra等核心模型和權重未公開。
桂公網安備45132202000164號