LALAL.AI是什么?
LALAL.AI是一款基于神经网络的音乐与语音源分离平台,可把混合音频或视频拆成人声、伴奏及不同乐器Stem。它同时提供Voice Cleaner、去回声与混响、主唱和和声分离、Voice Changer、Voice Cloner等工具,并覆盖网页、桌面、手机、VST插件和开发者API。
它适合制作伴奏、混音、采样、练习轨、对白清理和内容再编辑。AI分轨并不是获取原始录音工程:当多个声音在相同频率和时间重叠时,输出仍可能有串音、相位、金属感和高频损失。
Vocal Remover人声与伴奏分离
Vocal Remover可将歌曲拆成人声与伴奏两轨,用于卡拉OK、翻唱练习、Remix、对白提取和参考分析。用户可先试听预览,再决定是否处理和下载完整结果。
混响较大的主唱、多人合唱、失真吉他和人声频段接近时,伴奏中可能残留人声,独立人声中也可能带入镲片或合成器。对发布级项目应比较多个网络和处理设置。
10类Stem分离
当前云端可选择的10类分离包括:Vocal and Instrumental、Drums、Bass、Electric Guitar、Acoustic Guitar、Piano、Synthesizer、Voice and Noise、String Instruments和Wind Instruments。
用户可在同一上传文件上切换目标,而不必每次重新上传。
这些选项多为目标Stem与其余内容的两轨结果,并不等同于一次生成完整10轨工程。当前分钟计算还会乘以所选分离类型数量,因此同时选择多类Stem时消耗会增加。
Andromeda神经网络
Andromeda是LALAL.AI当前重点使用的新一代Audio Transformer网络,在Vocal and Instrumental、Voice and Noise以及相关工具中作为默认选择,并已扩展到Drums和Bass。官方称其训练数据量约为Perseus的4倍,基准处理最高快约40%,SDR提升约10%。
这些是官方测试结果,不代表每首歌曲都提升相同幅度。平台仍保留Perseus、Orion等网络供部分任务比较;
用户应以自己的困难素材试听,而不是只按模型新旧选择。
Voice Cleaner语音清理
Voice Cleaner用于从录音中分离Voice与Noise,可降低背景音乐、麦克风隆隆声、爆破音、环境噪声和其他干扰,适合播客、访谈、网课、会议与影视对白。
当噪声与语音高度重叠,或录音已经削波时,清理结果可能失真。Voice Cleaner不是实时会议降噪,也不能恢复没有被麦克风采集到的语音信息。
Echo与Reverb Remover
去回声与混响工具可让房间感较重的人声、歌曲或视频对白更干,便于重新混音或提高可懂度。Stem Splitter内也提供Vocal Reverb Control和De-Echo相关设置。
混响本身可能是音乐作品的一部分,完全去除会改变氛围、尾音和音色。建议先预览不同强度,并保留原始文件用于A/B比较。
Lead与Backing Vocal分离
Lead/Back Splitter可进一步把主唱与和声拆开,适合制作练习轨、重编人声层次和分析编曲。官方桌面云端工作流可以生成主唱、和声及其对应剩余内容。
叠唱、齐唱、声像重叠和大量效果器会降低区分准确度。分离结果不能证明某位歌手的身份,也不能自动获得人声表演的使用权。
Voice Changer与Voice Cloner
Voice Changer可对音乐、录音和视频中的声音进行转换,分钟按生成输出时长扣除。Voice Cloner允许用户以自己的录音训练个人语音包,用于获得一致的合成声音。
只能克隆自己或已经取得明确授权的声音。不得利用名人、员工、客户或普通人的声音进行冒充、诈骗、误导或未经同意的商业代言;
敏感场景还应标注合成语音。
输入与输出格式
桌面端公开支持的音频格式包括MP3、OGG、WAV、FLAC、AIFF、AAC和M4A,视频包括AVI、MP4、MKV、MOV和M4V。云端可将音频结果输出为MP3、WAV、FLAC、OGG、AAC或AIFF,也可默认保持原格式。
有损源文件中的压缩伪影会被分离模型进一步放大。重要音乐制作优先使用无损源,并在下载后检查采样率、位深、响度、同步和头尾长度。
Starter免费方案
Starter永久免费,每月提供10分钟Relaxed Queue、单文件最大200MB和免费结果预览,但不能下载完整结果,也不支持批量处理。它适合用一小段困难素材判断质量,而不是完成正式项目。
Starter没有Fast Queue。Relaxed Queue会按服务器空闲容量处理,等待时间随负载变化;
免费分钟的具体刷新和使用状态以账户显示为准。
价格与版本对比
| 套餐或版本 | 价格、额度与核心权益 |
|---|---|
| Lite订阅价格 | Lite年付总价90美元,折合7.5美元/月。当前方案包含无限Relaxed Queue、每月90分钟Fast Queue、单文件最大2GB、完整结果下载和批量处理,可在Web、桌面与移动端共享账户额度。Lite不包含VST插件、本地Lyra处理和API。需要低频但不急于处理的用户可以依靠无限Relaxed Queue;Fast分钟用完后系统自动转入Relaxed Queue,质量相同但速度优先级不同。 |
| Pro订阅价格 | Pro年付总价180美元,折合15美元/月,包含无限Relaxed Queue、每月250分钟Fast Queue、2GB文件、结果下载、批量处理、新功能优先体验,以及VST插件、API和桌面端Lyra本地处理。Pro适合制作人、开发者和重视离线处理的用户。官网也可能按月展示不同金额,目录采用当前年付折算价;税费、币种和促销以结算页面为准。 |
Lite订阅价格
Lite年付总价90美元,折合7.5美元/月。当前方案包含无限Relaxed Queue、每月90分钟Fast Queue、单文件最大2GB、完整结果下载和批量处理,可在Web、桌面与移动端共享账户额度。
Lite不包含VST插件、本地Lyra处理和API。需要低频但不急于处理的用户可以依靠无限Relaxed Queue;
Fast分钟用完后系统自动转入Relaxed Queue,质量相同但速度优先级不同。
Pro订阅价格
Pro年付总价180美元,折合15美元/月,包含无限Relaxed Queue、每月250分钟Fast Queue、2GB文件、结果下载、批量处理、新功能优先体验,以及VST插件、API和桌面端Lyra本地处理。
Pro适合制作人、开发者和重视离线处理的用户。官网也可能按月展示不同金额,目录采用当前年付折算价;
税费、币种和促销以结算页面为准。
Fast与Relaxed Queue
两种队列使用相同分离质量。每个计费月开始时,付费任务先消耗Fast分钟;
Fast额度用完后自动进入不限时长的Relaxed Queue,用户不能手动在两者间切换。
未使用Fast分钟不结转,下个周期重置。取消后可使用付费功能和余额到当前周期结束,随后回到Starter,剩余Fast分钟失效,也不再拥有无限Relaxed Queue;
订阅不可按剩余期退款。
分钟如何计算?
普通处理按文件时长扣除。Vocal Remover和Stem Splitter按“文件时长乘以选择的分离类型数量”计算,例如10分钟歌曲选择3类Stem会计为30分钟。
Voice Changer按生成输出的时长扣除。
因此Fast分钟不是简单等于可上传歌曲总时长。开始多Stem批处理前应先计算目标轨数量,必要时先用预览确认网络和设置。
Top-Up额外分钟
无需更换订阅即可购买一次性Fast Queue补充包:Master 750分钟50美元、Premium 3000分钟190美元、Enterprise 5000分钟300美元。补充分钟、适用功能和有效状态应在购买页确认。
旧资料常把LALAL.AI描述为Lite、Plus、Pro一次性永久分钟包,这已经不符合当前官网主定价。现行主方案为Starter、Lite和Pro订阅,加Top-Up补充Fast分钟。
桌面应用
LALAL.AI Desktop支持Windows 10/11、macOS 10.15或更高版本和Ubuntu 22.04或更高版本。云端模式功能与网页相近,可批量选择最多20个音频或视频文件,并在本地设置输出目录。
桌面应用可免费下载,但完整下载仍需要付费账户。云端处理需要联网并消耗共享分钟;
账户可在多台设备登录。
Lyra本地离线分轨
Pro用户可以在桌面端使用Lyra本地模型,素材不上传服务器、可以离线处理,也不扣Fast或Relaxed分钟,仅需偶尔联网验证订阅。Lyra可同时激活最多3台电脑。
本地Lyra当前支持7类:Vocals、Instrumental、Drums、Bass、Piano、Acoustic Guitar和Electric Guitar,少于云端10类,也没有全部云端专属设置。硬件可利用GPU或NPU加速,实际速度取决于设备。
VST插件
VST Plugin属于Pro方案,可在兼容DAW中直接进行本地Stem提取,适合Logic、Ableton Live、FL Studio、Cubase、Reaper等制作流程。插件使用Lyra离线模型,不上传音频,也不消耗分钟。
插件格式、DAW兼容性、操作系统和授权设备数应以下载页与EULA为准。离线模型更适合快速迭代,复杂最终分离可再与云端Andromeda结果比较。
移动应用
官方提供iPhone、iPad和Android应用,可上传歌曲与视频、预览和下载分离结果。订阅与分钟和Web、桌面端共享,不是每个平台单独发放。
移动设备适合快速提取和试听,长文件管理、批量处理与专业后期通常更适合桌面端。通过应用商店购买时,价格和订阅管理位置可能与网页不同。
API
LALAL.AI提供Public API v1,可上传文件获得source ID、提交分离任务、查询状态、获取结果并删除服务器上的源文件与Stem。API覆盖多Stem、Voice Cleaner、Voice Changer、Voice Cloning等能力,Pro方案开放访问。
API使用License令牌认证。生产环境应将令牌保存在服务端,处理文件过期、异步轮询、并发、失败重试、删除请求和用户版权声明。
高用量或嵌入式产品可联系企业方案。
GitHub与开源状态
官方运营主体OmniSale GmbH在GitHub公开了LALAL.AI API示例与OpenAPI相关资源,帮助开发者实现上传、分离、清理和任务查询。这些示例不等于核心模型开源。
Andromeda、Perseus、Orion、Lyra的训练代码与完整权重未公开,LALAL.AI总体属于专有商业服务。Demucs等同类开源项目与LALAL.AI没有官方从属关系。
版权与商业使用
分离技术不会为用户创造原歌曲、人声、伴奏或采样的版权。翻唱、Remix、影视配乐、广告、训练数据和商业发行仍需获得录音、词曲、表演、人格与样本许可。
即使只提取几秒,也可能构成受保护素材。未发布母带和保密项目优先考虑Pro的Lyra本地处理,并核对产品条款和组织安全要求。
LALAL.AI使用教程
完成一次基础任务
- 注册LALAL.AI并创建仅用于测试环境的API Key;
- 根据输入类型、上下文、质量、速度和价格选择模型;
- 先调用Vocal Remover人声与伴奏分离完成最小请求并检查返回结构;
- 再用10类Stem分离测试流式输出、参数和异常响应;
- 记录Tokens、调用次数、延迟、错误率和单次成本;
- 把密钥移入服务端密钥管理器后再接入正式应用;
建立可复用的专业工作流
- 为开发、测试和生产环境使用不同密钥与额度;
- 按Vocal Remover人声与伴奏分离、10类Stem分离和Andromeda神经网络建立代表性评测集;
- 设置超时、并发、重试、限流和预算上限;
- 对输出执行事实、安全、格式和敏感信息检查;
- 监控模型版本、价格、延迟和失败率变化;
- 准备降级模型、熔断和人工接管方案;
适合哪些用户?
- 制作卡拉OK伴奏、Remix和采样的音乐人;
- 提取鼓、贝斯、吉他、钢琴等练习轨的学习者;
- 清理对白、播客和课程录音的内容团队;
- 需要主唱与和声分离、去混响和多模型比较的制作人;
- 通过VST、本地离线模型或API建立工作流的专业用户。
产品优势
- 云端提供10类Stem选项和多种神经网络;
- 覆盖音乐分轨、语音降噪、去混响和人声层次拆分;
- 支持Web、三大桌面系统、iOS和Android;
- Pro提供不扣分钟的Lyra离线处理与VST;
- 付费方案提供无限Relaxed Queue;
- 有正式API、文档与官方GitHub示例。
限制与注意事项
- 免费Starter不能下载完整结果;
- Fast分钟不结转,多Stem按文件时长乘以类型数量扣费;
- RelaxedQueue等待时间不固定;
- AI分离仍可能产生串音、相位和音色损失;
- 本地Lyra只属于Pro且Stem与设置少于云端;
- 核心模型不开源,使用分离结果也不会自动获得版权和商业许可;
常见问题
LALAL.AI免费吗?
Starter永久免费,每月10分钟Relaxed Queue,可上传和预览,但不能下载完整结果。完整下载需要Lite或Pro。
LALAL.AI多少钱?
Lite年付90美元,折合7.5美元/月;Pro年付180美元,折合15美元/月。
另有750、3000和5000 Fast分钟Top-Up。
可以一次分成10条完整音轨吗?
平台支持10类目标分离,但通常按选定Stem与其余内容输出,而且每种分离类型都会增加分钟消耗,并非固定一次生成完整10轨。
可以离线使用吗?
可以。Pro用户可在桌面应用或VST中使用Lyra本地模型,音频不上传且不扣分钟,但本地可用Stem少于云端。
LALAL.AI有API吗?
有。Pro开放Public API v1,官方提供文档、OpenAPI说明和GitHub示例。
LALAL.AI开源吗?
不开源。官方只公开API示例等集成资源,Andromeda与Lyra等核心模型和权重未公开。
桂公网安备45132202000164号