LALAL.AI:全球最多人使用的AI音频分离工具
专为音乐制作人、DJ、播客、视频编辑者及所有创作者打造
LALAL.AI 于 2020 年推出,专注于让音轨分离更快速、精准且易于使用。六年后,该平台仅在 2025 年就处理了近 6,400 万次音频分离任务,服务超过 680 万名注册用户,几乎是前一年的两倍。
音轨分离让 LALAL.AI 一举成名,但此后该平台已发展为全方位的音频处理工具,全球音乐制作人、DJ、播客、视频编辑者、歌手及卡拉 OK 创作者皆在使用。LALAL.AI 是首个在易用性与音轨分离精准度上同时超越 iZotope RX 9、Spleeter by Deezer 及 Moises 的服务,并有 公开的比较结果 作为实证。
六代神经网络
自 2020 年以来,LALAL.AI 已开发出六代神经网络:Rocknet、Cassiopeia、Phoenix、Orion、Perseus 与 Andromeda。每一代的表现皆明显优于前一代。
Perseus(2024 年推出)将 Transformer 架构引入音频来源分离,是该模型家族在该领域的早期应用之一,与 ChatGPT 等大型语言模型背后的技术相同。它在人声提取的清晰度与精准度上带来了显著提升。
Andromeda(2025 年)是目前旗舰级云端模型。其训练数据量为 Perseus 的四倍,音频处理速度提升达 40%,SDR(信号失真比)评分高出 10%。它将先前两种 增强处理 模式整合为单一统一网络,消除了细节提取与防止串音之间的取舍。Andromeda 是人声移除器、音轨分离器、主唱与伴唱分离工具及回声和混响去除器的默认模型。
2026 年,LALAL.AI 亦推出了 Lynx,这是一款专为语音隔离与噪音去除而打造的云端模型。
Lynx(2026 年)基于专有架构,采用 U-Net 设计,结合自定义区块与非局部注意力机制,专为嵌入式应用场景优化,体积约为 Andromeda 的六分之一。它比早期模型更能稳定地将语音与噪音分离,是语音净化器的默认模型。同时也负责音轨分离器与人声移除器中的。开发者可通过 API 存取,将语音隔离功能集成至自有产品中。
除了云端模型系列之外,LALAL.AI 亦开发了 Lyra,这是一款专为设备端离线处理而打造的模型。
Lyra(2026 年)于用户本地硬件上运行,无需上传文件、无需网络连接,亦不扣减处理分钟数。支持七种音轨:人声、器乐、鼓、贝斯、钢琴、木吉他与电吉他。Lyra可于LALAL.AI桌面应用程序及VST插件中使用,非常适合DAW集成工作流程、现场演出,以及需要将音频文件保留于设备端的场景。
平台功能
七大产品,皆围绕音频分离与语音处理打造
音轨分离器 可将音频与视频文件分离为最多 10 种音轨:人声、器乐、鼓、贝斯、钢琴、木吉他、电吉他、合成器、弦乐器与管乐器。
人声移除器 可将人声从音轨中分离,支持多种音轨类型。
语音净化器 可去除语音与人声录音中的背景噪音、人声爆破音及麦克风低频震动。
变声器 可修改音频录音与视频文件中的人声,提供口音与音调调整功能。
语音克隆器 可根据用户自身的录音与音频样本,建立个性化 AI 语音模型。适用于有声书、视频旁白、广告及人声实验。
回声和混响去除器 可清除人声、语音录音、歌曲及视频文件中的回声与混响。
主唱与伴唱分离工具 可分离歌曲中的主唱与和声,输出四种音轨:主唱、和声、器乐,以及含和声之器乐。
所有产品皆支持主流音频与视频格式:MP3、OGG、WAV、FLAC、AIFF、AAC、M4A、AVI、MP4、MKV、MOV 及 M4V。
数据一览
用户:
6,793,709
截至 2025 年底,注册用户数已从 2024 年的 3.8 百万增长至目前规模,年增长率达 79%。
总量:
63,811,258
一年内处理的音轨分离任务,总音频时长超过 14,830,175 小时。
最常分离的音轨类型:
32.3M
人声
11.5M
声音
5.5M
鼓点
2.5M
贝斯
2.1M
电吉他
最常用的上传格式:
1910 万个文件
MP3
3.1M
MP4
2.1M
M4A
适用于开发者与工作室
API 将 LALAL.AI 的音频分离与语音处理功能以服务形式提供,让开发人员能直接将音轨分离、噪音去除及语音处理集成至自有 SaaS 产品、媒体平台或生产流程中。
VST 插件 可将 Lyra 以原生插件形式集成到任何兼容的 DAW 中,完全在用户的硬件上运行,无需上传文件,也不扣除订阅分钟数。它能无缝融入现有的制作工作流程,且授权可激活于多达三台工作站。
企业方案专为媒体公司及大型制作环境所设计,提供定制化解决方案、更高的处理容量或专属技术支持。
LALAL.AI 也支持网页、桌面(Windows、macOS 及 Ubuntu)、iOS 与 Android 等多种平台。
2026年第30届威比奖 —— 人民之声奖得主

最佳 AI 与机器学习应用、软件及沉浸式体验
人民之声奖由公众投票决定,每年皆有数百万张选票参与。LALAL.AI 在超过 70 个国家、13,000 多件参赛作品中脱颖而出,击败包括 Adobe Premiere Object Mask、Beeble AI、Captions AI 及 Cosmos 等入围强敌,成功夺得此奖项。同年,该平台亦荣获威比奖(Webby Awards)创作者、创意与媒体工具类别的荣誉提名(Webby Honoree)。威比奖被《纽约时报》誉为互联网最高荣誉。
关于 LALAL.AI
LALAL.AI 是一个音频处理平台,全球超过 600 万名音乐制作人、工程师、DJ、播客及媒体专业人士均在使用。公司总部位于瑞士楚格(Zug),由 OmniSale GmbH 运营。通过持续的神经网络研究,该平台已从单一的音轨分离工具,发展为一套完整的音频处理产品系列,可于网页、桌面、移动设备、API 及 DAW 环境中使用。
联系方式:marketing@lalal.ai
