LALAL.AI: O Separador de Áudio com AI Mais Usado no Mundo
Criado para Produtores Musicais, DJs, Podcasters, Editores de Vídeo e Quem Mais Quiser
O LALAL.AI foi lançado em 2020 com o objetivo de tornar a separação de stems rápida, precisa e acessível. Seis anos depois, a plataforma processou quase 64 milhões de separações de áudio apenas em 2025, atendendo a mais de 6,8 milhões de usuários registrados, que é quase o dobro em relação ao ano anterior.
A separação de stems colocou o LALAL.AI em destaque, mas, desde então, a plataforma evoluiu para um conjunto completo de ferramentas de processamento de áudio, utilizado por produtores musicais, DJs, podcasters, editores de vídeo, vocalistas e criadores de karaokê em todo o mundo. O LALAL.AI foi o primeiro serviço a superar o iZotope RX 9, Spleeter by Deezer, e Moises tanto em acessibilidade quanto em precisão na separação de stems, com resultados de comparação publicados que comprovam isso.
Seis Gerações de Redes Neurais
Desde 2020, o LALAL.AI desenvolveu seis gerações de redes neurais: Rocknet, Cassiopeia, Phoenix, Orion, Perseus e Andromeda. Cada geração superou de forma consistente a anterior.
Perseus (lançada em 2024) introduziu a arquitetura transformer na separação de fontes de áudio, figurando entre as primeiras aplicações dessa família de modelos na área, a mesma tecnologia por trás de grandes modelos de linguagem como o ChatGPT. Ela proporcionou uma melhoria significativa na clareza e na precisão da extração de vocais.
Andromeda (2025) é o atual modelo de nuvem principal. Treinada com quatro vezes mais dados que o Perseus, ela processa áudio até 40% mais rápido e apresenta pontuações 10% superiores em testes de referência de SDR (Relação Sinal-Distorção). Ela consolida os dois modos anteriores de Processamento Potencializado em uma única rede unificada, eliminando o conflito entre a extração de detalhes e a prevenção de vazamento de sinal (*cross-bleed*). A Andromeda é o modelo padrão para Removedor de Vocal, Divisor de Stem, Divisor de Vocal Principal e Backing Vocal e Removedor de Eco e Reverb.
Em 2026, o LALAL.AI também lançou a Lynx, um modelo especializado em nuvem desenvolvido para isolamento de voz e remoção de ruído.
Lynx (2026) é construída sobre uma arquitetura proprietária que utiliza um design U-Net com blocos personalizados e um mecanismo de atenção não-local, otimizado para casos de uso integrados e cerca de seis vezes menor que o Andromeda. Ela separa a voz do ruído de forma mais consistente do que modelos anteriores e é o modelo padrão no Limpador Vocal. Também processa os stems de voz e ruído nas ferramentas Divisor de Stem e Removedor Vocal. Desenvolvedores podem acessá-la via API para integrar a funcionalidade de isolamento de voz aos seus próprios produtos.
Além da linha de modelos em nuvem, o LALAL.AI também desenvolveu a Lyra, um modelo construído especificamente para processamento offline, diretamente no dispositivo.
Lyra (2026) é executada no próprio hardware do usuário, sem necessidade de upload de arquivos ou conexão com a internet, e sem consumo de minutos de processamento. Oferece suporte a sete stems: voz, instrumental, bateria, baixo, piano, violão e guitarra. A Lyra está disponível tanto no aplicativo para desktop do LALAL.AI quanto como plugin VST, sendo ideal para fluxos de trabalho integrados a DAWs, apresentações ao vivo e situações onde manter os arquivos de áudio no dispositivo é um requisito obrigatório.
O Que a Plataforma Faz
Sete produtos desenvolvidos com base na separação de áudio e no processamento de voz:
Divisor de Stem separa arquivos de áudio e vídeo em até 10 stems: vocais, instrumental, bateria, baixo, piano, violão, guitarra, sintetizador, cordas e sopros.
Removedor Vocal isola a voz do restante da faixa em diversos tipos de stems.
Limpador de Voz remove ruído de fundo, plosivas vocais e ruídos de manuseio do microfone de gravações de voz e vocais.
Modificador de Voz modifica vozes em gravações de áudio e arquivos de vídeo, com controles de sotaque e tonalidade.
Clonador de Voz cria um modelo de voz de IA personalizado a partir de gravações e amostras de áudio do próprio usuário. Utilizado em audiolivros, narrações de vídeos, anúncios e experimentos vocais.
Removedor de Eco e Reverb remove eco e reverberação de vocais, gravações de voz, músicas e arquivos de vídeo.
Divisor de Vocal Principal e Backing Vocal separa os vocais principais e os backing vocals das músicas, gerando quatro stems: vocal principal, backing vocals, instrumental e instrumental com backing vocals.
Todos os produtos suportam formatos populares de áudio e vídeo: MP3, OGG, WAV, FLAC, AIFF, AAC, M4A, AVI, MP4, MKV, MOV e M4V.
Em Números
Usuários:
6,793,709
registrados ao final de-2025, subindo 3.8 milhões em 2024. Isso representa um crescimento de 79% em relação ao ano anterior.
Volume:
63,811,258
trechos processados em um único ano, totalizando 14,830,175 horas de áudio.
O que as pessoas mais dividem:
32.3M
Vocais
11.5M
Voz
5.5M
Bateria
2.5M
Baixo
2.1M
Guitarra Elétrica
Formatos de upload mais usados:
19,1M de arquivos
MP3
3.1M
MP4
2.1M
M4A
Para Desenvolvedores e Estúdios
API disponibiliza a separação de áudio e o processamento de voz do LALAL.AI como um serviço, permitindo que desenvolvedores integrem a separação de stems, a remoção de ruído e o processamento de voz diretamente em seus próprios produtos SaaS, plataformas de mídia ou fluxos de trabalho de produção.
Plugin VST integra a Lyra a qualquer DAW compatível como um plugin nativo, executado inteiramente no hardware do usuário, sem necessidade de upload de arquivos ou consumo de minutos de assinatura. Ele se encaixa naturalmente nos fluxos de trabalho de produção existentes, e a licença permite a ativação em até três estações de trabalho.
Planos empresariais são feitos sob medida para empresas de mídia e ambientes de produção em larga escala que necessitam de soluções personalizadas, maiores volumes de processamento ou suporte dedicado.
O LALAL.AI também está acessível na web, no desktop (Windows, macOS e Ubuntu), no iOS e no Android.
30ª Edição Anual do Webby Awards, 2026 — Vencedor do People’s Voice

Melhor Uso de IA e Machine Learning, Aplicativos, Software e Imersão
O People’s Voice Award é decidido por votação popular, com milhões de votos computados anualmente. O LALAL.AI superou uma lista de finalistas que incluía Adobe Premiere Object Mask, Beeble AI, Captions AI e Cosmos, em uma competição que contou com mais de 13.000 inscrições de mais de 70 países. No mesmo ano, a plataforma também recebeu a distinção de Webby Honoree na categoria de Ferramentas para Criadores, Criação e Mídia. O Webby Awards foi descrito pelo The New York Times como "a maior honraria da Internet".
Sobre o LALAL.AI
O LALAL.AI é uma plataforma de processamento de áudio utilizada por mais de 6 milhões de produtores musicais, engenheiros de som, DJs, podcasters e profissionais de mídia em todo o mundo. A empresa está sediada em Zug, na Suíça, e é operada pela OmniSale GmbH. Graças à pesquisa contínua em redes neurais, a plataforma evoluiu de uma ferramenta única de separação de faixas (stems) para um conjunto completo de produtos de processamento de áudio, disponíveis para web, desktop, dispositivos móveis, API e DAWs.
Contato: marketing@lalal.ai
