LALAL.AI: El separador IA más utilizado por todo el mundo
Desarrollado para productores de música, Djs, podcasters, editores de video y todos los demás
LALAL.AI se lanzó en 2020 para hacer que la separación de stems fuera más rápida, precisa y accesible. Seis años después, la plataforma procesó 64 millones de separaciones de audio solo en 2025 y supera los 6,8 millones de usuarios registrados, casi el doble que el año anterior.
Separación de stems puso a LALAL.AI en el mapa, pero desde entonces la plataforma se ha convertido en un conjunto completo de las herramientas de procesamiento de audio, que utilizan productores de música, DJs, podcasters, editores de video, vocalistas y creadores de karaoke por todo el mundo. LALAL.AI fue el primer servicio en superar iZotope RX 9, Spleeter by Deezer, y Moises en accesibilidad y precisión de separación de stems, con resultados de comparación publicados para confirmarlo.
Seis generaciones de redes neuronales
Desde 2020, LALAL.AI ha desarrollado seis generaciones de redes neuronales: Rocknet, Cassiopeia, Phoenix, Orion, Perseus y Andromeda. Cada generación supera significativamente a la anterior.
Perseus (lanzado en 2024) introdujo la arquitectura transformadora en la separación de fuentes de audio, siendo una de las primeras aplicaciones de esta familia de modelos en este campo, la misma tecnología que impulsa los grandes modelos de lenguaje como ChatGPT. Ofreció una mejora significativa en la claridad y la precisión de la extracción de voces.
Andromeda (2025) es un modelo en la nube principal actual. Entrenado en cuatro veces más datos que Perseus, procesa audio hasta 40% más rápido y mejora en un 10 % su puntuación en las pruebas de referencia SDR (Signal-to-Distortion Ratio). Combina los dos modos anteriores de Procesamiento mejorado en una única red unificada, eliminando el compromiso entre la extracción de detalles y la prevención de la filtración entre pistas . Andromeda es el modelo predeterminado en Eliminador de voz, Separador de stems, Separador de voz principal y secundaria y Eliminador de eco y reverberación.
En 2026, LALAL.AI también introdujo Lynx, un modelo en la nube especializado desarrollado para aislar la voz y eliminar el ruido.
Lynx (2026) está basado en una arquitectura propia que utiliza un diseño U-Net con bloques personalizados y un mecanismo de atención no local, optimizado para casos de uso integrados y aproximadamente seis veces más pequeño que Andromeda. Separa la voz del ruido de forma más consistente que los modelos anteriores y es el modelo predeterminado de Limpiador de voz. También procesa las pistas de voz y ruido en Separador de stems y Eliminador de voz. Los desarrolladores pueden acceder a él mediante la API para integrar el aislamiento de voz en sus propios productos.
Junto a un linaje de modelos en la nube, LALAL.AI también desarrolló Lyra, un modelo creado específicamente para el procesamiento sin conexión en un dispositivo.
Lyra (2026) funciona en el propio dispositivo del usuario, sin necesidad de subir archivos ni de conectarse a Internet, y sin consumir minutos de procesamiento. Admite siete stems: Voces, Instrumental, Batería, Bajo, Piano, Guitarra acústica y Guitarra eléctrica. Lyra está disponible tanto en la aplicación de escritorio de LALAL.AI como en el plugin VST, se adapta perfectamente a flujos de trabajo integrados con DAW, actuaciones en directo y situaciones en las que es imprescindible mantener los archivos de audio en el dispositivo.
Qué hace la plataforma
Siete productos, basados en la separación de audio y el procesamiento de voz
Separador de stems separa archivos de audio y video en hasta 10 stems: Voces, Instrumental, Batería, Bajo, Piano, Guitarra acústica, Guitarra eléctrica, Sintetizador, Instrumentos de cuerda y viento.
Eliminador de voz aísla la voz del resto de la pista en varios tipos de stems.
Limpiador de voz elimina el ruido de fondo, las oclusivas vocales y el ruido de micrófono de voces y grabaciones de voz.
Cambiador de voz modifica voces en grabaciones de audio y archivos de video con controles de acento y tonalidad.
Clonador de voz crea un modelo de voz IA personalizado de grabaciones de usuario y muestras de audio. Se utiliza para audiolibros, videos de voz en off, anuncios, y experimentos vocales.
Eliminador de eco y reverberación elimina el eco y la reverberación de voces, grabaciones de voz, canciones y archivos de video.
Separador de voz principal y secundaria separa las voces principales y secundarias de canciones, produciendo cuatro stems: voz principal, coros, instrumental e instrumental con coros.
Todos los productos están compatibles con todos los formatos de audio y video populares: MP3, OGG, WAV, FLAC, AIFF, AAC, M4A, AVI, MP4, MKV, MOV, y M4V.
En cifras
Usuarios:
6,793,709
registrados por fin de 2025, frente a los 3.8 millones en 2024. Es un crecimiento del 79% respecto del año pasado.
Volumen:
63,811,258
separaciones procesadas en un solo año, con un total de 14,830,175 horas de audio.
Lo que más separan los usuarios:
32.3M
Voces
11.5M
Voz
5.5M
Batería
2.5M
Bajo
2.1M
Guitarra eléctrica
Formatos de subida más utilizados:
19.1M archivos
MP3
3.1M
MP4
2.1M
M4A
Para desarrolladores y studios
API hace que la separación de audio y el procesamiento de voz LALAL.AI estén disponibles como un servicio permitiendo a desarrolladores integrar la separación de stems, eliminación de ruido y el procesamiento de voz directamente en sus propios productos SaaS, plataformas multimedia y procesos de desarrollo de producto.
VST Plugin integra Lyra en cualquier DAW compatible como un plugin nativo que funciona completamente en el hardware del usuario, sin necesidad de subir archivos ni deducir minutos de la suscripción. Se adapta de forma natural a los flujos de trabajo de producción existentes y la licencia puede activarse en hasta tres estaciones de trabajo.
Planes de empresa están creados para las empresas multimedia y entornos de producción de gran escala que necesitan las soluciones personalizadas, los volúmenes de procesamiento mas altos y soporte dedicado.
LALAL.AI está también disponible en web, desktop (Windows, macOS y Ubuntu), iOS y Android.
La 30 edición de los Webby Awards, 2026 — Ganador del People’s Voice Award

El mejor uso de IA y aprendizaje automático, aplicaciones, software y experiencias inmersivas
The People’s Voice Award se decide mediante votación pública, con millones de votos emitidos cada año. LALAL.AI ganó frente a una lista de finalistas que incluía Adobe Premiere Object Mask, Beeble AI, Captions AI y Cosmos, en una competición que recibió más de 13 000 candidaturas de más de 70 países. Ese mismo año, la plataforma también recibió la distinción Webby Honoree en la categoría Creator, Creative & Media Tools . The New York Times ha llamado a los Webby Awards «el mayor honor de Internet».
Acerca de LALAL.AI
LALAL.AI es una plataforma de procesamiento de audio utilizada por más de 6 millones de productores musicales, ingenieros, DJ, podcasters y profesionales de los medios de todo el mundo. La empresa tiene su sede en Zug, Suiza, y está gestionada por OmniSale GmbH. Gracias a la investigación continua en redes neuronales, ha pasado de ser una única herramienta de separación de stems a convertirse en un conjunto completo de productos de procesamiento de audio disponibles en entornos web, de desktop, móviles, API y DAW.
Contactos: marketing@lalal.ai
