LALAL.AI: Il separatore audio AI più utilizzato al mondo
Creato per produttori musicali, DJ, podcaster, montatori video e tutti gli altri
LALAL.AI è stata lanciata nel 2020 con l’obiettivo di rendere la stem separation veloce., precisa e accessibile. Sei anni dopo, solo nel 2025 la piattaforma ha elaborato quasi 64 milioni di split audio, servendo oltre 6,8 milioni di utenti registrati, quasi il doppio rispetto all'anno precedente.
La separazione delle tracce ha reso celebre LALAL.AI, ma la piattaforma si è da allora evoluta in una suite completa di strumenti per l'elaborazione audio, utilizzata da produttori musicali, DJ, podcaster, video editor, cantanti e creatori di karaoke in tutto il mondo. LALAL.AI è stato il primo servizio a superare iZotope RX 9, Spleeter by Deezer e Moises sia per l’accessibilità che per la precisione dello stem-splitting, con risultati comparativi pubblicati a supporto.
Sei Generazioni di Reti Neurali
Dal 2020, LALAL.AI ha sviluppato sei generazioni di reti neurali: Rocknet, Cassiopeia, Phoenix, Orion, Perseus e Andromeda. Ogni generazione ha superato misurabilmente la precedente.
Perseus (rilasciato nel 2024) ha introdotto l'architettura transformer nella separazione delle sorgenti audio, tra le prime applicazioni di questa famiglia di modelli nel settore, la stessa tecnologia alla base dei grandi modelli linguistici come ChatGPT. Ha portato un miglioramento significativo in termini di chiarezza e precisione nell'estrazione vocale.
Andromeda (2025) è l'attuale modello di punta nel cloud. Addestrato su quattro volte più dati rispetto a Perseus, elabora l'audio fino al 40% più velocemente e ottiene un punteggio superiore del 10% nei benchmark SDR (Signal-to-Distortion Ratio). Consolida le due precedenti modalità Enhanced Processing in un'unica rete unificata, eliminando il compromesso tra estrazione dei dettagli e prevenzione del cross-bleed. Andromeda è il modello predefinito in Vocal Remover, Stem Splitter, Lead & Back Vocal Splitter ed Echo & Reverb Remover.
Nel 2026, LALAL.AI ha inoltre introdotto Lynx, un modello cloud specializzato progettato per l'isolamento vocale e la rimozione del rumore.
Lynx (2026) è basato su un'architettura proprietaria che utilizza un design U-Net con blocchi personalizzati e un meccanismo di attenzione non locale, ottimizzato per casi d'uso embedded e circa sei volte più piccolo di Andromeda. Separa la voce dal rumore in modo più coerente rispetto ai modelli precedenti ed è il modello predefinito in Voice Cleaner. Gestisce inoltre gli stem Voice e Noise in Stem Splitter e Vocal Remover. Gli sviluppatori possono accedervi tramite API per integrare l'isolamento vocale nei propri prodotti.
Accanto alla linea di modelli cloud, LALAL.AI ha anche sviluppato Lyra, un modello progettato specificamente per l'elaborazione locale e offline.
Lyra (2026) viene eseguita sull'hardware dell'utente, senza caricamenti di file, senza necessità di connessione Internet e senza consumo di minuti di elaborazione. Supporta sette stem: Voce, Strumentale, Batteria, Basso, Piano, Chitarra Acustica e Chitarra Elettrica. Lyra è disponibile sia nell'app desktop LALAL.AI che nel plugin VST, ideale per flussi di lavoro integrati nel DAW, ambienti live e situazioni in cui è obbligatorio mantenere i file audio sul dispositivo.
Cosa Fa la Piattaforma
Sette prodotti, sviluppati attorno alla separazione audio e all'elaborazione vocale:
Stem Splitter separa file audio e video in fino a 10 tracce: Voce, Strumentale, Batteria, Basso, Piano, Chitarra Acustica, Chitarra Elettrica, Sintetizzatore, Archi e Fiati.
Vocal Remover isola la voce dal resto della traccia su più tipi di stem.
Voice Cleaner rimuove rumore di fondo, plosive vocali e rimbombi da microfono dalle registrazioni vocali e di voce.
Voice Changer modifica le voci in registrazioni audio e file video, con controlli per accento e tonalità.
Voice Cloner crea un modello vocale AI personalizzato a partire dalle registrazioni e dai campioni audio dell'utente. Utilizzato per audiolibri, voiceover video, pubblicità ed esperimenti vocali.
Echo & Reverb Remover rimuove eco e riverbero da voci, registrazioni vocali, brani musicali e file video.
Lead & Back Vocal Splitter separa le lead e le backing vocal dai brani, restituendo quattro stem: lead vocals, backing vocals, instrumental e instrumental con backing vocals.
Tutti i prodotti supportano i formati audio e video più diffusi: MP3, OGG, WAV, FLAC, AIFF, AAC, M4A, AVI, MP4, MKV, MOV e M4V.
In Numeri
Utenti:
6,793,709
registrati alla fine del 2025, in aumento rispetto ai 3.8 milioni del 2024. Si tratta di una crescita annua del 79%.
Volume:
63,811,258
split elaborati in un singolo anno, per un totale di 14,830,175 ore di audio.
Cosa viene separato più spesso:
32.3M
Vocali
11.5M
Voce
5.5M
Batteria
2.5M
Basso
2.1M
Chitarra elettrica
Formati di caricamento più utilizzati:
19.1M di file
MP3
3.1M
MP4
2.1M
M4A
Per Sviluppatori e Studi
L’API espone come servizio la stem separation e il voice processing di LALAL.AI, permettendo agli sviluppatori d’integrare stem splitting, noise removal e voice processing direttamente nei propri prodotti SaaS, piattaforme media o pipeline di produzione.
Il plugin VST porta Lyra in qualsiasi DAW compatibile come plugin nativo, funzionando interamente sull'hardware dell'utente senza caricamenti di file e senza consumo di minuti di abbonamento. Si integra naturalmente nei flussi di lavoro di produzione esistenti e la licenza si attiva su un massimo di tre postazioni di lavoro.
I piani Enterprise sono progettati su misura per aziende del settore media e ambienti di produzione su larga scala che necessitano di soluzioni personalizzate, volumi di elaborazione più elevati o supporto dedicato.
LALAL.AI è inoltre accessibile su web, desktop (Windows, macOS e Ubuntu), iOS e Android.
30° Annual Webby Awards, 2026 — Vincitore del People’s Voice

Miglior Utilizzo dell'AI e del Machine Learning, App, Software e Immersive
Il People’s Voice Award viene assegnato tramite voto pubblico, con milioni di schede elettorali ogni anno. LALAL.AI ha vinto contro una rosa di finalisti che includeva Adobe Premiere Object Mask, Beeble AI, Captions AI e Cosmos, in una competizione con oltre 13,000 candidature provenienti da più di 70 paesi. La piattaforma ha inoltre ricevuto il riconoscimento di Webby Honoree nella categoria Strumenti per Creatori, Creatività e Media nello stesso anno. I Webby Awards sono stati definiti “il più alto riconoscimento di Internet” dal The New York Times.
Informazioni su LALAL.AI
LALAL.AI è una piattaforma di processing audio utilizzata da oltre 6 milioni di producer, sound engineer, DJ, podcaster e media professional in tutto il mondo. L’azienda ha sede a Zugo, Svizzera, ed è gestita da OmniSale GmbH. Grazie alla ricerca continua sulle reti neurali, è passata da un singolo tool di stem-splitting a una suite completa di prodotti per il processing audio, disponibili su web, desktop, mobile, API e nei DAW.
Contatti: marketing@lalal.ai
