Nessun upload, 100% locale, nessun account

Rimuovi voce (karaoke)

Trascina una traccia stereo per cancellare il canale centrale e ridurre la voce solista. Tutto avviene nel tuo browser; il file non lascia mai il dispositivo.

Come funziona Rimuovi voce (karaoke)

Rimuovi voce produce una versione karaoke di un brano applicando la cancellazione di fase del canale centrale nel browser. Trascina una traccia stereo, scegli output stereo o mono, e scarica il risultato. Il lavoro viene eseguito da ffmpeg compilato in WebAssembly, quindi il file audio viene elaborato interamente sul dispositivo e non viene mai inviato da nessuna parte.

Sii consapevole della tecnica: questo non è una separazione sorgenti tramite IA. Lo strumento sottrae il canale sinistro dal destro (e viceversa) usando il filtro pan di ffmpeg, rimuovendo ciò che è posizionato al centro esatto, tipicamente la voce principale, ma anche kick, rullante o basso centrati. Su alcuni mix commerciali il risultato è sorprendentemente pulito; su altri, la voce rimane o appare un evidente assottigliamento. I risultati variano da traccia a traccia.

Come usare Rimuovi voce (karaoke), passo dopo passo

  1. Trascina un file MP3, FLAC o WAV stereo nell'area di caricamento.
  2. Scegli output stereo (più ampio, naturale) o output mono (segnale laterale collassato, più uniforme su alcuni materiali).
  3. Fai clic su «Rimuovi voci» e attendi che il motore ffmpeg WebAssembly finisca.
  4. Scarica la traccia karaoke risultante direttamente sul dispositivo.

Casi d'uso comuni

  • Pratica con la base: genera una versione strumentale di un brano su cui cantare o suonare.
  • Preparazione DJ: rimuovi uno strato vocale da una traccia registrata da te prima del remix.
  • Serate karaoke: crea una versione cantabile rapida di un brano che il gruppo ha già come MP3.
  • Riferimento di produzione musicale: isola il contenuto laterale di un mix per studiare la larghezza stereo e il posizionamento degli strumenti.

Domande frequenti

Il rimuovi voce usa l'IA per separare gli strumenti?

No. Usa la cancellazione di fase del canale centrale tramite il filtro pan di ffmpeg, non la separazione sorgenti tramite IA. Il filtro sottrae i canali sinistro e destro l'uno dall'altro, rimuovendo l'audio posizionato al centro esatto. Questo di solito è la voce principale, ma influisce anche su basso e batteria centrati. Non è coinvolto alcun modello di machine learning.

Perché il mio brano ha ancora una voce fioca dopo l'elaborazione?

La cancellazione di fase rimuove solo ciò che è mixato al centro esatto dell'immagine stereo. Se la voce era doppia traccia, posizionata leggermente fuori dal centro o ha un riverbero distribuito nel campo, quegli elementi sopravvivono. L'effetto è limitato da come è stato mixato il brano originale, non da un difetto dello strumento.

Perché il file sorgente deve essere stereo?

La tecnica funziona calcolando la differenza tra i canali sinistro e destro. Un file mono ha un singolo canale, quindi non c'è differenza stereo da calcolare, e la cancellazione di fase non può fare nulla. Converti prima l'audio mono in stereo se vuoi provare, sebbene i risultati probabilmente non saranno utili.

Il motore ffmpeg WebAssembly riceve il mio file audio?

No. ffmpeg è compilato in WebAssembly e viene eseguito interamente nella scheda del browser. Il file audio viene caricato nella memoria locale, elaborato lì dal filtro pan, e il risultato karaoke viene salvato sul disco. Nulla viene trasmesso ai server di Sunasty o a terze parti in nessun momento.

L'output è mono o stereo, e quale è migliore?

L'output stereo preserva il materiale del canale laterale in un file standard a due canali, che suona più ampio e naturale. L'output mono collassa il segnale laterale in un singolo canale, che può suonare più uniforme sulle tracce in cui il campo stereo è stretto. Prova entrambi e tieni quello che suona meglio per la traccia specifica.

Posso elaborare formati senza perdita come FLAC o WAV?

Sì. ffmpeg compilato in WebAssembly gestisce MP3, WAV, FLAC e la maggior parte dei contenitori audio comuni. Il tempo di elaborazione è proporzionale alla durata del file; un tipico brano di 3-4 minuti finisce in pochi secondi su un dispositivo moderno.