Skip to main content
Strumento gratuito · Non si carica nulla

Togliere la voce da un brano senza consegnare il brano a nessuno

Quasi tutti i rimuovi-voce caricano il tuo file, lo mettono in coda e ti mandano un link via email. Questo scarica invece il modello di separazione nel tuo browser e lo esegue lì, così l’audio non lascia mai la scheda. Ottieni uno strumentale e un a cappella, entrambi in WAV.

Gira nel tuo browser · Senza account · Fino a 10 minuti per brano

Il separatore

Entra un file, escono due tracce

La prima esecuzione scarica circa 64 MB di modello, che poi il browser tiene in cache. Separare è lavoro vero: metti in conto qualche minuto su un portatile normale, e più tempo della canzone stessa se il tuo browser non supporta WebGPU.

Cosa cambia qui

Il file resta sulla tua macchina

Non è uno slogan sulla privacy avvitato sulla stessa architettura di tutti gli altri — è un’architettura diversa, e ha conseguenze che conviene conoscere prima di scegliere uno strumento.

Non si carica nulla

Questa pagina non ha alcun endpoint di caricamento. Il tuo mix non ancora uscito, le tracce del tuo cliente e il tuo memo vocale li legge la scheda e lì restano. Chiuderla cancella tutto.

Le tracce risommate danno l’originale

Il modello stima lo strumentale e la voce è ciò che resta, quindi risommando le due si ricostruisce esattamente il tuo file. È questo che rende lo strumentale una base karaoke utilizzabile e non un’approssimazione.

È la tua macchina a lavorare

È questo il compromesso: niente coda e niente costi, ma nemmeno una server farm. I browser con WebGPU finiscono ben prima della fine del brano; senza, si va di WebAssembly a thread singolo e si sente.

Come funziona

Spettrogrammi, non magia

Vale la pena sapere cosa sta facendo lo strumento: in parte spiega l’attesa, in parte ti dice quando il risultato sarà buono.

  1. 01

    Il file viene decodificato e ricampionato

    A 44,1 kHz stereo, perché è su questo che il modello è stato addestrato. Un file mono esce da entrambi i lati; si accetta tutto ciò che il browser sa decodificare.

  2. 02

    L’audio diventa un’immagine di sé

    Blocchi di sei secondi diventano spettrogrammi — una trasformata da 6144 punti ogni 1024 campioni, esattamente ciò che il modello si aspetta.

  3. 03

    Il modello stima lo strumentale

    Blocco per blocco, con i bordi in dissolvenza incrociata per non sentire una giuntura ogni sei secondi. È questa la parte che richiede tempo.

  4. 04

    La voce è ciò che resta

    Sottrarre lo strumentale stimato dall’originale dà la voce, e garantisce che le due metà risommate restituiscano esattamente il punto di partenza.

Due limiti onesti. Sui mix densi la separazione è imperfetta — riverbero abbondante, voci raddoppiate e piatti forti sono i punti in cui sentirai artefatti, in entrambe le tracce. E un brano lungo tiene in memoria il mix e tutte e due le tracce insieme: per questo il tetto è di 10 minuti e non di una facciata di album.

Crediti

Il modello non è nostro

La separazione usa UVR-MDX-NET-Inst_HQ_1, addestrato e pubblicato dal progetto Ultimate Vocal Remover con licenza MIT, che chiede a chi ne usa i modelli di citarlo. L’architettura è MDX-Net, di KUIELab. Noi abbiamo fatto la parte nel browser; il lavoro vero è loro.

Dopo la separazione

Una traccia è l’inizio di qualcosa, non la fine

Uno strumentale è un letto su cui parlare, un a cappella un gancio attorno a cui costruire. In PrismPoster si fa il resto: musica, video e immagini in uno studio, e una timeline per montarli insieme.

  • Genera musica tua invece di prendere in prestito quella di altri, e salta del tutto la questione delle licenze.
  • Monta la traccia in un video nello stesso posto, invece di esportare fra quattro strumenti.
  • Inizia gratis con 50 crediti, senza carta, e giudica da ciò che esce.

Il separatore resta gratuito e locale, che tu apra un account un giorno o no.

Come funziona lo Studio Musica

Domande

Quelle che meritano una risposta

È davvero gratis, senza limiti?

Sì. Nessun account, nessuna email e nessun limite per brano, perché non c’è nulla da contabilizzare: il lavoro lo fa il tuo computer, non i nostri server. Gli unici limiti sono tecnici: 10 minuti a brano e la memoria della tua macchina.

Il mio audio viene caricato da qualche parte?

No. La pagina non ha alcun percorso di caricamento. Il browser scarica il modello e lo esegue in locale, l’esatto contrario di quasi tutti i rimuovi-voce: loro mandano il tuo file a un server, qui è il modello a venire da te. Puoi verificarlo nella scheda di rete del browser: l’unica richiesta grossa è il modello che scende.

Quanto tempo ci vuole?

Dipende interamente dal browser. Con WebGPU, ben meno della durata del brano. Senza, la separazione ripiega su WebAssembly a thread singolo e impiega più della canzone stessa: diversi minuti per un singolo normale. Alla prima esecuzione si scaricano anche circa 64 MB di modello, una volta sola.

Quanto è buona la separazione?

Abbastanza buona per una base karaoke, una traccia di studio o un sample; non abbastanza da passare per un multitraccia di studio. I mix radi si separano puliti, quelli densi lasciano artefatti — li senti soprattutto su piatti, code lunghe di riverbero e voci raddoppiate. Ascolta entrambe le tracce prima di scegliere.

Quali file posso usare?

Tutto ciò che il browser sa decodificare, quindi in pratica MP3, WAV, M4A/AAC, FLAC e OGG. Entrambe le tracce tornano come WAV stereo a 44100 Hz, senza perdita e pronte per qualsiasi editor.

Posso usare le tracce a scopo commerciale?

Dipende dal brano, non da questo strumento. Separare una registrazione non ti dà alcun diritto su di essa: uno strumentale ricavato da un pezzo che non è tuo resta quel pezzo. Sulle tue registrazioni fai quello che vuoi. Se ti serve musica che puoi davvero licenziare, generarla è la risposta più pulita.

Gratis per iniziare

Hai la traccia.Ora fai il resto.

PrismPoster genera musica, video e immagini e monta tutto in un posto solo. Inizia gratis con 50 crediti, senza carta.