Non si carica nulla
Questa pagina non ha alcun endpoint di caricamento. Il tuo mix non ancora uscito, le tracce del tuo cliente e il tuo memo vocale li legge la scheda e lì restano. Chiuderla cancella tutto.
Quasi tutti i rimuovi-voce caricano il tuo file, lo mettono in coda e ti mandano un link via email. Questo scarica invece il modello di separazione nel tuo browser e lo esegue lì, così l’audio non lascia mai la scheda. Ottieni uno strumentale e un a cappella, entrambi in WAV.
Gira nel tuo browser · Senza account · Fino a 10 minuti per brano
Il separatore
La prima esecuzione scarica circa 64 MB di modello, che poi il browser tiene in cache. Separare è lavoro vero: metti in conto qualche minuto su un portatile normale, e più tempo della canzone stessa se il tuo browser non supporta WebGPU.
Cosa cambia qui
Non è uno slogan sulla privacy avvitato sulla stessa architettura di tutti gli altri — è un’architettura diversa, e ha conseguenze che conviene conoscere prima di scegliere uno strumento.
Questa pagina non ha alcun endpoint di caricamento. Il tuo mix non ancora uscito, le tracce del tuo cliente e il tuo memo vocale li legge la scheda e lì restano. Chiuderla cancella tutto.
Il modello stima lo strumentale e la voce è ciò che resta, quindi risommando le due si ricostruisce esattamente il tuo file. È questo che rende lo strumentale una base karaoke utilizzabile e non un’approssimazione.
È questo il compromesso: niente coda e niente costi, ma nemmeno una server farm. I browser con WebGPU finiscono ben prima della fine del brano; senza, si va di WebAssembly a thread singolo e si sente.
Come funziona
Vale la pena sapere cosa sta facendo lo strumento: in parte spiega l’attesa, in parte ti dice quando il risultato sarà buono.
A 44,1 kHz stereo, perché è su questo che il modello è stato addestrato. Un file mono esce da entrambi i lati; si accetta tutto ciò che il browser sa decodificare.
Blocchi di sei secondi diventano spettrogrammi — una trasformata da 6144 punti ogni 1024 campioni, esattamente ciò che il modello si aspetta.
Blocco per blocco, con i bordi in dissolvenza incrociata per non sentire una giuntura ogni sei secondi. È questa la parte che richiede tempo.
Sottrarre lo strumentale stimato dall’originale dà la voce, e garantisce che le due metà risommate restituiscano esattamente il punto di partenza.
Due limiti onesti. Sui mix densi la separazione è imperfetta — riverbero abbondante, voci raddoppiate e piatti forti sono i punti in cui sentirai artefatti, in entrambe le tracce. E un brano lungo tiene in memoria il mix e tutte e due le tracce insieme: per questo il tetto è di 10 minuti e non di una facciata di album.
Crediti
La separazione usa UVR-MDX-NET-Inst_HQ_1, addestrato e pubblicato dal progetto Ultimate Vocal Remover con licenza MIT, che chiede a chi ne usa i modelli di citarlo. L’architettura è MDX-Net, di KUIELab. Noi abbiamo fatto la parte nel browser; il lavoro vero è loro.
Dopo la separazione
Uno strumentale è un letto su cui parlare, un a cappella un gancio attorno a cui costruire. In PrismPoster si fa il resto: musica, video e immagini in uno studio, e una timeline per montarli insieme.
Il separatore resta gratuito e locale, che tu apra un account un giorno o no.
Come funziona lo Studio MusicaDomande
Sì. Nessun account, nessuna email e nessun limite per brano, perché non c’è nulla da contabilizzare: il lavoro lo fa il tuo computer, non i nostri server. Gli unici limiti sono tecnici: 10 minuti a brano e la memoria della tua macchina.
No. La pagina non ha alcun percorso di caricamento. Il browser scarica il modello e lo esegue in locale, l’esatto contrario di quasi tutti i rimuovi-voce: loro mandano il tuo file a un server, qui è il modello a venire da te. Puoi verificarlo nella scheda di rete del browser: l’unica richiesta grossa è il modello che scende.
Dipende interamente dal browser. Con WebGPU, ben meno della durata del brano. Senza, la separazione ripiega su WebAssembly a thread singolo e impiega più della canzone stessa: diversi minuti per un singolo normale. Alla prima esecuzione si scaricano anche circa 64 MB di modello, una volta sola.
Abbastanza buona per una base karaoke, una traccia di studio o un sample; non abbastanza da passare per un multitraccia di studio. I mix radi si separano puliti, quelli densi lasciano artefatti — li senti soprattutto su piatti, code lunghe di riverbero e voci raddoppiate. Ascolta entrambe le tracce prima di scegliere.
Tutto ciò che il browser sa decodificare, quindi in pratica MP3, WAV, M4A/AAC, FLAC e OGG. Entrambe le tracce tornano come WAV stereo a 44100 Hz, senza perdita e pronte per qualsiasi editor.
Dipende dal brano, non da questo strumento. Separare una registrazione non ti dà alcun diritto su di essa: uno strumentale ricavato da un pezzo che non è tuo resta quel pezzo. Sulle tue registrazioni fai quello che vuoi. Se ti serve musica che puoi davvero licenziare, generarla è la risposta più pulita.
Trova il tempo della traccia che hai appena estratto.
Scrivi il testo del brano che ci stai costruendo attorno.
Generare una base invece di prenderla in prestito.
SRT e WebVTT, convertiti nel browser come qui.
Immagine, video, musica, montaggio ed esportazione in un solo posto.
Cosa include il piano gratuito e quanto costano quelli a pagamento.
PrismPoster genera musica, video e immagini e monta tutto in un posto solo. Inizia gratis con 50 crediti, senza carta.