Nichts wird hochgeladen
Diese Seite hat überhaupt keinen Upload-Endpunkt. Dein unveröffentlichter Mix, die Spuren deines Kunden und deine Sprachnotiz werden vom Tab gelesen und bleiben dort. Schließt du ihn, ist alles weg.
Die meisten Gesangsentferner laden deine Datei hoch, stellen sie in eine Warteschlange und schicken dir einen Link per Mail. Dieses Tool lädt stattdessen das Trennmodell in deinen Browser und führt es dort aus — das Audio verlässt den Tab nie. Heraus kommen ein Instrumental und ein A-cappella, beide als WAV.
Läuft im Browser · Ohne Konto · Bis zu 10 Minuten pro Track
Der Trenner
Beim ersten Lauf werden rund 64 MB Modell geladen, die dein Browser danach zwischenspeichert. Trennen ist echte Rechenarbeit — rechne auf einem normalen Laptop mit einigen Minuten, und mit mehr Zeit als der Song dauert, sofern dein Browser kein WebGPU unterstützt.
Was hier anders ist
Das ist kein Datenschutz-Slogan, der auf dieselbe Architektur wie überall geschraubt wurde — es ist eine andere Architektur, und sie hat Folgen, die man vor der Wahl eines Tools kennen sollte.
Diese Seite hat überhaupt keinen Upload-Endpunkt. Dein unveröffentlichter Mix, die Spuren deines Kunden und deine Sprachnotiz werden vom Tab gelesen und bleiben dort. Schließt du ihn, ist alles weg.
Das Modell schätzt das Instrumental, der Gesang ist der Rest — addiert man beide wieder, ergibt das exakt deine Datei. Genau das macht das Instrumental zu einem brauchbaren Karaoke-Playback statt zu einer Annäherung daran.
Das ist der Handel: keine Warteschlange und keine Kosten, aber auch keine Serverfarm. Browser mit WebGPU sind deutlich schneller fertig als der Song lang ist; ohne WebGPU läuft es auf einkernigem WebAssembly und dauert spürbar länger.
So funktioniert es
Es lohnt sich zu wissen, was das Tool tut — zum einen erklärt es die Wartezeit, zum anderen sagt es dir, wann das Ergebnis gut wird.
Auf 44,1 kHz Stereo, denn darauf wurde das Modell trainiert. Eine Mono-Datei läuft auf beiden Seiten; akzeptiert wird alles, was der Browser dekodieren kann.
Sechs-Sekunden-Blöcke werden zu Spektrogrammen — eine 6144-Punkt-Transformation alle 1024 Samples, genau das, was das Modell erwartet.
Block für Block, mit übergeblendeten Rändern, damit du nicht alle sechs Sekunden eine Naht hörst. Das ist der Teil, der die Zeit kostet.
Zieht man das geschätzte Instrumental vom Original ab, bleibt der Gesang — und beide Hälften ergeben zusammen garantiert wieder genau das, womit du angefangen hast.
Zwei ehrliche Grenzen. Bei dichten Mixen ist die Trennung unvollkommen — kräftiger Hall, gedoppelter Gesang und laute Becken sind die Stellen, an denen du Artefakte hörst, und zwar in beiden Spuren. Und ein langer Track hält den Mix und beide Spuren gleichzeitig im Speicher, weshalb die Obergrenze 10 Minuten beträgt und nicht eine Albumseite.
Nennung
Die Trennung nutzt UVR-MDX-NET-Inst_HQ_1, trainiert und veröffentlicht vom Projekt Ultimate Vocal Remover unter der MIT-Lizenz, die von Entwicklern eine Nennung erbittet, wenn sie diese Modelle verwenden. Die Architektur ist MDX-Net von KUIELab. Wir haben die Browser-Seite gebaut; die eigentliche Arbeit leisten sie.
Nach der Trennung
Ein Instrumental ist ein Bett zum Darübersprechen, ein A-cappella ein Hook zum Weiterbauen. Bei PrismPoster entsteht der Rest: Musik, Video und Bilder in einem Studio, mit einer Timeline zum Zusammenschneiden.
Der Trenner bleibt kostenlos und lokal, ob du je ein Konto anlegst oder nicht.
So funktioniert das Musik-StudioFragen
Ja. Kein Konto, keine E-Mail-Adresse, keine Obergrenze pro Track — es gibt für uns nichts abzurechnen, denn die Arbeit macht dein Rechner, nicht unsere Server. Die einzigen Grenzen sind technisch: 10 Minuten pro Track und der Speicher deines Geräts.
Nein. Die Seite hat überhaupt keinen Upload-Pfad. Dein Browser lädt das Modell und führt es lokal aus — die umgekehrte Anordnung zu den meisten Gesangsentfernern: Die schicken deine Datei an einen Server, hier kommt das Modell zu dir. Du kannst das im Netzwerk-Tab deines Browsers mitverfolgen: Die einzige größere Anfrage ist das Modell.
Das hängt ganz von deinem Browser ab. Mit WebGPU deutlich kürzer als die Länge des Tracks. Ohne WebGPU fällt die Trennung auf einkerniges WebAssembly zurück und dauert länger als der Song — bei einer normalen Single mehrere Minuten. Beim ersten Lauf werden zusätzlich einmalig rund 64 MB Modell geladen.
Gut genug für ein Karaoke-Playback, eine Übungsspur oder ein Sample — und nicht gut genug, um als Studio-Mehrspuraufnahme durchzugehen. Dünn besetzte Mixe trennen sauber; dichte hinterlassen Artefakte, am hörbarsten bei Becken, langen Hallfahnen und gedoppeltem Gesang. Hör dir beide Spuren an, bevor du dich festlegst.
Alles, was dein Browser dekodieren kann, praktisch also MP3, WAV, M4A/AAC, FLAC und OGG. Beide Spuren kommen als 44100-Hz-Stereo-WAV zurück — verlustfrei und direkt in jedem Editor verwendbar.
Das hängt vom Song ab, nicht von diesem Tool. Eine Aufnahme zu trennen verschafft dir keinerlei Rechte daran — ein Instrumental aus einem Track, der dir nicht gehört, ist immer noch dieser Track. Bei eigenen Aufnahmen kannst du machen, was du willst. Wenn du Musik brauchst, die du wirklich lizenzieren kannst, ist es sauberer, sie zu erzeugen.
Finde das Tempo der Spur, die du gerade herausgelöst hast.
Schreib den Text für den Track, den du darum herum baust.
Ein Playback erzeugen, statt sich eines zu borgen.
SRT und WebVTT, im Browser umgewandelt wie hier.
Bild, Video, Musik, Schnitt und Export an einem Ort.
Was der kostenlose Plan enthält und was die bezahlten Pläne kosten.
PrismPoster erzeugt Musik, Video und Bilder und schneidet alles an einem Ort zusammen. Starte kostenlos mit 50 Credits, ohne Karte.