Skip to main content
Herramienta gratuita · No se sube nada

Quita la voz de una canción sin entregarle la canción a nadie

La mayoría de los quita-voces suben tu archivo, lo ponen en cola y te mandan un enlace por correo. Este descarga el modelo de separación a tu navegador y lo ejecuta ahí, así que el audio nunca sale de la pestaña. Obtienes un instrumental y una a capela, ambos en WAV.

Funciona en tu navegador · Sin cuenta · Hasta 10 minutos por pista

El separador

Un archivo entra, dos pistas salen

La primera vez se descargan unos 64 MB de modelo, que tu navegador guarda en caché. Separar es trabajo de verdad: cuenta con unos minutos en un portátil normal, y con más tiempo del que dura la canción si tu navegador no admite WebGPU.

Qué cambia aquí

El archivo se queda en tu equipo

No es un eslogan de privacidad pegado sobre la misma arquitectura que los demás: es una arquitectura distinta, y tiene consecuencias que conviene conocer antes de elegir herramienta.

No se sube nada

Esta página no tiene ningún punto de subida. Tu mezcla inédita, las pistas de tu cliente y tu nota de voz los lee la pestaña y ahí se quedan. Al cerrarla desaparece todo.

Las pistas suman de vuelta el original

El modelo estima el instrumental y la voz es lo que sobra, así que sumando ambos se reconstruye tu archivo exactamente. Eso es lo que convierte el instrumental en una base de karaoke utilizable y no en una aproximación.

El trabajo lo hace tu máquina

Ese es el trato: sin cola y sin coste, pero tampoco hay granja de servidores. Los navegadores con WebGPU terminan bastante antes de lo que dura la canción; sin él vas con WebAssembly de un hilo y se nota.

Cómo funciona

Espectrogramas, no magia

Merece la pena saber qué hace la herramienta: en parte explica la espera y en parte te dice cuándo el resultado va a ser bueno.

  1. 01

    Tu archivo se decodifica y se remuestrea

    A 44,1 kHz estéreo, porque es con lo que se entrenó el modelo. Un archivo mono suena por los dos lados; se acepta todo lo que el navegador sepa decodificar.

  2. 02

    El audio se convierte en una imagen de sí mismo

    Bloques de seis segundos se convierten en espectrogramas: una transformada de 6144 puntos cada 1024 muestras, que es justo lo que el modelo espera recibir.

  3. 03

    El modelo estima el instrumental

    Bloque a bloque, con los bordes fundidos para que no oigas una costura cada seis segundos. Esta es la parte que consume el tiempo.

  4. 04

    La voz es lo que sobra

    Restar el instrumental estimado a tu original da la voz, y garantiza que las dos mitades sumadas devuelvan exactamente aquello con lo que empezaste.

Dos límites honestos. La separación es imperfecta en mezclas densas: reverberación fuerte, voces dobladas y platillos altos son donde oirás artefactos, en las dos pistas. Y un tema largo mantiene la mezcla y las dos pistas en memoria a la vez, por eso el techo son 10 minutos y no una cara de un disco.

Créditos

El modelo no es nuestro

La separación usa UVR-MDX-NET-Inst_HQ_1, entrenado y publicado por el proyecto Ultimate Vocal Remover bajo licencia MIT, que pide a quienes usan sus modelos que lo citen. La arquitectura es MDX-Net, de KUIELab. Nosotros hicimos la parte del navegador; el trabajo de verdad es suyo.

Después de separar

Una pista es el principio de algo, no el final

Un instrumental es una base sobre la que hablar y una a capela es un gancho sobre el que construir. En PrismPoster se hace el resto: música, vídeo e imágenes en un estudio, y una línea de tiempo para montarlo todo.

  • Genera música propia en vez de tomar prestada la de otro, y sáltate del todo la cuestión de las licencias.
  • Monta la pista en un vídeo en el mismo sitio, en lugar de exportar entre cuatro herramientas.
  • Empieza gratis con 50 créditos, sin tarjeta, y júzgalo por lo que sale.

El separador sigue siendo gratuito y local, abras una cuenta algún día o no.

Cómo funciona el Estudio de Música

Preguntas

Las que merecen respuesta

¿De verdad es gratis y sin límite?

Sí. Sin cuenta, sin correo y sin tope por pista, porque no hay nada que medir: el trabajo lo hace tu ordenador, no nuestros servidores. Los únicos límites son técnicos: 10 minutos por pista y la memoria de tu equipo.

¿Se sube mi audio a algún sitio?

No. La página no tiene ninguna ruta de subida. Tu navegador descarga el modelo y lo ejecuta en local, justo al revés que la mayoría de los quita-voces: ellos mandan tu archivo a un servidor, aquí el modelo viene a ti. Puedes comprobarlo en la pestaña de red de tu navegador: la única petición grande es el modelo bajando.

¿Cuánto tarda?

Depende por completo de tu navegador. Con WebGPU, bastante menos que lo que dura el tema. Sin él, la separación cae a WebAssembly de un solo hilo y tarda más que la canción: varios minutos para un sencillo normal. La primera vez también se descargan unos 64 MB de modelo, una sola vez.

¿Qué tal es la separación?

Suficiente para una base de karaoke, una pista de ensayo o un sample; no lo suficiente para pasar por una multipista de estudio. Las mezclas despejadas se separan limpias; las densas dejan artefactos, y se oyen sobre todo en platillos, colas largas de reverberación y voces dobladas. Escucha las dos pistas antes de decidirte.

¿Qué archivos puedo usar?

Cualquier cosa que tu navegador sepa decodificar, o sea MP3, WAV, M4A/AAC, FLAC y OGG. Las dos pistas vuelven como WAV estéreo de 44100 Hz, sin pérdida y listo para cualquier editor.

¿Puedo usar las pistas comercialmente?

Eso depende de la canción, no de esta herramienta. Separar una grabación no te da ningún derecho sobre ella: un instrumental sacado de un tema que no es tuyo sigue siendo ese tema. Con tus propias grabaciones, haz lo que quieras. Si necesitas música que puedas licenciar de verdad, generarla es la respuesta más limpia.

Gratis para empezar

Ya tienes la pista.Ahora haz el resto.

PrismPoster genera música, vídeo e imágenes y lo monta todo en un sitio. Empieza gratis con 50 créditos y sin tarjeta.