Bottom Line Up Front (BLUF): El separador vocal divide una pista en dos en tu navegador: la voz y el instrumental. Sube una canción, pulsa el botón y obtén la voz por un lado y una pista de acompañamiento para karaoke por otro: ambas se escuchan en la página y se descargan como archivos WAV. El archivo no se envía a ningún sitio, todo se calcula en tu dispositivo, no se gastan tokens y aquí no hay ninguna API de pago. También sirve un archivo de vídeo: la herramienta toma el sonido de él.
Es la división de una pista de música en partes separadas. A la entrada una canción, a la salida dos pistas: la voz por un lado y el instrumental, una pista sin voz. La herramienta sirve cuando necesitas una base para karaoke, cuando quieres quitar la voz y cantar encima, montar un remix o simplemente escuchar cómo suena el arreglo sin la voz.
La voz aislada también es útil por sí sola: como referencia, como pista para un montaje o para descomponerla en frases.
El modelo descompone la pista en cuatro partes: batería, bajo, otros y voz. Se te muestran dos pistas: la voz se toma tal cual, y el instrumental se arma con todas las demás partes sin la voz. Así la base suena entera y no como trozos de instrumentos sueltos.
El resultado se entrega en archivos WAV a 44,1 kHz en estéreo: puedes escucharlos directamente en la página y descargarlos.
La pista no sale de tu ordenador: ni el archivo ni las pistas finales se envían a ningún sitio. El modelo se carga en el navegador y funciona en tu hardware: el cálculo va por WebGPU y, si la tarjeta gráfica no está disponible, el motor pasa con honestidad al procesador y te avisa: tardará bastante más.
Por la separación no se gastan tokens: es una herramienta gratuita que funciona en tu dispositivo, no en nuestro servidor.
Audio: MP3, WAV, M4A, OGG, FLAC y otros formatos habituales. También puedes subir un archivo de vídeo: la herramienta tomará de él la pista de sonido.
La herramienta funciona mejor en un Chrome, Edge o Safari reciente. En un navegador sin WebGPU la separación irá por el procesador: también funciona, pero más despacio.
En el primer arranque el navegador descarga una vez los pesos del modelo: unos 172 MB. Se quedan en la caché del navegador y los siguientes arranques empiezan al momento.
El tiempo depende de la duración de la pista y de la potencia del dispositivo: un fragmento corto se separa rápido, una canción larga tarda más. El progreso se ve en la barra y el trabajo se puede cancelar.
Sí. El modelo y sus pesos se cargan en el navegador y el cálculo se hace en tu dispositivo. La pista y las pistas finales no se envían a ningún sitio: la herramienta no tiene ninguna API de pago.
Nada. No se gastan tokens: es una herramienta gratuita que calcula en tu ordenador.
Dos: la voz por un lado y el instrumental, una base sin voz. Ambas se escuchan en la página y se descargan como archivos WAV.
Sí. La herramienta toma la pista de sonido del vídeo y la separa igual que una pista normal.
El navegador descarga una vez los pesos del modelo: unos 172 MB. Después vienen de la caché y el arranque empieza al momento.
La herramienta sigue funcionando en el procesador: más despacio, pero con el mismo resultado. Ella misma te avisa de que se ha activado el modo de reserva.