Extraer la voz (acapella)
Quita el acompañamiento de una canción y conserva solo la voz. Úsala para estudiar cómo se canta una parte, distinguir armonías o crear material para remezclas y mashups. La IA de separación funciona en tu navegador, así que la canción no se sube. También puedes guardar el acompañamiento eliminado.
La primera ejecución descarga un modelo de IA (unos 90 MB); las siguientes usan la copia guardada en tu navegador. Solo se transfiere el modelo y tus archivos nunca se suben.
Ajustes
Cómo se usa
- 1
Añade canciones
Suelta audio como MP3, WAV, M4A o FLAC, o vídeo como MP4 o MOV. Puedes procesar varias canciones a la vez.
- 2
Elige el formato de salida
Por defecto, MP3 a 320 kbps. Elige WAV o FLAC si vas a editar el resultado. La primera vez se descarga el modelo de IA (unos 90 MB).
- 3
Escucha y guarda
En el reproductor del resultado, silencia, pon en solo o cambia el volumen de cada pista para comparar, y guarda cada archivo o exporta la mezcla como uno solo.
Qué contiene la voz extraída
La IA separa la canción en cuatro pistas —voz, batería, bajo y otros— y entrega la voz. La voz principal y las armonías (coros) quedan en la misma pista de voz. La mayor parte de la reverberación de la voz también se queda con ella.
Donde el acompañamiento suena fuerte, puede colarse un poco de los instrumentos en la voz. Si te importa, pon la voz en solo en el reproductor y elige las partes que vas a usar. En Chrome o Edge en un ordenador se procesa con la GPU (WebGPU); en el portátil que probamos (GPU integrada) una canción de 4 minutos tardó alrededor de 1 minuto. En iPhone, iPad y Safari se procesa con la CPU y tarda más: unos 7 minutos para una canción de 4 minutos en un iPhone 15 Pro Max.
Preguntas frecuentes
¿Puedo extraer solo las armonías?
No. La voz principal y las armonías se extraen juntas como una sola pista de voz.
¿Es gratis? ¿Hay límites de canciones o de duración?
Es gratis y no requiere registro, sin límite de canciones ni de duración. Las canciones largas tardan más, y el audio muy largo (más de una hora) depende de la memoria de tu dispositivo. La canción no se sube; la separación se hace en tu dispositivo.
¿Qué formatos admite?
Puedes cargar audio como MP3, WAV, M4A y FLAC, y el audio de vídeos como MP4, MOV y WebM. El resultado se puede guardar en MP3 (320 kbps por defecto), M4A, WAV, FLAC, AIFF, OGG y otros. WAV o FLAC es lo mejor si vas a editar el resultado.
¿Puedo publicar la voz extraída?
Publicar o distribuir la voz extraída de una canción comercial, por ejemplo en una remezcla o un mashup, requiere permiso de los titulares de los derechos. Úsala para practicar y estudiar, o con canciones que tengas permiso para usar o que hayas compuesto tú.
Ayúdanos a mejorar el servicio
Cuando una conversión falla, enviarnos las circunstancias nos ayuda a encontrar la causa. Saber qué dispositivos y formatos fallan más, y cuánto tarda el procesamiento, nos permite revisar los formatos admitidos y corregir los errores. Si no te importa, dejarlo activado nos ayuda mucho.
Qué se envía
La herramienta usada y los ajustes elegidos (formato de salida, calidad, etc.), las características del dispositivo (GPU, memoria, número de núcleos), el formato de entrada con su tamaño aproximado, cuántos archivos tuvieron éxito o fallaron y cuánto tardó, y el tipo y los detalles del error cuando algo falla.
Qué no se envía nunca
Los archivos en sí, los nombres de archivo, el texto, los subtítulos o las indicaciones que añades a un vídeo, y las direcciones IP. Los datos van únicamente al servidor de este sitio, nunca a un servicio de terceros.