Extractor de a capella
Aísla las voces de cualquier canción con la separación basada en IA. Dos opciones de modelo, salida en formato WAV sin pérdida de calidad.
Arrastra el archivo de audio aquí o haz clic para buscarlo
MP3, WAV, FLAC, OGG, M4A • Hasta 15 minutos
Privado — procesado en tu dispositivo, nunca subido
La primera vez que se utiliza, se descarga un modelo de IA de 32 MB (que se almacena en caché para futuras visitas).
Preparando...
Procesando localmente
En su lugar, elimina las voces →
Dividir en todos los tallos →
Crear una pista de karaoke →
Crear un mashup →
Cómo extraer una pista a capela
- 1 Sube una canción (MP3, WAV, FLAC, OGG)
- 2 La IA separa la voz de la parte instrumental
- 3 Descarga la pista a capela aislada en formato WAV
Preguntas Frecuentes
¿Cómo funciona el extractor de acapella?
El extractor de acapella utiliza una red neuronal MDX-Net entrenada con miles de pistas mezcladas para identificar y aislar la pista vocal. El resultado es una pista de acapella limpia (solo voz) y una pista instrumental independiente, ambas en formato WAV sin pérdida de calidad. Hay dos opciones de modelo disponibles: «Fast» (14 MB, MDXNET_1) para una extracción rápida, y «Quality» (32 MB, Voc_FT) para obtener la máxima claridad vocal en material complejo.
¿Cuál es la diferencia entre «Acapella Extractor» y «Vocal Remover»?
Acapella Extractor y Vocal Remover utilizan el mismo motor de IA, pero tienen objetivos opuestos. Acapella Extractor se centra en ofrecer voces aisladas lo más limpias posible, ideales para el sampling, las remezclas o la creación de mashups. Vocal Remover se centra en eliminar las voces para producir una pista instrumental limpia o una pista de acompañamiento de karaoke. Ambos generan archivos de voz e instrumentales en formato WAV, pero el flujo de trabajo está optimizado para cada caso de uso.
¿Es la pista a capela extraída lo suficientemente buena para hacer remezclas y utilizarla como muestra?
En las pistas producidas en estudio con una presencia vocal clara, se puede esperar una separación nítida con un mínimo de artefactos, lo que las hace aptas para remezclas y mashups profesionales. Las grabaciones en directo, las superposiciones vocales intensas o las pistas en las que las voces comparten el espectro de frecuencias con los sintetizadores pueden presentar cierto sangrado. El modelo «Quality» (Voc_FT) ofrece resultados notablemente más limpios en material complejo.
¿Funciona con pistas completamente mezcladas o solo con grabaciones aisladas?
Funciona con cualquier tipo de audio mezclado: canciones completas, sesiones de DJ, grabaciones en directo o episodios de podcast. El modelo de IA se ha entrenado específicamente con mezclas completas, no con pistas separadas previamente. Las pistas con una separación clara de las voces en la mezcla ofrecen los mejores resultados.
¿Se suben mis archivos a un servidor?
Depende de tu dispositivo. En ordenadores de sobremesa compatibles con WebGPU, el procesamiento se realiza íntegramente en tu equipo; los archivos nunca salen de tu dispositivo. En dispositivos móviles o con un hardware más lento, es posible que la herramienta recurra a Cloud Assist (procesamiento en un servidor seguro) para obtener resultados más rápidos. Los archivos de Cloud Assist se eliminan inmediatamente después del procesamiento. El icono de privacidad que aparece en la zona de carga indica qué modo está activo.
¿Qué formatos y longitudes de archivo son compatibles?
Formatos de entrada: MP3, WAV, FLAC, OGG, M4A y AIFF. Duración máxima: 15 minutos. Formato de salida: WAV sin pérdida de calidad a la frecuencia de muestreo original, tanto para la pista a capela como para la instrumental.
¿Cuáles son los casos de uso más habituales de un extractor de acapella?
Los productores utilizan las pistas a capela extraídas para hacer remezclas, samplear frases vocales, crear mashups con diferentes instrumentales, elaborar pistas de karaoke, crear fragmentos vocales para música electrónica y aislar los diálogos de la música en la producción de vídeos. Los DJ utilizan las pistas a capela para crear mashups en directo y transiciones.