Eliminador de voz de AI

Separa las voces de los instrumentales en cualquier canción usando IA de última generación. Crea canciones de karaoke, acapellas y pistas de respaldo de forma gratuita.

Subir canción al proceso

3.000 caracteres por canción

Arrastre y suelte su archivo aquí, o navegar

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB
— o grabar desde su micrófono —
00:00

Configuración de separación

Ambos modos utilizan el mismo modelo de Mel-Band RoFormer.
Gratis para probar con una cuenta gratuita

Cómo funciona

Sube tu canción
AI separa las pistas
Vista previa y descarga
Separando voces...

Separando voces de instrumentales...

Uso Mel-Band RoFormer en el Saldo calidad
¿Tomando un tiempo? Su resultado aparecerá en su historia de la generación cuando esté listo.
Separación vocal completa

Vocales

0:00

Instrumental

0:00
Calidad de la separación 8.2 dB SDR
Vocal Bleed < 2%
Duración de la canción 3:42
Tiempo de procesamiento 12.4s

Motor de separación

Modelo Mel-Band RoFormer
Producto Vocales + instrumentales
DEG vocal 11.3 dB
DEG instrumental 16.0 dB

Medido en extractos de prueba de 50 MUSDB18. SDR es la relación señal-distorsión: más alto es más limpio. Nuestro motor anterior anotó 8.4 dB (voces) y 13.1 dB (instrumental).

Por qué TTS.ai vs. Competidores

Nivel libre disponible

Prueba con una cuenta gratuita.Competidores como LALAL.AI, Moises y PhonicMind cobran $5-25/mes por la eliminación vocal básica.

Calidad de separación medida

Las vocales están separadas por un modelo Mel-Band RoFormer. En 50 extractos de la prueba MUSDB18 anotó 11.3 dB SDR vocal y 16,0 dB instrumental SDR, aproximadamente 3 dB por encima de nuestro motor anterior en ambos.

Sin marcas de agua ni tapas de calidad

Descarga la salida de calidad completa en WAV, MP3 o FLAC. Sin marcas de agua, sin recorte, sin restricciones de bits en ningún nivel.

Acceso API para el procesamiento por lotes

Procesar cientos de canciones programáticamente a través de nuestra API REST. Perfecto para empresas de producción musical y piscinas DJ.

Consejos para obtener mejores resultados

  • Utilice la entrada WAV o FLAC para una separación de calidad máxima
  • Elige Ambos para obtener la acapella y el instrumental de una carga
  • Los maestros del estudio se separan más limpiamente que las grabaciones en vivo o en bootleg
  • Las canciones con separación estéreo clara producen los mejores resultados
  • Los MP3s fuertemente comprimidos (128kbps o menos) pueden tener una calidad de separación reducida
  • Para la división de múltiples stems (batería, bajo, etc.), utilice nuestro Divisor de stems

Cómo funciona

Las redes neuronales profundas analizan el espectro audio de su canción, identifican las frecuencias vocales y las separan limpiamente del respaldo instrumental en tres pasos.

Medida 1

Sube tu canción

Arrastre y suelte cualquier canción en formato MP3, WAV, FLAC, OGG o M4A. Soportamos archivos de hasta 50MB y canciones de hasta 10 minutos de duración. Su archivo se cifra durante la carga y se procesa en instancias GPU aisladas. Los archivos se eliminan automáticamente dentro de 1 hora de procesamiento.

Medida 2

AI separa las pistas

Un modelo de Mel-Band RoFormer convierte tu audio en un espectrograma dividido en bandas de frecuencia a escala mel, luego utiliza la atención de transformadores a través del tiempo y la frecuencia para estimar la pista vocal. El instrumental es la mezcla original con esa pista vocal eliminada, por lo que las dos pistas suman de nuevo a tu canción.

Medida 3

Vista previa y descarga

Escuche las pistas vocales e instrumentales separadas lado a lado con nuestros reproductores de audio incorporados, y luego descargue cada pista en su formato preferido.

Casos de uso del removedor vocal

La eliminación vocal de AI abre posibilidades creativas para músicos, DJs, creadores de contenido y entusiastas de la música en una amplia gama de aplicaciones.

Karaoke

Crea versiones de karaoke de cualquier canción al instante. Quita la voz principal para cantar junto con el respaldo instrumental original. Perfecto para la noche de karaoke, práctica de canto, calentamientos vocales, ensayos de coro y bares de karaoke. Trabaja con cualquier género de pop a rock a R&B.

Remezclar & Mashups

Extraiga voces aisladas o instrumentales para crear remixes, mashups y ediciones de bootleg. Combine las voces de una canción con el ritmo de otra. Capa acapellas sobre sus propias producciones. Esencial para los productores que crean remixes oficiales y no oficiales.

Producción musical

Muestra voces y partes instrumentales de grabaciones existentes para su uso en nuevas producciones. Extrae ganchos vocales, libs y armonías. Aísla riffs de guitarra, líneas de bajo o parches sintéticos para el muestreo creativo. Acelera tu flujo de trabajo de producción dramáticamente.

DJ Sets & Live Performance

Cree instrumentos y acapellas limpios para los sets de DJ en vivo. Construya pistas de transición, cree stems listos para mashup y prepare gotas vocales para el rendimiento en vivo. Esencial para DJs que quieran mezclas únicas que distingan sus conjuntos de la competencia.

Educación musical

Aísla las partes vocales para clases de canto, entrenamiento de oídos y estudio de teoría musical. Practica la armonización con pistas de respaldo aisladas. Analiza las técnicas vocales escuchando la pista vocal aislada. Crea pistas de práctica para estudiantes de música y entrenadores vocales.

Creación de vídeo y contenido

Extraiga instrumentales para música de fondo en videos, podcasts y contenido de redes sociales. Utilice versiones sin voz de canciones populares como pistas de fondo sin distracción lírica. Cree bancos de sonido personalizados para YouTube, TikTok e Instagram.

Cubrir canciones

Graba tus propias voces sobre la pista instrumental original de cualquier canción. Crea versiones de portada de alta calidad con pistas de respaldo auténticas. Perfecto para cantantes que construyen su portafolio, graban demos o publican portadas en YouTube y redes sociales.

Transcripción y análisis

Aisla las voces para una transcripción lírica precisa, especialmente para canciones con instrumentación compleja que hace que sea difícil escuchar las palabras. Analiza melodías vocales, armonías y ad-libs en aislamiento. Útil para musicólogos y periodistas de música que estudian la interpretación vocal.

El mejor desinstalador de voz gratis en línea

Desarrollado por Mel-Band RoFormer

La eliminación de vocales ejecuta un modelo Mel-Band RoFormer, un transformador que asiste a través del tiempo y a través de bandas de frecuencia mel escaladas del espectrograma. En 50 extractos de prueba MUSDB18 midió 11.3 dB SDR vocal y 16,0 dB instrumental SDR (relación señal-distorsión, más alto es más limpio), aproximadamente 3 dB mejor en ambos que el motor que usamos antes. Esperan un poco de sangrado en mezclas densas o fuertemente comprimidas.

Un motor en cada nivel

Las separaciones gratuitas y de cuenta se ejecutan en el mismo modelo, por lo que un resultado gratuito no es una vista previa de menor calidad. El modo que elijas cambia la forma en que se factura el trabajo, no qué modelo se ejecuta.

Sin marcas de agua, sin restricciones

A diferencia de muchas herramientas de eliminación vocal competidoras que añaden marcas de agua, limitan la calidad de salida en niveles libres o restringen los formatos de descarga, TTS.ai le proporciona archivos de salida limpios y sin restricciones. Descargue en MP3, WAV o FLAC a plena calidad. Sus pistas separadas están listas para usarse inmediatamente en cualquier DAW o reproductor multimedia sin necesidad de post-procesamiento.

API REST para desarrolladores

Integre la eliminación vocal en sus propias aplicaciones con nuestra API REST para desarrolladores. Procese las canciones programáticamente, cree funciones de eliminación vocal en aplicaciones de música, cree flujos de trabajo automatizados de preparación de DJ o cree herramientas para plataformas de educación musical. Acceso API incluido en cada plan. Ejemplos de SDKs para Python, JavaScript y cURL en la documentación.

Planes de eliminación vocal

Comience gratis, actualice cuando necesite más

Libre
  • Modelo vocal Mel-Band RoFormer
  • Canciones de 10 minutos
  • Vocales + Instrumentales
  • Salida de MP3 y WAV
  • No se requiere cuenta
Más populares
Cuenta gratuita
  • El mismo modelo que el nivel libre
  • 4-stem splits in the Stem Splitter
  • Rápido / Equilibrado / Mejores modos
  • Todos los formatos de salida
  • 15.000 caracteres libres
Regístrate gratis
Pro
  • Archivos de audio más largos
  • Separación por lotes
  • Acceso a la API
  • Tratamiento prioritario
Actualizar

Preguntas frecuentes

La eliminación de la voz AI utiliza un modelo de aprendizaje profundo (Mel-Band RoFormer) que analiza el espectrograma de su canción a través del tiempo y bandas de frecuencia mel escaladas. Se estima la canción vocal, y el instrumental es la mezcla original con esa canción vocal removida, produciendo una salida de estilo karaoke limpio.

El modelo vocal midió SDR vocal de 11.3 dB y SDR instrumental de 16,0 dB en extractos de prueba de 50 MUSDB18, aproximadamente 3 dB mejor en ambos que el motor que usamos antes. La salida instrumental es típicamente lo suficientemente limpia para karaoke o remezcla.

¡Sí! Obtienes tanto la voz aislada como la pista instrumental. Esto es útil para crear versiones de acapella, para probar voces para remezclas o transcribir letras de mezclas complejas.

Soportamos archivos MP3, WAV, FLAC, OGG, M4A y WEBM de hasta 50MB. Para obtener los mejores resultados, utilice el archivo fuente de la más alta calidad disponible (WAV o FLAC preferido sobre MP3 comprimido).

Sí, crear canciones de karaoke es uno de los usos más populares. La salida instrumental es lo suficientemente limpia para actuaciones de karaoke, videos de canciones y música de fondo para eventos.

Subir la canción y la herramienta produce automáticamente tanto la pista vocal aislada (acapella) como el instrumental. La extracción vocal funciona mejor en pistas bien mezcladas con voces claras. Utilice archivos fuente WAV o FLAC para obtener los resultados más limpios.

El procesamiento por lotes está disponible a través de nuestra API, permitiéndole enviar múltiples pistas para la eliminación vocal en un flujo de trabajo automatizado. La interfaz web procesa una canción a la vez con una vista previa instantánea y descarga.

Nuestra herramienta utiliza un modelo Mel-Band RoFormer para la separación vocal. En 50 extractos de la prueba MUSDB18 midió SDR vocal de 11.3 dB y SDR instrumental de 16,0 dB. La separación basada en transformadores como esta deja menos artefactos que métodos espectrales más antiguos.

Sí, pero los resultados varían con audio en vivo. Las grabaciones de estudio dan la mejor calidad de separación. Las grabaciones en vivo con ruido de audiencia, reverberación e instrumentos superpuestos pueden tener más resultados, aunque el modelo aún produce resultados utilizables.

La eliminación vocal utiliza 2.000 caracteres por pista procesada. Las cuentas gratuitas reciben 15.000 caracteres al registrarse. La herramienta está disponible en todos los planes de pago con generosas asignaciones de caracteres para uso regular.

El audio que usted separa en cualquier plan de pago puede ser usado comercialmente, y la actualización también cubre audio que usted separó anteriormente en el nivel libre; la salida de nivel libre es para uso personal, no comercial solamente. El modelo vocal de Mel-Band RoFormer se libera bajo la licencia del MIT, por lo que el modelo mismo no impone ninguna restricción al uso comercial. En cada caso usted debe tener los derechos de la canción original: usar música con copyright sin permiso puede violar las leyes de copyright independientemente de cómo se procesa el audio.

El tiempo de procesamiento depende de la longitud de la pista. Una canción típica de 3-5 minutos tarda 15-45 segundos en procesarse. Las pistas más largas o los modos de separación de mayor calidad pueden tardar hasta un minuto. Los resultados se reproducen al instante en su navegador.
5.0/5 (1)

¿Qué podríamos mejorar? Sus comentarios nos ayudan a solucionar problemas.

Eliminar vocales de cualquier canción gratis

Únete a miles de músicos y creadores usando TTS.ai. Eliminación de voz con un modelo Mel-Band RoFormer en cada nivel. 15.000 personajes gratis con registro.