AI Stem Splitter

Dividir cualquier canción en stems individuales: vocales, tambores, bajo y otros instrumentos. Impulsado por la IA de última generación para la producción de música, remezcla y práctica.

Cargar pista de música

3.000 a 5.000 caracteres por canción

Arrastre y suelte su archivo aquí, o navegar

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB

Configuración de división de stems

Vocales de un modelo Mel-Band RoFormer, tambores, bajo y otros de un modelo SCNet, salida WAV sin pérdidas, listo para su DAW.

División gratuita en 2 stems, sin necesidad de cuenta.

Cómo funciona

Cargar la pista
AI separa cada stem
Vista previa y descarga de los stems
Dividiendo stems...

Dividir tu pista en stems...

Uso Mel-Band RoFormer + SCNet en lugar de 4 Stems
¿Tomando un tiempo? Su resultado aparecerá en su historia de la generación cuando esté listo.
Separación de stems completa

Vocales

0:00

Tambores

0:00

Bass

0:00

Otros

0:00
Stems creados 4
Duración de la canción 4:12
Tiempo de procesamiento 18.3s

¿Qué son los stems de audio?

Los stems de audio son el instrumento individual o las pistas vocales que componen una canción. La música profesional se mezcla típicamente a partir de docenas de pistas individuales, pero la división de stems utiliza la IA para inversionar la mezcla y extraer los componentes primarios.

Vocales Cantar, rapear, armonías, coros vocales, ad-libs
Tambores Patada, Snare, Hi-hats, platillos, tams, percusión
Bass Bajo guitarra, bajo sintético, sub bajo, 808s
Otros Todo lo demás: guitarras, piano, llaves, cuerdas, latón, sintetizadores, efectos

Detalles del modelo

Vocales Mel-Band RoFormer

Separa las voces en cada división. Un transformador asiste a través del tiempo y a través de bandas de frecuencia mel escaladas del espectrograma, y el instrumental es la mezcla con esas voces eliminadas. Medido en 50 extractos de prueba MUSDB18: 11.3 dB vocal SDR y 16,0 dB instrumental SDR.

Stems: 2, 4

Tambores SCNet

Divide el instrumental en tambores, bajo y otros instrumentos en modo de 4 stems. Divide el espectrograma en sub-bandas de frecuencia y da las bandas bajas, donde el bajo y la batería de patadas se sientan, más detalles.

Stems: 4

Consejos para obtener mejores resultados

  • Utilice la entrada sin pérdidas (WAV/FLAC) para la separación más limpia
  • 4 stems es el punto dulce para la mayoría de las necesidades de producción de música
  • Guitarra, piano y sintetizadores todos los terrenos en el stem Otro
  • Las canciones con arreglos claros (menos capas) producen mejores resultados
  • Exportar como WAV si planea importar a una DAW para editar
  • Para la eliminación sólo vocal, pruebe nuestro especialista Desinstalador vocal

Cómo funciona

Nuestros modelos de aprendizaje profundo analizan los patrones espectrales y temporales de su música para aislar grupos de instrumentos individuales con una precisión notable.

Medida 1

Cargar la pista

Arrastre y suelte su archivo de música en cualquier formato de audio común. Aceptamos archivos MP3, WAV, FLAC, OGG y M4A de hasta 50MB. Para obtener los mejores resultados, utilice formatos sin pérdidas como WAV o FLAC. Su archivo se procesa de forma segura en nuestros servidores GPU y se elimina automáticamente en 1 hora.

Medida 2

AI separa cada stem

Un modelo de Mel-Band RoFormer primero separa las voces, usando la atención de transformadores a través del tiempo y bandas de frecuencia mel escaladas del espectrograma. Para 4 stems, un modelo SCNet luego divide el instrumental restante en tambores, bajo y otros instrumentos.

Medida 3

Vista previa y descarga de los stems

Cada stem extraído obtiene su propio reproductor de audio para que pueda previsualizar los instrumentos individuales de forma aislada. Stems específicos en solitario o mudo para escuchar cómo interactúan. Descargue cada stem por separado o agárrelos todos en un conveniente archivo ZIP listo para importar en su DAW.

Casos de uso de división de stems

La división de stems con IA está revolucionando la producción de música, la educación y los flujos de trabajo creativos en toda la industria.

Producción y remezcla de música

Extraer stems individuales para crear remixes, mashups y nuevos arreglos. Muestra de patrones de tambor, líneas de bajo o ganchos vocales de grabaciones existentes. Superponer stems de diferentes canciones para crear producciones únicas. Esencial para productores que trabajan con pistas de referencia o crear remixes oficiales.

DJ Sets & Performance

Prepara los stems para los sets y actuaciones de DJ en vivo. Crea gotas de acapella, pausas aisladas de batería y versiones exclusivas de bajo para la mezcla creativa. Construye pistas de transición que conecten canciones sin problemas. Mezcla stems vocales de una pista sobre la instrumental de otra para mashups en vivo únicos.

Práctica y estudio

Aisla partes específicas del instrumento para practicar junto con. Los tambores pueden silenciar la pista de tambor y tocar junto con el resto de la banda. Los bajistas pueden aislar la línea de bajo para estudiar la técnica. Los guitarristas y los teclistas pueden solo el stem Otro para escuchar sus partes sin voz, batería o bajo.

Educación musical

Descomponga las canciones en componentes para el análisis de teoría musical. Ayude a los estudiantes a entender cómo los instrumentos interactúan en una mezcla. Demostre las técnicas de arreglo mostrando cómo cada stem contribuye a la canción final. Cree pistas de práctica personalizadas para las clases de música.

Muestreo y diseño de sonido

Extraer muestras limpias de cualquier grabación para su uso en nuevas producciones. Aislar golpes de tambor de un solo disparo, tonos de bajo, cortes vocales y frases musicales. Construir paquetes de muestras y bibliotecas de sonido de grabaciones existentes. Crear texturas únicas mediante el procesamiento de stems individuales a través de cadenas de efectos.

Postproducción de películas y medios

Extrae stems musicales para la postproducción de cine y TV. Ajusta el equilibrio entre las voces y los instrumentos en las mezclas de bandas sonoras. Crea versiones instrumentales de música licenciada para uso de fondo. Aísla elementos específicos para el diseño de sonido y el trabajo de Foley en la producción de vídeo.

Karaoke y versiones de portada

Crea pistas de karaoke perfectas eliminando voces. Graba tus propias voces sobre el arreglo instrumental original. Usa stems de batería y bajo como una sección de ritmo para realizar actuaciones acústicas o ensayos de bandas. Construye pistas de respaldo personalizadas para shows en vivo.

Análisis y transcripción de audio

Aislar stems para crear transcripciones musicales precisas. Escuchar partes de instrumentos individuales claramente para propósitos de notación. Analizar técnicas de mezcla mediante el estudio de cómo se procesa cada stem. Perfecto para musicólogos, servicios de transcripción y análisis de arreglos.

El divisor de stems gratis más potente en línea

Dos modelos especializados

Cada parte de la división utiliza un modelo entrenado para ese trabajo. Las vocales vienen de un modelo Mel-Band RoFormer que midió SDR de 11.3 dB en extractos de 50 MUSDB18 de prueba, aproximadamente 3 dB por encima de nuestro motor anterior. En modo de 4 stems un modelo SCNet separa tambores, bajos y otros instrumentos del instrumental. La guitarra, piano y sintetizadores permanecen juntos en el stem Otro.

Separación gratuita de 2 stems

Empieza gratis con separación de 2 stems. Divide cualquier canción en voces e instrumental sin crear una cuenta o gastar personajes. La división gratuita utiliza el mismo modelo vocal que las divisiones de cuentas, sin marcas de agua. Crea una cuenta gratuita para dividir tambores, bajos y otros instrumentos en modo de 4 stems.

Procesamiento acelerado por GPU

La división de stems es computacionalmente intensiva. TTS.ai ejecuta los modelos de separación en GPUs NVIDIA dedicadas. El tiempo de procesamiento crece con la longitud de la canción, y 4 stems tardan más de 2 porque un segundo modelo funciona en el instrumental.

API REST para el procesamiento por lotes

Procesar bibliotecas de música enteras de forma programática con nuestra API de desarrolladores. Construir la división de stems en sus propias aplicaciones, herramientas de producción de música o flujos de trabajo de preparación de DJ. La API admite 2 y 4 stems. Su parámetro de modelo todavía acepta demucs y spleeter para compatibilidad, y ambos ejecutan el mismo motor. Acceso API incluido en cada plan con Python, JavaScript y cURL SDKs.

Planes de división de stems

Comience gratis, actualice cuando necesite más

Libre
  • División en 2 stems (voz + instrumental)
  • Modelo vocal Mel-Band RoFormer
  • Canciones de 10 minutos
  • No se requiere cuenta
Más populares
Cuenta gratuita
  • División en 4 stems (voz, batería, bajo, otros)
  • Baterías SCNet, bajo y otros
  • Descarga por stem + ZIP
  • 15.000 caracteres libres
Regístrate gratis
Pro
  • Carga hasta 2 GB
  • Archivos de audio más largos
  • Procesamiento por lotes
  • Acceso a la API
Actualizar

Preguntas frecuentes

La división de stems separa una pista de audio mixta en componentes individuales (stems): vocales, tambores, bajo y otros instrumentos. Esto es invaluable para la producción de música, remezcla, muestreo, transcripción y karaoke.

Puedes dividir una pista en 2 stems (voz e instrumental) o 4 stems (voz, batería, bajo y otros instrumentos).Guitarra, piano, sintetizadores y todo lo demás que no sea vocal, batería o bajo permanecen juntos en el stem Otro.

Las vocales están separadas por un modelo Mel-Band RoFormer en cada división. En el modo de 4-stems, un modelo SCNet separa los tambores, el bajo y otros instrumentos del instrumental. Hay un motor para cada nivel, por lo que la división de 2-stems gratis utiliza el mismo modelo vocal que las divisiones de cuenta.

En 50 extractos de la prueba MUSDB18 el modelo vocal medido 11.3 dB SDR vocal y 16,0 dB instrumental SDR (relación señal-distorsión, mayor es más limpio), aproximadamente 3 dB mejor en ambos que el motor que usamos antes. Algunos sangrados entre stems es normal, especialmente en mezclas fuertemente en capas o comprimidas.

El tiempo de procesamiento depende de la longitud de la pista y del número de stems. Una división de 4 stems toma más tiempo que una división de 2 stems, porque un segundo modelo separa el instrumental después de que se retiran las voces.

Los stems que se separan de cualquier plan de pago pueden ser utilizados comercialmente, y la actualización también cubre los stems que hizo anteriormente en el nivel libre; la salida de nivel libre es para uso personal y no comercial solamente. Ambos modelos de separación se liberan bajo licencias que permiten el uso comercial: MIT para el modelo vocal Mel-Band RoFormer y Apache 2.0 para el modelo SCNet. En todos los casos debe tener los derechos del audio original: separar música con copyright no le otorga nuevos derechos sobre los stems individuales.

El procesamiento por lotes está disponible a través de nuestra API, lo que le permite enviar múltiples pistas para la separación de stems en un flujo de trabajo automatizado. La interfaz web maneja una pista a la vez con una vista previa instantánea y descarga de todos los stems.

No como su propio stem. El modo de 4 stems pone guitarras, piano, sintetizadores, teclados y cualquier otro instrumento juntos en el stem Otro. No hay disponible un stem de guitarra o piano dedicado.

Sí, cada stem se exporta como un archivo de audio separado que se puede importar a cualquier DAW (Ableton, Logic Pro, FL Studio, etc.) para remezclar. Ajustar niveles, añadir efectos o reemplazar los stems individuales para crear nuevos arreglos.

La división de stems usa 2.000 caracteres por pista procesada. Las cuentas gratuitas reciben 15.000 caracteres al registrarse. Todos los planes de pago incluyen generosas asignaciones de caracteres para su uso regular.

Aceptamos archivos MP3, WAV, FLAC, OGG, M4A y WEBM de hasta 50MB. Para la mejor calidad de separación, suba formatos sin pérdidas (WAV, FLAC). Los stems de salida se proporcionan en formato WAV para preservar la máxima calidad.

Nuestras voces provienen de un modelo Mel-Band RoFormer, una arquitectura transformadora para la separación de fuentes musicales, y la división de 4 stems añade un modelo SCNet para batería, bajo y otros instrumentos. En lugar de un ranking, publicamos lo que medimos: 11.3 dB vocal SDR y 16,0 dB instrumental SDR en extractos de 50 MUSDB18 de pruebas.
5.0/5 (1)

¿Qué podríamos mejorar? Sus comentarios nos ayudan a solucionar problemas.

Dividir cualquier canción en stems gratis

Únete a miles de músicos y productores que utilizan TTS.ai. Separación gratuita de 2 stems disponible ahora. Consigue 15.000 caracteres con una cuenta gratuita para el modo de 4 stems.