AI Stem Splitter

Divida calquera canción en partes individuais: voces, batería, baixo e outros instrumentos. Está alimentado por IA de última xeración para a produción musical, remezclas e práctica.

Non o facemos. Vender a túa voz

Enviar a pista de música

3- 5 créditos por canción

Arrastre e solte o ficheiro aquí, ou navegar

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

ficheiro.mp3

0 MB

Configuración da división do tronco

Voces dun modelo Mel-Band RoFormer, batería, baixo e outros dun modelo SCNet, saída WAV sen perdas, listo para a súa DAW.

División libre de 2 ramas — non se precisa conta.

Como funciona

Enviar a pista
A IA separa cada talo
Previsualizar e obter os talos
A dividir os talos...

A dividir a pista en segmentos...

A usar Mel-Band RoFormer + SCNet para 4 voces
Leva un tempo? O seu resultado aparecerá no seu historial de xeración cando estea listo.
Completouse a división da voz

Vogais

0:00

Batería

0:00

Baixo

0:00

Outros

0:00
Tallos creados 4
Duración da canción 4:12
Tempo de procesamento 18.3s

Que son os audio stems?

Os troncos de son son as pistas individuais de instrumentos ou voces que compoñen unha canción. A música profesional típicamente mestúrase a partir de ducias de pistas individuais, pero a división de troncos usa IA para facer enxeñaría inversa da mestura e extraer os compoñentes primarios.

Vogais Canto, rap, harmonías, coros, ad- libs
Batería Kick, snare, hi- hats, címbalos, toms, percusión
Baixo Baixo, baixo sintetizado, subbaixo, 808s
Outros Todo o resto: guitarras, piano, teclas, cordas, metais, sintetizadores, efectos

Detalles do modelo

Vogais Mel-Band RoFormer

Separates the vocals in every split. A transformer attends across time and across mel-scaled frequency bands of the spectrogram, and the instrumental is the mix with those vocals removed. Measured on 50 MUSDB18 test excerpts: 11.3 dB vocal SDR and 16.0 dB instrumental SDR.

Cabeceiras: 2, 4

Batería SCNet

Divide o instrumental en batería, baixo e outros instrumentos no modo de 4 cordas. Divide o espectrograma en subbandas de frecuencia e dá máis detalles ás bandas baixas, onde están o baixo e a batería.

Cabeceiras: 4

Consellos para obter os mellores resultados

  • Empregar a entrada sen perdas (WAV/FLAC) para a separación máis limpa
  • 4 stems é o punto ideal para a maioría das necesidades de produción musical
  • Guitarra, piano e sintetizadores todos aterran no Other stem
  • As cancións con arranxos claros (menos capas) producen mellores resultados
  • Exportar como WAV se planea importar nunha DAW para editar
  • Para eliminar só as voces, probe o noso Eliminador de voces

Como funciona

Os nosos modelos de aprendizaxe profunda analizan os patróns espectrais e temporais da súa música para illar grupos individuais de instrumentos cunha precisión notable.

Paso 1

Enviar a pista

Arrastre e solte o seu ficheiro de música en calquera formato de son común. Aceptamos ficheiros MP3, WAV, FLAC, OGG e M4A de ata 50 MB. Para obter os mellores resultados, use formatos sen perdas como WAV ou FLAC. O seu ficheiro procesarase de forma segura nos nosos servidores de GPU e borrarase automaticamente no prazo de 1 hora.

Paso 2

A IA separa cada talo

Un modelo RoFormer de banda Mel separa primeiro as voces, empregando a atención do transformador a través do tempo e bandas de frecuencia escaladas en mel do espectrograma. Para 4 cordas, un modelo SCNet divide entón o instrumental restante en batería, baixo e outros instrumentos.

Paso 3

Previsualizar e obter os talos

Cada tronco extraído obtén o seu propio reprodutor de son para que poida previsualizar instrumentos individuais illados. Solo ou silencie troncos específicos para escoitar como interactúan. Descargue cada tronco por separado ou obtéñaos todos nun cómodo arquivo ZIP listo para importar na súa DAW.

Casos de uso da división do tronco

A división do tronco impulsada pola IA está revolucionando a produción musical, a educación e os fluxos de traballo creativos en toda a industria.

Produción e remezcla de música

Extraia ramas individuais para crear remixes, mashups e novos arranxos. Mostre patróns de batería, liñas de baixo ou ganchos vocais de gravacións existentes. Capture ramas de diferentes cancións para crear producións únicas. Esencial para produtores que traballan con pistas de referencia ou que crean remixes oficiais.

Conxuntos e actuacións de DJName

Prepare stems para sets e actuacións de DJ en directo. Cree drop acapella, pausas de batería illadas e versións só de baixo para mesturas creativas. Cree pistas de transición que conecten as cancións sen problemas. Mezcle stems vocais dunha pista sobre o instrumental doutra para mashups únicos en directo.

Práctica e estudo

Isolate specific instrument parts to practice along with. Drummers can mute the drum track and play along with the rest of the band. Bassists can isolate the bass line to study technique. Guitarists and keyboard players can solo the Other stem to hear their parts without vocals, drums or bass.

Educación musical

Divida as cancións en compoñentes paranálise da teoría musical. Axude aos estudantes a comprender como interactúan os instrumentos nunha mestura. Demostre as técnicas de arranxo mostrando como cada elemento contribúe á canción final. Cree pistas de práctica personalizadas para as clases de música.

Deseño de son e mostraxe

Extraia mostras limpas de calquera gravación para usalas en novas producións. Isole golpes de batería, sons de baixo, cortes vocais e frases musicais. Construa paquetes de mostras e bibliotecas de son a partir de gravacións existentes. Cree texturas únicas procesando ramas individuais a través de cadeas de efectos.

Postprodución de películas e medios

Extraia estrofas musicais para a postprodución de filmes e televisión. Axuste o equilibrio entre voces e instrumentos nas mesturas de banda sonora. Cree versións instrumentais de música licenciada para uso de fondo. Isole elementos específicos para o deseño de son e o traballo de Foley na produción de vídeo.

Karaoke e versións de portadas

Cree perfectas pistas de acompañamento para karaoke eliminando os vocais. Grave as súas propias voces sobre o arranxo instrumental orixinal. Use a batería e o baixo como pista de acompañamento da sección rítmica para actuacións acústicas ou ensaios de banda. Cree pistas de acompañamento personalizadas para espectáculos en directo.

Análise e transcrición de son

Isole os troncos para crear transcricións musicais precisas. Escoite claramente as partes individuais dos instrumentos para fins de notación. Analice as técnicas de mestura estudando como se procesa cada tronco. Perfecto para musicólogos, servizos de transcrición e análise de arranxos.

O divisor de talos libre máis potente en liña

Dous modelos especializados

Each part of the split uses a model trained for that job. Vocals come from a Mel-Band RoFormer model that measured 11.3 dB vocal SDR on 50 MUSDB18 test excerpts, about 3 dB above our previous engine. In 4-stem mode an SCNet model separates drums, bass and other instruments from the instrumental. Guitar, piano and synths stay together in the Other stem.

División libre de 2 talos

Comece de balde coa separación de 2 cordas. Divida calquera canción en voces e instrumentais sen crear unha conta ou gastar caracteres. A división libre usa o mesmo modelo vocal que as divisións de conta, sen marcas de auga. Cree unha conta libre para dividir baterías, baixos e outros instrumentos no modo de 4 cordas.

Procesamento acelerado pola GPU

A división de troncos é computacionalmente intensiva. TTS.ai executa os modelos de separación en GPU NVIDIA dedicadas. O tempo de procesamento aumenta coa lonxitude da canción, e 4 troncos tardan máis que 2 porque un segundo modelo executa o instrumental.

API REST para procesamento por lotes

Procese bibliotecas musicais enteiras mediante programación coa nosa API de desenvolvemento. Construa a división de troncos nos seus propios programas, ferramentas de produción musical ou fluxos de traballo de preparación de DJ. A API soporta 2 e 4 troncos. O seu parámetro de modelo aínda acepta demucs e spleeter para compatibilidade, e ambos executan o mesmo motor. O acceso á API inclúese en todos os plans con Python, JavaScript e cURL SDKs.

Planos de división de voz

Comece de balde, actualice cando precise máis

Libre
  • División de 2 partes (vocais + instrumental)
  • Mel- Band RoFormer vocal model
  • Cancións de 10 minutos
  • Non se require conta
Máis popular
Conta libre
  • División de 4 cordas (vocais, batería, baixo, outros)
  • Batería, baixo e outros instrumentos SCNet
  • Obter por raíz + ZIP
  • 15. 000 caracteres libres
Inscríbete gratis
Pro
  • Envios de ata 2 GB
  • Ficheiros de son máis longos
  • Procesamento por lotes
  • Acceso á API
Actualizar

Preguntas frecuentes

A división do tronco separa unha pista de son mesturada en compoñentes individuais (troncos): voces, batería, baixo e outros instrumentos. Isto é moi valioso para a produción musical, remesturas, mostraxe, transcrición e karaoke.

Pode dividir unha pista en 2 partes (vocais e instrumentais) ou 4 partes (vocais, batería, baixo e outros instrumentos). A guitarra, o piano, os sintetizadores e todo o que non sexa voz, batería ou baixo permanecen xuntos na Outra parte.

As voces están separadas por un modelo Mel- Band RoFormer en cada división. No modo de 4 cordas, un modelo SCNet separa a batería, o baixo e outros instrumentos do instrumental. Hai un motor para cada nivel, polo que a división libre de 2 cordas usa o mesmo modelo vocal que as divisións de conta.

On 50 MUSDB18 test excerpts the vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR (signal-to-distortion ratio, higher is cleaner), about 3 dB better on both than the engine we used before. Some bleed-through between stems is normal, especially on heavily layered or compressed mixes.

O tempo de procesamento depende da lonxitude da pista e do número de cordas. Unha división de 4 cordas leva máis tempo que unha división de 2 cordas, porque un segundo modelo separa o instrumental despois de eliminar os vocais.

Stems you separate on any paid plan can be used commercially, and upgrading also covers stems you made earlier on the free tier; free-tier output is for personal, non-commercial use only. Both separation models are released under licenses that allow commercial use: MIT for the Mel-Band RoFormer vocal model and Apache 2.0 for the SCNet model. In every case you must have the rights to the original audio: separating copyrighted music does not grant you new rights to the individual stems.

O procesamento por lotes está dispoñíbel a través da nosa API, o que lle permite enviar varias pistas para a separación do tronco nun fluxo de traballo automatizado. A interface web xestiona unha pista de cada vez con vista previa instantánea e descarga de todos os troncos.

Non como unha árbore propia. O modo de 4 árbores xunta guitarras, piano, sintetizadores, teclados e todos os outros instrumentos na árbore Outra. Non está dispoñíbel unha árbore dedicada á guitarra ou ao piano.

Si, cada tronco é exportado como un ficheiro de son separado que pode ser importado en calquera DAW (Ableton, Logic Pro, FL Studio, etc.) para remezclar. Axuste os niveis, engada efectos ou substitua troncos individuais para crear novos arranxos.

A división do tronco emprega 2000 caracteres por pista procesada. As contas gratuítas reciben 15000 caracteres ao rexistrarse. Todos os plans de pago inclúen xenerosas asignacións de caracteres para uso regular.

Acéptanse ficheiros MP3, WAV, FLAC, OGG, M4A e WEBM de ata 50 MB. Para unha mellor calidade de separación, envíe formatos sen perdas (WAV, FLAC). Os ficheiros de saída fornécense en formato WAV para preservar a máxima calidade.

Our vocals come from a Mel-Band RoFormer model, a transformer architecture for music source separation, and the 4-stem split adds an SCNet model for drums, bass and other instruments. Rather than a ranking, we publish what we measured: 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts.
5.0/5 (1)

Que podemos mellorar? Os seus comentarios axúdannos a corrixir os problemas.

Divida calquera canción en partes gratuitamente

Únase a miles de músicos e produtores que usan TTS.ai. Agora está dispoñíbel a división gratuíta de 2 partes. Obteña 15.000 caracteres cunha conta gratuíta para o modo de 4 partes.