Eliminador Vocal da IA

Separar vozes de instrumentais em qualquer canção usando IA de última geração. Crie faixas de karaoke, acapellas e faixas de suporte gratuitamente.

Carregar a canção para o processo

3.000 caracteres por canção

Arraste e largue o seu arquivo aqui, ou navegar

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB
— ou registo do seu microfone —
00:00

Configurações de Separação

Ambos os modos usam o mesmo modelo Mel-Band RoFormer.
Livre para tentar com uma conta gratuita

Como funciona

Envie sua canção
AI separa as pistas
Antevisão e Baixe
Separando vozes...

Separando vozes de instrumentais...

Utilização Mel-Band RoFormer em Balanço qualidade
Seu resultado aparecerá em seu história da geração quando pronto.
Separação Vocal Completa

Vocais

0:00

Instrumental

0:00
Qualidade de separação 8.2 dB SDR
Sangue Vocal < 2%
Duração da canção 3:42
Tempo de processamento 12.4s

Motor de separação

Modelo Mel-Band RoFormer
Produção Vocais + instrumentais
DSVV 11.3 dB
DSE instrumental 16.0 dB

Medidos em extratos de teste 50 MUSDB18. A SDR é a razão sinal-distorção: maior é mais limpa. O nosso motor anterior obteve 8,4 dB (vocais) e 13,1 dB (instrumental).

Por que TTS.ai vs Concorrentes

Disponível em nível livre

Tente com uma conta gratuita. Concorrentes como LALAL.AI, Moises e PhonicMind cobram $5-25/mes para remoção vocal básica.

Qualidade de separação medida

Os Vocals são separados por um modelo Mel-Band RoFormer. Em 50 MUSDB18 extratos de testes obteve 11,3 dB vocal SDR e 16,0 dB instrumental SDR, cerca de 3 dB acima do nosso motor anterior em ambos.

Sem marcas de água ou tampas de qualidade

Baixe a saída de qualidade completa em WAV, MP3, ou FLAC. Sem marcas de água, sem corte, sem restrições de taxa de bits em qualquer nível.

Acesso API para processamento de lotes

Processar centenas de músicas programáticamente através da nossa API REST. Perfeito para empresas de produção de música e piscinas de DJ.

Dicas para os melhores resultados

  • Use a entrada WAV ou FLAC para a máxima separação de qualidade
  • Escolha Tanto para obter a acapella como o instrumental de um upload
  • Estúdio mestres separam mais limpamente do que gravações ao vivo ou bootleg
  • Canções com separação estéreo clara produzem os melhores resultados
  • Os MP3s fortemente comprimidos (128kbps ou inferiores) podem ter redução da qualidade da separação
  • Para a divisão multi-stem (drums, baixos, etc.), use o nosso Separador de stems

Como funciona

As redes neurais profundas analisam o espectro de áudio da sua música, identificam as frequências vocais e separam-nas de forma limpa do suporte instrumental em três etapas.

Passo 1

Envie sua canção

Arrastrar e soltar qualquer música no formato MP3, WAV, FLAC, OGG ou M4A. Nós suportamos arquivos até 50MB e canções até 10 minutos de comprimento. Seu arquivo é criptografado durante o upload e processado em instâncias GPU isoladas. Os arquivos são automaticamente apagados dentro de 1 hora do processamento.

Passo 2

AI separa as pistas

Um modelo Mel-Band RoFormer converte o seu áudio em um espectrograma dividido em bandas de frequências mel-scaled, então usa atenção transformadora ao longo do tempo e frequência para estimar a faixa vocal. O instrumental é a mistura original com essa faixa vocal removida, então as duas faixas adicionam de volta à sua música.

Passo 3

Antevisão e Baixe

Ouça as faixas vocais e instrumentais separadas lado a lado com nossos leitores de áudio incorporados, e então baixe cada faixa no seu formato preferido.

Casos de utilização do removedor Vocal

A remoção vocal da IA abre possibilidades criativas para músicos, DJs, criadores de conteúdos e entusiastas de música em uma ampla gama de aplicações.

Karaoke

Crie versões de karaoke de qualquer canção instantaneamente. Remova as vozes de chumbo para cantar junto com o suporte instrumental original. Perfeito para a noite de karaoke, prática de canto, aquecimento vocal, ensaios de cor e bares de karaoke. Funciona com qualquer gênero de pop para rock para R&B.

Remistura & Mashups

Extrair vozes isoladas ou instrumentais para criar remixões, machupes e edições de bootleg. Combinar vozes de uma canção com o batimento de outra. Acapellas de camada sobre suas próprias produções. Essencial para os produtores criando remixes oficiais e não oficiais.

Produção Música

Amostra vocal e peças instrumentais de gravações existentes para uso em novas produções. Extrair ganchos vocais, ad-libs e harmonias. Riffs de guitarra isolados, linhas de baixo, ou patchs synth para amostragem criativa. Acelere dramaticamente o seu fluxo de trabalho de produção.

Sets de DJ e Desempenho ao vivo

Crie instrumentais limpos e acapellas para conjuntos de DJ ao vivo. Construa faixas de transição, crie stems de mashup prontas e prepare gotas vocais para o desempenho ao vivo. Essential para DJs que querem misturas únicas que estabelecem seus conjuntos separados da competição.

Educação Música

Isole peças vocais para aulas de canto, treinamento de orelhas e estudo da teoria da música. Practice harmonização com faixas isoladas de suporte. Analise as técnicas vocais ao ouvir a faixa vocal isolada. Crie faixas de prática para estudantes de música e treinadores vocais.

Criação de Vídeo e Conteúdo

Extrair instrumentos para música de fundo em vídeos, podcasts e conteúdos de mídia social. Use versões livres de voz de músicas populares como faixas de fundo sem distração lírica. Crie leitos de som personalizados para o YouTube, TikTok e o conteúdo do Instagram.

Canções de Cover

Grave suas próprias vozes sobre a pista instrumental original de qualquer música. Crie versões de cobertura de alta qualidade com faixas de suporte autênticas. Perfeito para cantores construir seu portfólio, gravação demo, ou postação de capas para YouTube e mídias sociais.

Transcrição e Análise

Isola os vocais para a transcrição lírica precisa, especialmente para canções com instrumentação complexa que torna difícil ouvir as palavras. Analisar melodias vocais, harmonias e ad-libs isoladamente. Útil para musicologistas e jornalistas de música que estudam performance vocal.

O melhor remotor Vocal grátis on-line

Alimentado por Mel-Band RoFormer

A remoção vocal executa um modelo Mel-Band RoFormer, transformador que participa ao longo do tempo e em bandas de frequência mel-escaladas do espectrograma. Em extratos de teste 50 MUSDB18 mediram 11,3 dB vocal SDR e 16,0 dB instrumental SDR (razón de sinal-para-distorção, maior é mais limpa), cerca de 3 dB melhor em ambos que o motor que usamos antes. Esperam alguns sangramentos em misturas densas ou fortemente comprimidas.

Um motor em cada nível

As separações livres e de contas executam o mesmo modelo, por isso um resultado livre não é uma visualização de menor qualidade. O modo que você escolhe altera como o trabalho é facturado, não que modelo é executado.

Sem marcas de água, sem restrições

Ao contrário de muitas ferramentas de remoção vocal concorrentes que adicionam marcas de água, limitem a qualidade de saída em níveis livres, ou restringem os formatos de download, TTS.ai dá arquivos de saída limpos e sem restrições. Baixe em MP3, WAV, ou FLAC a toda a qualidade. Seus faixas separadas estão prontas para usar imediatamente em qualquer DAW ou leitor de mídia sem qualquer post-processamento necessário.

API REST para desenvolvedores

Integrar a remoção vocal em suas próprias aplicações com a nossa API REST amigável para desenvolvedores. Processar canções programáticamente, construir recursos de remoção vocal em aplicativos musicais, criar fluxos de trabalho automatizados de preparação de DJ ou construir ferramentas para plataformas de educação musical. Acesso API incluído em cada plano. exemplos de SDKs para Python, JavaScript e cURL na documentação.

Planos de Remoção Vocal

Comece livre, atualização quando você precisa mais

Grátis
  • Mel-Band RoFormer modelo vocal
  • Canções de 10 minutos
  • Vocais + Instrumentais
  • MP3 & WAV saída
  • Não é necessária nenhuma conta
Mais Popular
Conta Livre
  • O mesmo modelo que o nível livre
  • Divisões de 4 stems no Separador de stems
  • Rápido / Balanceado / Melhores modos
  • Todos os formatos de saída
  • 15.000 caracteres livres
Inscreva-se gratuitamente
Pro
  • Arquivos de áudio mais longos
  • Separação de lote
  • Acesso à API
  • Tratamento prioritário
Actualização

Perguntas Frequentes

A remoção vocal da IA utiliza um modelo de aprendizagem profunda (Mel-Band RoFormer) que analisa o espectrograma de sua música ao longo do tempo e bandas de frequências escaladas de mel. Estima a faixa vocal, e o instrumental é a mistura original com essa faixa vocal removida, produzindo saída limpa de estilo karaoke.

O modelo vocal mediu 11,3 dB vocal SDR e 16,0 dB instrumental SDR em 50 MUSDB18 extratos de teste, cerca de 3 dB melhor em ambos que o motor que usamos antes. A saída instrumental é tipicamente limpa o suficiente para karaoke ou remixing. Alguns hemorragias podem ocorrer em faixas pesadamente processadas ou comprimidas.

Sim! Você recebe tanto as vozes isoladas como a pista instrumental. Isto é útil para criar versões de acapella, amostrar as vozes para remixões, ou transcrição de letras de misturas complexas.

Nós suportamos arquivos MP3, WAV, FLAC, OGG, M4A e WEBM até 50MB. Para os melhores resultados, use o arquivo fonte de alta qualidade disponível (WAV ou FLAC preferido em MP3) comprimido.

Sim, criar faixas de karaoke é uma das mais populares. A saída instrumental é limpa o suficiente para performances de karaoke, vídeos de canto e música de fundo para eventos.

Carregue a música e a ferramenta automaticamente produz tanto a faixa vocal isolada (acapella) como o instrumental. A extração vocal funciona melhor em faixas bem misturadas com voz clara. Use arquivos de fonte WAV ou FLAC para os resultados mais limpos.

O processamento de lotes está disponível através da nossa API, permitindo que você envie várias faixas para remoção vocal em um fluxo de trabalho automatizado. A interface web processa uma música de cada vez com visualização instantânea e download.

Nossa ferramenta utiliza um modelo Mel-Band RoFormer para separação vocal. Em 50 MUSDB18 extratos de testes mediram 11,3 dB vocal SDR e 16,0 dB instrumental SDR. Separação baseada em transformadores, como isso deixa menos artefatos do que métodos espectrais mais antigos.

Sim, mas os resultados variam com áudio ao vivo. As gravações estúdio dão a melhor qualidade de separação. As gravações ao vivo com ruído de audiência, reverb e instrumentos sobrepostos podem ter mais hemorragia, embora o modelo ainda produza resultados utilizáveis.

Remoção Vocal usa 2.000 caracteres por faixa processada. Contas gratuitas recebem 15.000 caracteres na inscrição. A ferramenta está disponível em todos os planos pagos com licenças de caráter generosas para uso regular.

O áudio que você separa em qualquer plano pago pode ser usado comercialmente, e a atualização também cobre áudio que você se separa mais cedo no nível livre; a saída de nível livre é para uso pessoal e não comercial apenas. O modelo vocal Mel-Band RoFormer é lançado sob a licença MIT, por isso o próprio modelo não coloca nenhuma restrição no uso comercial. Em todos os casos você deve ter os direitos à música original: usar música com copyright sem permissão pode violar as leis de copyright independentemente de como o áudio é processado.

O tempo de processamento depende do comprimento da pista. Uma música típica de 3-5 minutos leva 15-45 segundos para processar. Os modos de separação mais longos ou de maior qualidade podem levar até um minuto. Os resultados reproduzem instantaneamente no seu navegador.
5.0/5 (1)

O que podemos melhorar? Seu feedback nos ajuda a resolver problemas.

Remover Vocals de Qualquer Canção Grátis

Junte-se a milhares de músicos e criadores usando TTS.ai. Remoção Vocal com um modelo Mel-Band RoFormer em cada nível. 15.000 caracteres livres com inscrição.