Usuwacz AI Vocal

Oddzielne wokały od instrumentów w dowolnej piosence, używając najnowocześniejszego AI. Tworzenie karaoke ścieżek, akapel i poparcie ścieżek za darmo.

Przesyłanie piosenki do procesu

3000 znaków na piosenkę

Przeciągnij i upuść plik tutaj, lub przeglądaj

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB
— lub zapis z mikrofonu —
00:00

Ustawienia oddzielenia

Obydwa tryby używają tego samego modelu Mel-Band RoFormer.
Bezpłatne do spróbujenia z bezpłatnym kontom

Jak działa

Wyślij swoją piosenkę
AI rozdziela utwory
Podgląd i pobieranie
Rozdzielające się wokale...

Oddzielając wokały od instrumentów...

Stosowanie Mel-Band RoFormer na Zrównoważone jakość
Twój wynik pojawi się w twoim historia pokolenia Kiedy będzie gotowa.
Oddzielenie głosowe zakończone

Głośniki

0:00

Instrumentalny

0:00
Jakość oddzielenia 8.2 dB SDR
Krwawienie głosowe < 2%
Czas trwania piosenki 3:42
Czas przetwarzania 12.4s

Silnik oddzielny

Wzór Mel-Band RoFormer
Wynik Głośniki + instrumentalne
SDR głosu 11.3 dB
Instrumentalna SDR 16.0 dB

Środek pomiaru na 50 odcinek testowych MUSDB18. SDR jest wskaźnikiem sygnału do wykrycia: wyższy jest czysty. Nasz poprzedni silnik zdobył 8,4 dB (wokali) i 13,1 dB (instrumentalne).

Dlaczego TTS.ai ws Konkurenci

Bezpłatny poziom dostępności

Spróbuj z bezpłatnym konto. Konkurenci jak LALAL.AI, Moises, i FonicMind opłatą 5-25/miesiąc za podstawowe usunięcie głosu.

Mierzyna jakość separacji

Wakacje są oddzielone modelem Mel-Band RoFormer. W 50 odcinkach testowych MUSDB18 zdobywano 11,3 dB wocal SDR i 16.0 dB instrumental SDR, około 3 dB powyżej poprzedniego silnika na obu.

Brak znaków wodnych ani kapsłów jakościowych

Pobierz pełną jakość wyjścia w WAV, MP3 lub FLAC. Brak znaków wodnych, bez skrócenia, bez ograniczeń bitowych na żadnym poziomie.

Dostęp API do przetwarzania serii

Przetwarzanie setek piosenek programematycznie za pośrednictwem naszego REST API. Idealnie dla firm muzycznych i DJ basenów.

Wskazówki na najlepsze wyniki

  • Użyj wejścia WAV lub FLAC do maksymalnej separacji jakości
  • Wybierz Oba, aby dostać akapelę i instrumental z jednego przesłania
  • Mistrzowie studiów oddzielają się bardziej czystie niż nagrania na żywo lub w bagażniku
  • Piosenki o wyraźnej separacji stereo dają najlepsze wyniki
  • Ciężko sprężone MP3 (128kbps lub niższe) mogą mieć zmniejszoną jakość separacji
  • Do rozdzielenia wielostemowego (pęcherzyki, bas itp.), użyj naszego Rozdzielacz stemów

Jak działa

Głębokie sieci neuronowe analizują widmo dźwiękowe Twojej piosenki, identyfikują częstotliwości wokalne i czystie oddzielają je od instrumentalnego poparcia w trzech krokach.

Krok 1

Wyślij swoją piosenkę

Przeciągnij i upuść dowolną piosenkę w formacie MP3, WAV, FLAC, OGG lub M4A. Obsługujemy pliki do 50MB i utwory do 10 minut. Twój plik jest zaszyfrowany podczas wysyłania i przetwarzania na odizolowanych instancjach GPU. Pliki są automatycznie usuwane w ciągu 1 godziny od przetwarzania.

Krok 2

AI rozdziela utwory

Model Mel-Band RoFormer przekształca dźwięk w spektrogram podzielony na pasmy częstotliwości metrologiczne, a następnie wykorzystuje uwagę transformatora w czasie i częstotliwości do oszacowania toru wokalnego. Instrumentalny jest oryginalny mieszanek z tym usuniętym torem wokalnym, więc dwa utwory dodają się do piosenki.

Krok 3

Podgląd i pobieranie

Posłuchaj oddzielonych ścieżek wokalnych i instrumentalnych bok obok naszych wbudowanych odtwarzaczy audio, a następnie pobierz każdy ścieżkę w swoim preferowanym formacie.

Przypadki użytkowania wyjątkowego

AI wokalne usunięcie otwiera twórcze możliwości dla muzyków, DJ, twórców treści i entuzjastów muzyki w szerokiej gamie zastosowań.

Karaoke

Stwórzcie wersje karaoke dowolnej piosenki natychmiast. Usuńcie wokały ołowiowe, aby śpiewać razem z oryginalnym instrumentalnym wsparciem. Idealnie dla karaoke nocy, śpiewu, wokalnych grzechów, chórów i barów karaoke. Pracuje z jakiegokolwiek gatunku od pop do rocka do R&B.

Remiksowanie i mashups

Wydobyć odizolowane wokały lub instrumenty do tworzenia remiksów, maseusów i modyfikacji bootlegów. Połączyć wokały z jednej piosenki z biciem z drugiej. Warstwy akapely nad własnymi produkcjami. Istotne dla producentów tworząc oficjalne i nieoficjalne remiksy.

Produkcja muzyczna

Próbka wokałów i części instrumentalnych z istniejących nagrań do wykorzystania w nowych produkcjach. Ekstraktować haki wokalne, ad-libs, i harmonii. Izolować gitarowe ryfy, linie basowe lub syntetyczne dla kreatywnego pobierania próbek. Przyspiesz swój przepływ roboczy dramatycznie.

Nastawienia DJ i efektywność na żywo

Tworzenie czystych instrumentów instrumentalnych i akapel dla zestawów DJ na żywo. Budowanie ścieżek przejściowych, tworzenie stemów gotowych do mashupów, i przygotowanie wokalnych kropli na żywo. Podstawowe dla DJów, którzy chcą wyjątkowych mieszanek, które ustawiają ich zestawy od konkursu.

Edukacja muzyczna

Isolate wokalne części do śpiewania lekcji, szkolenia ucha i studia teorii muzyki. Praktyka harmonizując z izolowanymi ścieżkami podparcia. Analizować techniki wokalnej przez słuchanie odizolowanej ścieżki wokalnej. Tworzenie ścieżek treningowych dla studentów muzyki i trenerów wokalu.

Tworzenie wideo i treści

Wydobyć instrumenty do muzyki tła w filmach, podcastach i treści mediów społecznościowych. Użyj wokalnej wersji popularnych piosenek jako utworów tła bez lirycznej rozproszenia. Tworzyć niestandardowe dźwięki dla YouTube, TikTok i Instagram.

Piosenki na okładkach

Rejestruj własne wokały na oryginalnym instrumentalnym torze dowolnej piosenki. Tworzyj wysokiej jakości okładki z autentycznymi utworami podparcia. Idealnie dla śpiewaków tworzących swoje portfolio, nagrywających demo lub delegujących okładki na YouTube i media społecznościowe.

Przepisy i analiza

Izolować wokały na dokładną transkrypcję liryczną, zwłaszcza na piosenki z złożonym instrumentacją, które sprawiają, że trudno słyszeć słowa. Analizować wokalnej melodii, harmonii i reklamy w izolacji. Przydatne dla muzykologów i dziennikarzy muzyki studiujących wokalne występy.

Najlepszy darmowy remover Vocal Online

Zasilany przez Mel-Band RoFormer

Odsunięcie spektrogramu wodnego rozpoczyna się model Mel-Band RoFormer, transformator, który uczestniczy w czasie i w czasie metrowych pasmach częstotliwości spektrogramu. W 50 MUSDB18 testowych fragmentów mierzył 11,3 dB wocal SDR i 16.0 dB instrumental SDR (wskaźnik znaków na wykrycie, wyższy jest czysty), o 3 dB lepiej na obu tych, które używaliśmy wcześniej. Oczekuj krwawienia na gęstych lub mocno stlačonych mieszankach.

Jeden silnik na każdym poziomie

Darmowe i rozdzielenie konta działają w tym samym modelu, więc bezpłatny wynik nie jest podglądem niższej jakości. Tryb, który wybierasz zmienia sposób rachunku, a nie który model działa.

Brak merków, brak ograniczeń

W przeciwieństwie do wielu konkurencyjnych narzędzi usuwania wokalu, które dodają znaki wokalu, ograniczyć jakość wyjścia na bezpłatnych poziomach lub ograniczyć formaty pobierania, TTS.ai daje ci czyste, nieograniczone pliki wyjściowe. Pobierz w MP3, WAV lub FLAC o pełnej jakości. Twoje oddzielone utwory są gotowe do natychmiastowego użycia w dowolnym DAW lub odtwarzaczu medialnym bez konieczności poprzetwarzania.

REST API dla programistów

Iнтегрuj wokalowe usunięcie do własnych aplikacji z naszymi deweloper-przyjaznymi REST API. Utwór utworzony programemmaticznie, buduj funkcje usuwania wokalów w aplikacjach muzycznych, tworz zautomatyzowany przepływ roboczy DJ lub buduj narzędzia do edukacji muzycznej. Dostęp API włączony do każdego planu. Przykłady SDK dla Python, JavaScript i cURL w dokumentacji.

Plany usuwania głosów

Uruchom bezpłatnie, uaktualnij, gdy potrzebujesz więcej

Darmowe
  • Mel-Band RoFormer wokalowy model
  • 10 minut piosenek
  • Głośniki + Instrumentalne
  • Wyjście MP3 & WAV
  • Rachunek nie jest wymagany
Najpopularniejsze
Darmowe konto
  • Ten sam model co wolna szczebla
  • 4-stemowy podział w rozdzielaczu stemów
  • Szybkie / Zrównoważone / Najlepsze tryby
  • Wszystkie formaty wyjściowe
  • 15 000 wolnych znaków
Zarejestruj się za darmo
Prof.
  • Dłuższe pliki audio
  • Separacja serii
  • Dostęp API
  • Przetwarzanie priorytetowe
Uaktualnij

Często zadawane pytania

AI wocal recale używa modelu głębokiego uczenia się (Mel-Band RoFormer), który analizuje spektrogram Twojej piosenki w czasie i pasm częstotliwości mel. Szacuje to tor wokalny, a instrumentem instrumentalnym jest oryginalna mieszanka z tym wokalnym usuniętym torkiem, wytwarzając czysty wynik karaoke.

Wzorce głosowe mierzyły 11,3 dB wocal SDR i 16.0 dB instrumentalne SDR na 50 MUSDB18 testowych fragmentów, o 3 dB lepsze zarówno na silniku, który używaliśmy wcześniej. Wyjście instrumentalne jest zazwyczaj wystarczająco czyste do karaoke lub remiksowania. Niektóre krwawienie może wystąpić na ciężkich przetworzonych lub stlačonych torach.

Tak! Dostajesz zarówno odizolowane wokały, jak i tor instrumentalny. Jest to przydatne do tworzenia wersji akapelli, próbki wokalu dla remiksów, lub transkrypcji tekstów z złożonych mieszanek.

Wspomagamy pliki MP3, WAV, FLAC, OGG, M4A i WEBM do 50MB. Dla najlepszych wyników należy użyć najwyższej jakości dostępnych plików źródłowych (WAV lub FLAC preferowane w porównaniu ze sprężonym MP3).

Tak, tworzenie karaoke to jeden z najbardziej popularnych zastosowań. Wynik instrumentalny jest wystarczająco czysty do karaoke występów, śpiew-długich filmów i muzyki tła dla wydarzeń.

Wyślij piosenkę i narzędzie automatycznie produkuje zarówno izolowany tor wokalny (acapella) jak i instrumentalny. Wydobycie wokalu działa najlepiej na dobrze zmieszanych utworach z czystymi wokałami. Użyj plików źródłowych WAV lub FLAC dla najczystszych wyników.

Przetwarzanie partii jest dostępne za pośrednictwem naszego API, pozwalając Państwu składać wiele utworów do usuwania wokału w zautomatyzowanym przepływie roboczym. Interfejs internetowy przetwarza jedną piosenkę naraz z podglądem i pobieraniem.

Nasze narzędzie używa modelu Mel-Band RoFormer do separacji wokali. W 50 MUSDB18 testów mierzył 11,3 dB wokal SDR i 16.0 dB instrumental SDR. Takie separacje na bazie transformatora pozostawiają mniej artefaktów niż starsze metody spektralne.

Tak, ale wyniki różnią się w żywo audio. Nagrania Studio zapewniają najlepszą jakość separacji. Nagrania na żywo z hałasem publiczności, odgłosem i nakładając instrumenty mogą mieć więcej krwawień, chociaż model wciąż daje użyteczne wyniki.

Usunięcie wokalu wykorzystuje 2,000 znaków na tor przetwarzany. Darmowe konta otrzymują 15,000 znaków na rejestracji. Narzędzie jest dostępne na wszystkich płatnych planach z hojnymi przydziałami charakterystycznymi do regularnego użytkowania.

Audio można oddzielić od każdego planu płatnego można używać komercyjne, a modernizacja obejmuje także audio, które wcześniej oddzieliłeś na wolnym poziomie; bezpłatne wyjście jest przeznaczone wyłącznie do użytku osobistego, niekomercyjnego. Model wokalny Mel-Band RoFormer jest wydawany w ramach licencji MIT, więc model sam nie wprowadza ograniczeń w użytkowaniu handlowym. W każdym przypadku musi mieć prawa do oryginalnej piosenki: korzystanie z muzyki autorskiej bez pozwolenia może naruszać prawa autorskie niezależnie od tego, jak jest przetwarzany dźwięk.

Czas przetwarzania zależy od długości toru. Typowa 3-5 minut piosenka zajmuje 15-45 sekund. Długiej utwory lub bardziej wysokiej jakości tryby separacji mogą zająć do minuty. Wyniki odtwarzania natychmiast w przeglądarce.
5.0/5 (1)

Co moglibyśmy ulepszyć? Twoje zwroty zwrotne pomagają nam rozwiązać problemy.

Usuń wokały z dowolnej piosenki za darmo

Dołącz do tysięcy muzyków i twórców przy użyciu TTS.ai. Odsunięcie wokalu z modelem Mel-Band RoFormer na każdym poziomie. 15 000 wolnych znaków z rejestracją.