AI Vocal RemoverName

Separi voĉojn de instrumentoj en iu ajn kanto uzante la plej modernan AI. Krei karaokeajn trakojn, acapellas, kaj akompanajn trakojn senpage.

Alŝuti kanton al procezo

3 kreditoj por kanto

Ŝovu vian dosieron ĉi tien, aŭ foliumi

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

dosiero.mp3

0 MB
— aŭ registri per via mikrofono —
00:00

Agordo de apartigo

Ambaŭ metodoj uzas la saman modelon de Mel-Band RoFormer.
Libera por provi kun libera konto

Kiel ĝi funkcias

Alŝuti vian kanton
AI apartigas la trakojn
Antaŭrigardo kaj elŝuto
Separigante vokalojn...

Separas voĉojn de instrumentoj...

Uzante Mel-Band RoFormer ĉe Ekvilibro kvalito
Ĉu vi bezonas iom da tempo? Via rezulto aperos en via generacia historio kiam preta.
Vokala apartigo finiĝis

Voĉoj

0:00

Instrumenta

0:00
Separa kvalito 8.2 dB SDR
Voĉa interspaco < 2%
Kanto- daŭro 3:42
Procezadotempo 12.4s

Separiga motoro

Modelo Mel-Band RoFormer
Eligo Voĉo + Instrumentoj
Voĉa SDR 11.3 dB
Instrumenta SDR 16.0 dB

Measured on 50 MUSDB18 test excerpts. SDR is the signal-to-distortion ratio: higher is cleaner. Our previous engine scored 8.4 dB (vocals) and 13.1 dB (instrumental).

Kial TTS.ai kontraŭ konkurantoj

Libera nivelo disponebla

Provu ĝin per senpaga konto. Konkurentantoj kiel LALAL.AI, Moises, kaj PhonicMind kostas $5-25/monate por baza voĉforigo.

Mezurata apartiga kvalito

Vocals are separated by a Mel-Band RoFormer model. On 50 MUSDB18 test excerpts it scored 11.3 dB vocal SDR and 16.0 dB instrumental SDR, about 3 dB above our previous engine on both.

Neniu akvosigno aŭ kvalito- limigo

Elŝuti plenkvalitan eligon kiel WAV, MP3, aŭ FLAC. Neniu akvomarko, nenia tranĉo, nenia limigo de bitkvanto je iu ajn nivelo.

API- aliro por bata prilaborado

Programe prilabori centojn da kantoj per nia REST API. Perfekta por muzikproduktaj firmaoj kaj DJ-oj.

Konsiloj por plej bonaj rezultoj

  • Uzi WAV aŭ FLAC enigo por maksimuma kvalito apartigo
  • Elektu Ambaŭ por akiri la acapella kaj instrumentan el unu alŝuto
  • Studiomajstroj apartigas pli klare ol viva aŭ bootleg-registradoj
  • Kantoj kun klara stereoapartigo produktas la plej bonajn rezultojn
  • Tre kunpremitaj MP3-dosieroj (128 kbps aŭ malpli) eble havas malplibonigitan apartigan kvaliton
  • Por plurvoĉa divido (frapinstrumentaro, kontrabaso, ktp.), uzu nian Voĉa disigilo

Kiel ĝi funkcias

Profundaj neŭralaj retoj analizas la aŭdan spektron de via kanto, identigas voĉajn frekvencojn, kaj klare apartigas ilin de la instrumenta akompanado en tri paŝoj.

Etapo 1

Alŝuti vian kanton

Ŝovu iun ajn kanton en MP3, WAV, FLAC, OGG, aŭ M4A formato. Ni subtenas dosierojn ĝis 50MB kaj kantojn ĝis 10 minutoj longaj. Via dosiero estas ĉifrita dum alŝuto kaj prilaborita sur izolitaj GPU instancoj. Dosieroj estas aŭtomate forigitaj ene de 1 horo de prilaborado.

Paŝo 2

AI apartigas la trakojn

Mel-Band RoFormer modelo konvertas vian sonon al spektrogramo dividita en mel-skalitajn frekvencbendojn, tiam uzas transforman atenton tra tempo kaj frekvenco por taksi la voĉan trakon. La instrumenta estas la origina miksaĵo kun tiu voĉtrako forigita, do la du trakoj estas aldonitaj reen al via kanto.

Paŝo 3

Antaŭrigardo kaj elŝuto

Aŭskultu la apartajn voĉajn kaj instrumentajn trakojn flanke de flanko per niaj enkonstruitaj aŭdvidaĵoj, poste elŝutu ĉiun trakon en via preferata formato.

Voĉforigilo

AI-voĉa forigo malfermas kreajn eblecojn por muzikistoj, DJ-oj, enhavokreintoj, kaj muzikaj entuziasmuloj tra larĝa gamo de aplikoj.

Karaokeo

Kreu karaokajn versiojn de iu ajn kanto tuj. Forigu la ĉefvoĉojn por kanti kune kun la originala instrumenta akompanado. Perfekta por karaokeaj noktoj, kantaj ekzercoj, voĉaj varmigoj, ĥoraj ekzercoj, kaj karaokeaj bareloj. Laboras kun iu ajn ĝenro de popo ĝis roko ĝis R&B.

Remiksado kaj miksaĵoj

Ekstraktu izolitajn voĉojn aŭ instrumentojn por krei miksaĵojn, miksaĵojn, kaj bootleg-redaktaĵojn. Kombini voĉojn de unu kanto kun la ritmo de alia. Aldoni acapellas super viajn proprajn produktaĵojn. Necesa por produktantoj kreantaj oficialajn kaj neoficialajn miksaĵojn.

Muzika produktado

Ekzemplovoĉoj kaj instrumentaj partoj el ekzistantaj sonregistraĵoj por uzo en novaj produktaĵoj. Ekstraktu voĉajn hokoj, ad-libs, kaj harmoniojn. Izolu gitarajn rifojn, basliniojn, aŭ sinteziloj por kreiva specimenado. Rapidigu vian produktan laborfluon draste.

DJ Sets & Live PerformanceName

Kreu klarajn instrumentojn kaj acapellas por vivaj DJ- aroj. Konstruu transirajn trakojn, kreu mashup- pretajn stemojn, kaj preparu voĉajn dropojn por vivaj prezentoj. Necesa por DJoj kiuj volas unikajn miksaĵojn kiuj apartigas siajn arojn de la konkurenco.

Muzika edukado

Izoli voĉajn partojn por kantlecionoj, aŭda trejnado, kaj studado de muzikteorio. Ekzerci harmoniigon per izolitaj akompanaj trakoj. Analizi voĉajn teknikojn aŭskultante la izolitan voĉan trakon. Krei ekzercajn trakojn por muzikstudentoj kaj voĉaj trejnistoj.

Kreado de video kaj enhavo

Ekstraktu instrumentojn por fona muziko en videoj, podkastoj, kaj sociaj amaskomunikiloj. Uzu senvoĉajn versiojn de popularaj kantoj kiel fonajn trakojn sen lirika distrado. Kreu proprajn sonojn por YouTube, TikTok, kaj Instagram enhavo.

Kovrilaj kantoj

Registru viajn proprajn voĉojn super la originala instrumenta trako de iu ajn kanto. Kreu altkvalitajn kovrilajn versiojn kun aŭtentaj akompanaj trakoj. Perfekta por kantistoj konstruantaj siajn portfoliojn, registrante demonstraĵojn, aŭ afiŝante kovrilojn al YouTube kaj sociaj amaskomunikiloj.

Transskribo kaj analizo

Izoli voĉojn por preciza lirika transskribo, speciale por kantoj kun kompleksa instrumentado kiu malfaciligas aŭdi la vortojn. Analizi voĉajn melodiojn, harmoniojn, kaj ad- libs izolite. Utila por muzikistoj kaj muzikĵurnalistoj studantaj voĉan ludadon.

La plej bona libera voĉforigilo enretanName

Malfermu la dosieron

Voĉforigo uzas Mel-Band RoFormer-modelon, transformilon kiu funkcias tra la tempo kaj tra la mel-skalitaj frekvencaj bendoj de la spektrogramo. Sur 50 MUSDB18-testoj ĝi mezuris 11.3 dB voĉan SDR kaj 16.0 dB instrumentan SDR (signalo-distorda rilato, pli alta estas pli pura), ĉirkaŭ 3 dB pli bonan en ambaŭ ol la motoro kiun ni uzis antaŭe. Atendu iom da sangado ĉe densaj aŭ forte kunpremitaj miksaĵoj.

Unu motoro sur ĉiu nivelo

Liberaj kaj kontoj apartigitaj uzas la saman modelon, do libera rezulto ne estas malpli bona antaŭrigardo. La reĝimo kiun vi elektas ŝanĝas kiel la tasko estas fakturata, ne kiu modelo ruliĝas.

Neniu akvosigno, neniu limigo

Malsame al multaj konkurantaj voĉforigaj iloj, kiuj aldonas akvosignojn, limigas kvaliton ĉe liberaj niveloj, aŭ limigas elŝutajn formatojn, TTS.ai donas al vi purajn, nelimigitajn elŝutajn dosierojn. Elŝutu en MP3, WAV, aŭ FLAC je plena kvalito. Viaj apartigitaj trakoj estas pretaj uzi tuj en iu ajn DAW aŭ amaskomunikila legilo sen iu ajn posttraktado bezonata.

REST API por programistoj

Integri voĉforigon en viajn proprajn aplikaĵojn per nia programisto-amika REST API. Procesi kantojn programe, konstrui voĉforigajn funkciojn en muzikaj aplikaĵoj, krei aŭtomatajn DJ-preparajn laborfluojn, aŭ konstrui ilojn por muzikedukadaj platformoj. API-aliro inkludita en ĉiu plano. SDK-oj por Pitono, Ĝavoskripto, kaj cURL-ekzemploj en la dokumentaro.

Voĉforigaj planoj

Komencu senpage, ĝisdatigu kiam vi bezonas pli

Libera
  • Mel-Band RoFormer vocal model
  • 10-minutaj kantoj
  • Voĉo + Instrumenta
  • MP3 & WAV eligo
  • Neniu konto necesas
Plej populara
Libera konto
  • Same model as the free tier
  • 4-trakaj disigiloj en la disigilo de trakoj
  • Rapida / Ekvilibra / Plej bonaj reĝimoj
  • Ĉiuj eligoformatoj
  • 15, 000 liberaj signoj
Aliĝi senpage
Pro
  • Pli longaj sondosieroj
  • Bataj apartigoj
  • API- aliro
  • Prioritata prilaborado
Ĝisdatigi

Oftaj demandoj

AI-voĉa forigo uzas profundan lernadon modelon (Mel-Band RoFormer) kiu analizas la spektrogramon de via kanto tra tempo kaj mel-skalitaj frekvencaj bendoj. Ĝi taksas la voĉan trakon, kaj la instrumenta estas la origina miksaĵo kun tiu voĉo trako forigita, produktante puran karaoke-stilan eliron.

The vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts, about 3 dB better on both than the engine we used before. The instrumental output is typically clean enough for karaoke or remixing. Some bleed-through may occur on heavily processed or compressed tracks.

Jes! Vi ricevas kaj la izolitajn voĉojn kaj la instrumentan trakon. Tio estas utila por krei acapella- versiojn, sampli voĉojn por miksaĵoj, aŭ transskribi tekstojn el kompleksaj miksaĵoj.

Ni subtenas MP3-, WAV-, FLAC-, OGG-, M4A- kaj WEBM-dosierojn ĝis 50 MB. Por plej bonaj rezultoj, uzu la fontodosieron kun la plej alta kvalito disponebla (WAV aŭ FLAC prefere ol kunpremita MP3).

Jes, kreado de karaokeaj trakoj estas unu el la plej popularaj uzoj. La instrumenta eligo estas sufiĉe pura por karaokeaj prezentoj, kunkantaj videoj, kaj fonomuziko por eventoj.

Alŝutu la kanton kaj la ilo aŭtomate kreos kaj la izolitan voĉan trakon (acapella) kaj la instrumentan. La voĉa ekstraktado plej bone funkcias sur bone miksitaj trakoj kun klaraj voĉoj. Uzu WAV aŭ FLAC fontajn dosierojn por plej puraj rezultoj.

Batch processing is available through our API, letting you submit multiple tracks for vocal removal in an automatic workflow. The web interface processes one song at a time with instant preview and download.

Our tool uses a Mel-Band RoFormer model for vocal separation. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR. Transformer-based separation like this leaves fewer artifacts than older spectral-based methods.

Jes, sed la rezultoj varias kun viva sono. Studioregistradoj donas la plej bonan apartigan kvaliton. Vivaj registraĵoj kun aŭskultanta bruo, reverb, kaj kovrantaj instrumentoj povas havi pli da sangado, kvankam la modelo ankoraŭ produktas uzeblajn rezultojn.

Voĉforigo uzas 2000 signojn por ĉiu trako. Senpagaj kontoj ricevas 15000 signojn je la aliĝo. La ilo estas disponebla ĉe ĉiuj pagaj planoj kun granda nombro da signoj por regula uzo.

La sonoj, kiujn vi apartigas per iu ajn pagita plano, povas esti uzataj komerce, kaj ĝisdatigo ankaŭ kovras la sonojn, kiujn vi apartigis antaŭe per la libera nivelo; la libera-nivela eligo estas por persona, ne-komerca uzo nur. La voĉmodelo Mel-Band RoFormer estas liberigita sub la MIT-licenco, do la modelo mem ne limigas komercan uzon. Ĉiukaze vi devas havi la rajtojn al la originala kanto: uzado de kopirajta muziko sen permeso povas rompi kopirajtajn leĝojn sendepende de kiel la sono estas prilaborita.

La prilaboradotempo dependas de la trakolongo. Tipa kanto de 3- 5 minutoj bezonas 15- 45 sekundojn por esti prilaborita. Pli longaj trakoj aŭ pli altkvalitaj apartigaj reĝimoj povas preni ĝis unu minuton. La rezultoj estas ludataj tuj en via retumilo.
5.0/5 (1)

Kion ni povus plibonigi? Via reago helpas nin solvi problemojn.

Forigi voĉojn el iu ajn kanto senpage

Aliĝi al miloj da muzikistoj kaj kreintoj uzantaj TTS.ai. Voĉa forigo per Mel-Band RoFormer modelo je ĉiu nivelo. 15,000 liberaj signoj per aliĝo.