AI Vocal-fjerner

Atskill sanger fra instrumenter i alle sanger ved bruk av moderne AI. Lag karaoke- spor, acapellas og gratis bakspor.

Last opp sang til prosess

3. 000 tegn per sang

Dra og slipp fila her, eller bla

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

file.mp3

0 MB
— eller registrere fra mikrofonen —
00:00

Separasjonsinnstillinger

Begge modusene bruker samme mel- Band RoFormer-modell.
Gratis å prøve med en ledig konto

Hvordan det fungerer

Last opp sangen din
AI skiller sporene
Forhåndsvis nedlasting
Separerer stemme...

Separerer stemme fra instrumenter...

Bruker Mel-Band RoFormer ved Balansert kvalitet
Ta en stund? Resultatet ditt vil dukke opp i din genereringshistorie når klar.
Ferdig med vokal atskillelse

Vokaler

0:00

Instrumentelt

0:00
Separasjonskvalitet 8.2 dB SDR
Vokal Bleed < 2%
Song- varighet 3:42
Prosesstid 12.4s

Skillemotor

Modell Mel-Band RoFormer
Utdata Vokaler + instrument
Vokal SDR 11.3 dB
Instrumentell SDR 16.0 dB

Measured on 50 MUSDB18 test excerpts. SDR is the signal-to-distortion ratio: higher is cleaner. Our previous engine scored 8.4 dB (vocals) and 13.1 dB (instrumental).

Hvorfor TTS.ai vs Competitors

Ledig nivå tilgjengelig

Konkurrenter som TAL.AI, Moises og PhonicMind tar ut $5-25/måned for enkel vokal fjerning.

Målt atskillelseskvalitet

Vokalene er atskilt med en mel- Band RoFormer-modell. På 50 MUSDB18 testutdrag ble det scoret 11,3 dB stemme SDR og 16,0 dB instrument-SDR, ca 3 dB over vår tidligere motor på begge.

Ingen vannmerker eller kvalitetslokk

Last ned utdata av full kvalitet i WAV, MP3 eller FLAC. Ingen vannmerker, ingen renskjæring, ingen bitratebegrensninger på noe nivå.

API- tilgang til satsvis behandling

Bearbeid hundrevis av sanger programmatisk via vårt REST API. Perfekt til musikkproduksjonsfirmaer og DJ-bassenger.

Tips for beste resultat

  • Bruk WAV eller FLAC inndata for høyeste kvalitet atskillelse
  • Velg begge for å hente akabella og instrumentene fra en opplasting
  • Studio-mestere, mer rene enn opptak i live eller fot,
  • Sanger med klar stereoseparasjon gir de beste resultatene
  • Kraftig komprimerte MP3er (128 kbps eller lavere) kan ha redusert separasjonskvalitet
  • For deling med flere stomer (trommeler, bass osv.), bruk våre Stammesplitter

Hvordan det fungerer

Deep neural-nettverk analyserer sangens lydspekter, identifiserer stemmefrekvenser og skiller dem rent fra den instrumentelle støtten i tre trinn.

Trinn 1

Last opp sangen din

Dra og slipp alle melodier i MP3, WAV, FLAC, OGG eller M4A format. Vi støtter filer opp til 50 MB og sanger opp til 10 minutter. Din fil blir kryptert under opplasting og behandling på isolerte GPU- instanser. Filer blir automatisk slettet innen 1 time etter behandling.

Trinn 2

AI skiller sporene

En mel- Band RoFormer- modell gjør om lyden din til et spektrogram delt inn i mel- skalerte frekvensbånd, bruker så transformator- oppmerksomhet over tid og frekvens til å anslå vokalsporet. Instrumentet er den opprinnelige blanden med det vokalsporet fjernet, så de to sporene legger tilbake til sangen din.

Trinn 3

Forhåndsvis nedlasting

Lytt til det separerte vokalsporet og instrumentalsporet side om side med våre innebygde lydspillere, og last så ned hvert spor i det formatet du foretrekker.

Tilfeller med bruk av vokalfjerner

AI vokalfjerning åpner opp kreative muligheter for musikere, DJ-er, innholdsskapere og musikkentusiaster over et bredt spekter av programmer.

Karaoke

Lag karaoke- versjoner av en hvilken som helst sang med en gang. Fjern hovedstemmen for å synge sammen med den opprinnelige instrumenta backen. Perfekt for karaoke natt, sangøvelse, vokale oppvarminger, korprøver og karaoke- barer. Fungerer med alle genrer fra pop til rock til R& B.

Omblanding og mashups

Trekk ut isolerte stemmer eller instrumenter for å lage remixer, mashups og bootleg- redigeringer. Kombiner sånger fra én sang med beatet fra et annet. Lag acapellas over dine egne produksjoner. Det er viktig for produsenter å lage offisielle og uoffisielle ommikser.

Musikkproduksjon

Ta stikkprøver av stemmer og instrumentdeler fra eksisterende opptak til bruk i nye produksjoner. Trekk ut vokalkroker, ad- libs og harmonier. Isoler gitarriffer, basslinjer eller synth- lapper for kreativ sampling. Sett fart på arbeidsflyten i produksjonen dramatisk.

DJ- sett og live ytelse

Lag rene virkemidler og akapellaer for levende DJ- sett. Bygg overgangsspor, lag mashup- klare stilker, og forbered vokaldråper for live- ytelse. Det er viktig for DJ- er som vil ha unike blandinger som skiller seg fra konkurransen.

Musikkundervisning

Isoler vokaldeler for sangøvelser, øreopplæring og musikkteoristudier. Øv på å harmonisere med isolerte bakspor. Analyser vokalteknikker ved å lytte til det isolerte vokalsporet. Lag øvelsesspor for musikkstudenter og vokaltrænere.

Videooppretting og innholdsopprettelse

Trekk ut mekanismer for bakgrunnsmusikk i video, podkaster og innhold i sosiale medier. Bruk populære sanger som bakgrunnsspor uten sangforstyrrelser. Lag selvvalgte lydplater for YouTube, TikTok og Instagram- innhold.

Omslagssanger

Spill inn dine egne sanger over det opprinnelige instrumentelle sporet av alle sanger. Lag høykvalitets omslagsversjoner med autentiske bakgrunner. Perfekt for sangere som bygger sin portefølje, tar inn demoer eller legger ut omslag til YouTube og sosiale medier.

Transskription og analyse

Isoler vokaler for nøyaktig lyrisk transkription, spesielt for sanger med kompliserte instrumenter som gjør det vanskelig å høre ordene. Analyser vokale melodier, harmonier og ad-libs alene. Nyttig for musikkologer og musikkjournalister som studerer vokaloppførsel.

Den beste frie vokalfjerneren tilkoblet

Drivet av Mel- Band RoFormer

Vocal removal runs a Mel-Band RoFormer model, a transformer that attends across time and across mel-scaled frequency bands of the spectrogram. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR (signal-to-distortion ratio, higher is cleaner), about 3 dB better on both than the engine we used before. Expect some bleed on dense or heavily compressed mixes.

En motor på hvert nivå

Fritt oppsett og kontoskille kjører samme modell, så et fritt resultat er ikke en forhåndsvisning av lavere kvalitet. Modusen du velger endrer hvordan jobben faktureres, ikke hvilken modell som kjører.

Ingen vannmerker, ingen begrensninger

Til forskjell fra mange konkurrerende verktøy for vokalfjerning som legger til vannmerker, begrenser utgangskvaliteten på frie nivåer, eller begrenser nedlastingsformatene, så gir TTS.ai deg rene og ubegrensete utdatafiler. Last ned i MP3, WAV eller FLAC i full kvalitet. De atskilte sporene er klare til å bruke umiddelbart i alle DAW - eller mediespillere uten at det trengs noen etterbehandling.

REST API for utviklere

Integrer vokalfjerning til dine egne programmer med vår utviklervennlige REST API. Prosesser sanger programmatisk, bygg sangfjerningsfunksjoner til musikkapper, lag automatiske DJ forberedelser, eller bygg verktøy for musikkopplæringsplattformer. API- tilgang inkludert i hver plan. SDKs for Python, JavaScript og cURL- eksempler i dokumentasjonen.

Vokal fjerningsplaner

Start ledig, oppgrader når du trenger mer

Ledig
  • Mel-Band RoFormer vokalmodell
  • 10 minutters sanger
  • Vokaler + instrumenter
  • MP3 & WAV- utdata
  • Ingen konto påkrevd
Mest populære
Fri konto
  • Samme modell som det frie nivået
  • 4-delt deleenhet i stamsplitteren
  • Rask / balansert / best modus
  • Alle utdata- formater
  • 15.000 ledige tegn
Registrer deg gratis
Pro
  • Lengere lydfiler
  • Utskilling av partier
  • API- tilgang
  • Prioritetsbehandling
Oppgradering

Ofte stilte spørsmål

AI vokalfjerning bruker en dyplæringsmodell (Mel- Band RoFormer) som analyserer spektrogramet for sangen din over tid og mel- skalerte frekvensbånd. Det anslår vokalsporet, og det instrumentelle er den opprinnelige blandingen med det vokalsporet fjernet, og gir ren karaoke- stil.

The vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts, about 3 dB better on both than the engine we used before. The instrumental output is typically clean enough for karaoke or remixing. Some bleed-through may occur on heavily processed or compressed tracks.

Ja! Du får både den isolerte stemmen og det instrumentelle sporet. Dette er nyttig for å lage Acapella- versjoner, sample vokaler for remixer, eller transkribere tekster fra komplekse blandinger.

Vi støtter MP3, WAV, FLAC, OGG, M4A og WEBM filer opp til 50 MB. For å få best resultat, bruk den beste kildefila som er tilgjengelig (WAV eller FLAC foretrukket framfor komprimert MP3).

Ja, å lage karaokespor er en av de mest populære bruksområdene. Den instrumentære utgangen er ren nok til karaoke- framføringer, sang- lange videoer og bakgrunnsmusikk for hendelser.

Last opp melodien og verktøyet lager automatisk både det isolerte melodisporet (acapella) og det instrumentelle. Uttrekket av melodien virker best på godt blandet spor med klare melodier. Bruk WAV - eller FLAC- kildefiler for å få de reneste resultatene.

Mengdevis behandling er tilgjengelig gjennom vårt API, slik at du kan sende inn flere spor for vokal fjerning i en automatisk arbeidsgang. Nettgrensesnittet behandler en sang ad gangen med øyeblikkelig forhåndsvisning og nedlasting.

Our tool uses a Mel-Band RoFormer model for vocal separation. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR. Transformer-based separation like this leaves fewer artifacts than older spectral-based methods.

Ja, men resultatene varierer med live lyd. Studio- opptak gir den beste kvaliteten på separation. Live- opptak med publikumsstøy, reverb og overlappende instrumenter kan ha mer gjennombløding, selv om modellen fremdeles gir brukbare resultater.

Vokal fjerning bruker 2000 tegn pr. spor behandlet. Gratis kontoer får 15.000 tegn ved registrering. Verktøyet er tilgjengelig på alle betalte planer med generøse tegnkvoter for regelmessig bruk.

Lyd som du skiller på en betalt plan kan brukes kommersielt, og oppgradering dekker også lyd som du skilte fra tidligere på det frie nivået. Utdata fra « free-tier » er bare til personlig, ikke- kommersiell bruk. Mel- Band RoFormer- modellen blir sluppet ut under MIT- lisensen, så modellen selv setter ingen restriksjoner på kommersiell bruk. I alle tilfeller må du ha rettigheter til den opprinnelige sangen: å bruke opphavsrettsbeskyttet musikk uten tillatelse kan bryte opphavsrettsloven uansett hvordan lyden behandles.

Behandlingstid avhenger av sporets lengde. En typisk 3-5 minutters melodi tar 15- 45 sekunder å behandle. Lengere spor eller høyere kvalitet kan ta opp til et minutt. Resultater avspilles øyeblikkelig i nettleseren din.
5.0/5 (1)

Hva kan vi forbedre? din tilbakemelding hjelper oss med å løse problemer.

Fjern Vokaler fra alle sanger gratis

Bli med i tusenvis av musikere og utviklere med TTS.ai. Vocal- fjerning med en mel- Band RoFormer- modell på hvert nivå. 15.000 frie tegn med tilmelding.