Àkọlé àwòrán

Àwọn Àwọn Àkọlé

Ṣàfarawé àwọn àwòrán tí a fi kọ́ nínú àwọn àkọlé nínú àwọn àkọlé nípa ìlòjútó AI. Ṣẹ̀dà àwọn àkọlé karaoke, acapellas, àti àwọn àkọlé ìdákọ́ nípa ìfẹ́fẹ́.

A kò ní àwọn ìrànwọ́ TTS nínú ìtàn rẹ̀. Yọ̀ọ̀kan rán wà láti fàyè gba àwọn rẹ̀! Fi Ojú Rẹ̀ pamọ́

Fi àwòrán pamọ́ sí ìṣàmúlò-ètò

Àwọn àyọkà 3,000 fún àwọn àyọkà kan

Gbé àwọn fáìlì rẹ̀ lọ́wọ́lọ́wọ́ síbẹ̀, tàbí Wá

Supports MP3, WAV, FLAC, OGG, M4A. Max 500 MB (2 GB on paid plans). Songs up to 10 minutes.

fáìlì.mp3

0 MB
— tàbí àwòrán láti inú míkrófún rẹ̀ —
00:00

Àwọn Àtòjọ-ẹ̀yàn Ìjáde

Àwọn ìṣàmúlò-ètò meji náà náà ló ìṣàmúlò-ètò RoFormer Mel-Band kan.
Òfẹ́ láti gbiyanju pẹlú kàǹtì ọ̀fẹ́

Bií O ṣe N ṣiṣẹ́

Fi Àwọn Àkọlé Rẹ̀ Hàn
AI tí n ṣí àwọn àkọlé
Àwọn Àwọn Àkọsílẹ̀
Tí a bá ṣì àwọn àyọkà ìṣàfarawé...

Tí a ǹpa àwọn àwòrán láti inú àwọn àwòrán...

Ìlò Mel-Band RoFormer nínú Àwọn àwọn ààyè-iṣẹ́ Ìgúnrégé
Ń gba àwọn ìṣàmúlò-ètò láti ṣẹ́? Àwọn àwọn generation history Tí a bá tì ṣẹ̀dà.
Àwọn àwọn

Àwọn àyọkà ìsàlẹ̀-ilà

0:00

Àwọn Ìṣàmúlò-ètò

0:00
Àwọn ìṣàfarawé ìṣàfarawé 8.2 dB SDR
Àwọn àyọkà ìṣàfarawé < 2%
Ìgbà ìtàn àwọn àkọlé 3:42
Àwọn Ìṣàmúlò-ètò 12.4s

Àwọn Ìjánu-ìṣàfarawé

Àwọn ìṣàmúlò-ètò Mel-Band RoFormer
Àwọn Àtòjọ-ẹ̀yàn Àwọn àkọlé àwòrán
Àwọn àkọlé 11.3 dB
Àwọn Ìṣàmúlò-ètò SDR 16.0 dB

Measured on 50 MUSDB18 test excerpts. SDR is the signal-to-distortion ratio: higher is cleaner. Our previous engine scored 8.4 dB (vocals) and 13.1 dB (instrumental).

Kini idi ti TTS.ai vs Competitiors

Àwọn àgbèwọlé tí a ní

Wo o pẹlu iroyin ọfẹ. Awọn oludije bii LALAL.AI, Moises, ati PhonicMind gba owo $5-25/oṣu fun iyọkuro ọrọ-ọrọ ipilẹ.

Àwọn ìṣàfarawé àwọn ìṣàfarawé àwọn àwọn ààyè-iṣẹ́

Àwọn àwòrán tí a tí kọ́ nípa módèlè̀ RoFormer Mel-Band. Nínú àwọn ààyè ìṣàyẹwo 50 MUSDB18, o tí fi 11.3 dB SDR àwọn àwòrán 16.0 dB SDR, nípa 3 dB lọ́wọ́lú inú àwọn ààyè wà tí a tì kọ́ nípa gbogbo àwọn.

Kò ní àwọn àmì-ìwé àti àwọn à

Ṣàfikún àwọn ààtò ìṣàfihàn ìdáràn-ìdáràn nínú WAV, MP3, tàbí FLAC. Kò ní àwọn àmì-ìwé, kò ní ìṣàfihàn, kò ní àwọn ìdáràn bítàtì nínú àwọn ìpele.

Ìyàn API fún ìṣàfarawé àwọn àwọn ìṣàmúlò-ètò

Fi àwọn àkọ́lé àwọn ọ̀dọ̀tànìlọ́wọ́ kọ́ọ̀kan lọ́wọ́lọ́wọ́ nípa API REST wa. Ó jẹ́ àwọn iléiṣẹ́ ìṣàfarawé orin àti àwọn ẹ̀yàn DJ.

Àwọn Ìṣàmúlò-ètò fún Àwọn Àtòjọ-ẹ̀yàn

  • Lo àgbéwọlé WAV tàbí FLAC fún ìpàpọ̀ ìṣàfarawé ìṣàfarawé ìkúndùn
  • Yan gbogbo àwọn láti gba acapella àti àwọn ìṣàmúlò-ètò láti inú ìṣàfihàn kan
  • Àwọn olòtúnú studiò tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n tí wọ́n
  • Àwọn àwọn àkọ́lé àti àwọn àwọn àyọkà àwọn
  • Àwọn MP3s tí a típá jú lọ (128kbps tàbí àwọn tí o gà jú lọ) lè ní ìdájú ìfaradájú
  • Fun ìpàdá àwọn àgbègbè-àgbègbè (àgbègbè, àgbègbè, abbl.), lò wà Àtòjọ-ẹ̀yàn Àwọn Àmì-ìwé

Bií O ṣe N ṣiṣẹ́

Àwọn nẹ́dàlì àwọn ẹ̀yàn ẹ̀yàn tí o pọ̀ jú lọ́wọ́lọ́wọ́ ṣàyẹwo àwọn àwòrán-ìrọ̀ tí o jẹ́ tí o bá jẹ́ pé o jẹ́ àwọn àwọn ìṣàfarawe-ìrọ̀ nínú àwọn ìsẹ̀tàtì mẹ́tà.

Àkóónú 1

Fi Àwọn Àkọlé Rẹ̀ Hàn

Ṣẹ̀dà àtì fi àwọn àwọn àwòrán àtí àwọn àwòrán àwọn àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán àwọn àwòrán

Àkóónú 2

AI tí n ṣí àwọn àkọlé

A Mel-Band RoFormer model converts your audio into a spectrogram split into mel-scaled frequency bands, then uses transformer attention across time and frequency to estimate the vocal track. The instrumental is the original mix with that vocal track removed, so the two tracks add back up to your song.

Àkóónú ààyè-iṣẹ́

Àwọn Àwọn Àkọsílẹ̀

Listen to the separated vocal and instrumental tracks side by side with our built-in audio players, then download each track in your preferred format.

Àwọn Ààyè Ìlò

Iṣẹ́ tí a ǹṣè nípa ìpàlẹ̀̀ pẹ̀lú́ AI ǹfí ìgbàyélú pẹ̀lú́ awọń ẹ̀yàn tí a lè ṣe fuń awọń oṣere, DJs, awọń onímọ̀, àti àwọń tí ǹfẹ́ pẹ̀lú́ orin nínú gbogbo irú awọń ohuń eló.

Karaoke

Ṣẹ̀dà àwọn ìṣàfarawe-karaoke tí àwọn àwọn ìranṣẹ́ wò ní pàtó. Ṣẹ̀dá àwọn àwọn ìgbàdúrò ìṣàmúlò-ètò láti kọ̀ọ̀kan nípa àwọn ìṣàmúlò-ètò ìṣàfihàn. Tí a tí ṣé fún àwọn ààyè-iṣẹ́ karaoke, ìṣàfihàn ìṣàmúlò-ètò, àwọn ìṣàfihàn ìṣàmúlò-ètò, àwọn ìṣàfihàn àwọn karaoke. Àwọn iṣẹ́ láti inú gbogbo àwọn ìṣàfihàn láti inú pop̀ sí rock̀ sí R&B.

Àwọn àgbékalẹ̀ & Àwọn àgbékalẹ̀

Ṣẹ̀dà àwọn àwòrán àti àwọn àwòrán-ìṣàmúlò-ètò tí a tí kọ́ nípa ìṣàmúlò-ètò, àwọn

Àwọn Ìṣàmúlò-ètò Àwọn Àkọsílẹ̀

Ṣàfihàn àwọn

Àwọn àwọn ààyè-iṣẹ́ DJ

Ṣẹ̀dá àwọn àwọn ìṣàmúlò-ètò àti àwọn àkàpélà tí a tíwàn fún àwọn àwọn ààyè-iṣẹ́ DJ. Ṣẹ̀dá àwọn ààyè-iṣẹ́ ìṣàmúlò-ètò, kọ́ àwọn àwọn ààyè-iṣẹ́ tí a tí wa ní ìṣàmúlò-ètò, àtí fi àwọn ààyè-iṣẹ́ gbọ́ fun àwọn àwọn ìṣàmúlò-ètò. Àwọn àwọn DJ tí fẹ́ àwọn àwọn ìṣàmúlò-ètò àìdájú àwọn àwọn ààyè-iṣẹ́ wọn nínú àwọn

Àwọn Àkọsílẹ̀

Ṣàfikún àwọn ààyè-iṣẹ́ ìgbàye-gbàye fun àwọn ìwé-ìwé-ìrọ̀, ìṣàfihàn ìgbọ́, àtí ìmọ̀ tí a kọ̀ nípa àwọn àkọsílẹ̀ ìmọ̀. Ṣàfikún ìṣàmúlò-ètò ìṣàmúlò-ètò láti fi àwọn àkọsílẹ̀ ìṣàfihàn pamọ́. Ṣàfikún àwọn àkọsílẹ̀ ìṣàfihàn fún àwọn ọmọ-iwe ìmọ̀ ìṣàmúlò-ètò ìṣàfihàn àtí àwọn ìṣàfihàn ìṣàfihàn.

Àwọn Àkọlé

Ṣàfihàn àwọn àkọlé àwọn àkọlé àwọn àkọlé àwọn àkọlé àwọn àkọlé àwòrán, àwọn àkọlé àwòrán, àwọn àkọlé àwòrán, àwọn àkọlé àwòrán, àwọn àkọlé àwòrán, àwọn àkọlé àwòrán, à

Àwọn Àkọsílẹ̀ Àkọsílẹ̀

Fi àwọn àwòrán rẹ pamọ́ sínú àwọn àwòrán àwọn ìṣàmúlò-ètò ìṣàmúlò-ètò ìṣàmúlò-ètò ìṣàmúlò-ètò ìṣàmúlò-ètò orílẹ̀̀-ètò tí a bá fi pamọ́. Ó jẹ́ àwọn àwọn ìṣàmúlò-ètò tí a fi pamọ́ nínú àwọn àwòrán.

Àwọn Àkọlé

Ṣẹ̀dà àwọn àwòrán fún ìṣàfilọ́lẹ̀ àwọn àyọkà ìṣàfilọ́lẹ̀, fún àwọn

Àwọn

Àwọn ààyè-iṣẹ́

Vocal removal runs a Mel-Band RoFormer model, a transformer that attends across time and across mel-scaled frequency bands of the spectrogram. On 50 MUSDB18 test excerpts it measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR (signal-to-distortion ratio, higher is cleaner), about 3 dB better on both than the engine we used before. Expect some bleed on dense or heavily compressed mixes.

Àwọn Ìjánu-ìṣàmúlò-ètò

Free and account separations run the same model, so a free result is not a lower-quality preview. The mode you pick changes how the job is billed, not which model runs.

Kò ní àwọn àmì-ìwé, Kó ní àwọn ìdájó

Unlike many competing vocal removal tools that add watermarks, limit output quality on free tiers, or restrict download formats, TTS.ai gives you clean, unrestricted output files. Download in MP3, WAV, or FLAC at full quality. Your separated tracks are ready to use immediately in any DAW or media player without any post-processing required.

REST API fún àwọn ìṣàfilọ́lẹ̀

Fi àwọn àwọn ìṣàmúlò-ètò rẹ̀ pamọ́ sínú àwọn ìṣàmúlò-ètò rẹ̀ nípa àwọn API REST tí a fi hàn. Ṣàṣe àwọn à

Àwọn Àtòjọ-ẹ̀yàn Ìjáde

Ṣílẹ̀ ọ̀fẹ́, ṣíṣàfihàn tí o bà fẹ́ diẹ́ sii

Àìfẹ́
  • Former vocal model
  • Àwọn àwọn àwòrán 10-minúntù
  • Àwọn Àkọlé + Àwọn Ìṣàmúlò-ètò
  • Àwọn ààtòjọ-ẹ̀yàn
  • Kò ní àwọn
Àwọn Àkọ́gbégbé
Àwọn
  • Àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò
  • Àwọn ìpàdá 4-ìtítì nínú Àwọn Ìpàdá Ìtítì
  • Àwọn ìṣàmúlò-ètò àìpẹ̀ / Àìdáràn / Tí o dara jù
  • Gbogbo àwọn ìrísí-lẹ́tà ìtòjọ-ẹ̀yàn
  • Àwọn àmì-àṣírí 15,000 tí a fi pamọ́
Ṣẹ̀dà
Àwọn
  • Àwọn fáìlì àwòrán tí o jú
  • Àwọn àwọn
  • Àwọn Ìṣàmúlò-ètò
  • Àwọn ìṣàmúlò-ètò ìṣàfarawé
_Ṣàfikún

Àwọn Àtòjọ-ẹ̀yàn

AI tí n ló ìgbàdá àwọn àwòrán àwọn àwòrán AI ló ìṣàmúlò-ètò ìmọ̀ràn tí o pọ̀ (Mel-Band RoFormer) tí ǹ ṣàfihàn àwọn àwòrán àwọn

The vocal model measured 11.3 dB vocal SDR and 16.0 dB instrumental SDR on 50 MUSDB18 test excerpts, about 3 dB better on both than the engine we used before. The instrumental output is typically clean enough for karaoke or remixing. Some bleed-through may occur on heavily processed or compressed tracks.

Ya! O lè gba àwọn àwòrán àti àwọn àkọsílẹ̀. O lò fún ìṣàfilọ́lẹ̀ àwọn ìṣàmúlò-ètò acapella, àwọn àwòrán ìṣàmúlò-ètò fún àwọn ìṣàmúlò-ètò mìíràn, tàbí ìṣàfilọ́lẹ̀ àwọn àyọkà láti inú àwọn àwọn ìṣàmúlò-ètò tí wọ́n jẹ́.

A ǹfá àwọn fáìlì MP3, WAV, FLAC, OGG, M4A, àti WEBM lọ́wọ́lọ́wọ́ sí 50MB. Fún àwọn àwọn ìrísí-lẹ́tà tí o dara ju, ló fáìlì ìṣàfilọ́lẹ̀ ìgúnrégé tí o ga jù lọ́wọ́lọ́wọ́ (WAV tàbí FLAC nípa MP3 tí a tí fi pamọ́).

Yà, ìṣàfihàn àwọn àkọ́lé karaoke nínú àwọn ìlòjútó tí a lò. Àtòjọ-ẹ̀yàn àwọn ìṣàfihàn àwọn ìṣàmúlò-ètò ní ìṣàfihàn láti fi àwọn àkọ́lé karaoke, àwọn àwòrán-ìṣàmúlò-ètò, àti àwọn ìṣàmúlò-ètò ìtàn pamọ́.

Fi àwòrán pamọ́ láti inú àwọn àwọn àwòrán.

Àwọn ìṣàmúlò-ètò ìṣàmúlò-ètò tí a fi lè lò nípa API wa, tí o fi ọ̀rọ̀ kọ́ọ̀kan pamọ́ fún ìjánu-ìrọ̀ nínú ìṣàmúlò-ètò ìṣàfarawé. Ààyè-iṣẹ́ wẹ́ẹ̀bù náà ń fi àwọn àkọlé kọ́ọ̀kan pamọ́ nínú àwọn ìṣàfihàn àti àwọn ìṣàmúlò-ètò.

Àwọn àwọn ààtò wà ló ìṣàmúlò-ètò RoFormer Mel-Band fún ìpàdá àwọn àwòrán. Ní àwọn ààtò ìṣàmúlò-ètò 50 MUSDB18 ó fi àwọn àwòrán 11.3 dB SDR àti 16.0 dB SDR àwọn àwòrán ẹsẹ̀. Àwọn àwọn àwòrán tí a dá ní pàtó nípa àwọn à

Yà, àwọn àwọn ìrísí-lẹ́tà ní pàtó àwọn ìrísí-lẹ́tà tí a fi pamọ́. Àwọn ìṣàmúlò-ètò studiò náà náà ní ìṣàfarawé àwọn ìṣàmúlò-ètò tí o dara ju. Àwọn ìṣàmúlò-ètò pẹ̀lú àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn ìṣàmúlò-ètò àwọn

Ìpàràn àwọn àmì-ìwé ló ń ló àwọn àmì-ìwé 2,000 fún àwọn àkọ́lé fún àwọn àkọ́lé tí a tí ṣé. Àwọn àwọn à

Audio you separate on any paid plan can be used commercially, and upgrading also covers audio you separated earlier on the free tier; free-tier output is for personal, non-commercial use only. The Mel-Band RoFormer vocal model is released under the MIT license, so the model itself places no restriction on commercial use. In every case you must have the rights to the original song: using copyrighted music without permission may violate copyright laws regardless of how the audio is processed.

Àkókò ìṣàmúlò-ètò ní pàtó nípa ìgbà ìṣàmúlò-ètò. Àwọn àkọ́kọ́ 3-5 àkókò àwọn àkókò tí a lò ní 15-45 àwọn ìsàlẹ̀-ètò láti sàlú. Àwọn àkókò tí o jú lọ́wọ́lọ́wọ́ àti àwọn ìṣàmúlò-ètò ìpàpọ̀ ìṣàmúlò-ètò tí o júlọ́wọ́lọ́wọ́ lè gbà àkókò kan. Àwọn àwọn à
5.0/5 (1)

Àwọn àwọn àgbéwọlé rẹ̀ lè jẹ́ ìrànwọ́ fún wa.

Pa àwọn àwòrán láti inú àwọn àwòrán wọn

Ṣàfikún àwọn ọ̀dọ̀tàlì àti àwọn amọ́jà tí o lo TTS.ai. Ìpàràn àwọn àwọn àkọ́lé nípá módèlè̀ RoFormer Mel-Band lórí gbogbo àwọn ààyè. Àwọn àmì-àṣírí 15,000 tí a fi pamọ́ láti fi pamọ́.