Free AI Testun i LeferyddComment

36+ modelau ffynhonnell agored, 314+ llais, 55+ ieithoedd. Nid oes angen cyfrif.

45K+
creuwyr
155K+
generations
36+
Modelau AI
314+
llais( au)
Hoffwch TTS.ai? Meddwl am eich ffrindiau!

Popeth sydd ei angen arnoch ar gyfer AI LleferyddName

30+ offer wedi'u pweru gan ffynonellau agored modelau AI

36+ Modelau Lleferydd AI

Y casgliad mwyaf eang o fathau TTS ffynhonnell agored ar un platfform

KokoroKokoro Rhydd

Model testun-i-leferydd 82 miliwn o baramedrau yw Kokoro sy'n gwneud yn well na'i ddosbarth pwysau. Er gwaethaf ei faint bach, mae'n cynhyrchu siarad naturiol a chryno. Cynhelir nifer o ieithoedd gan gynnwys Saesneg, Japaneg, Tsieineeg a Corea gydag amrywiaeth o lais cryf. Mae'n rhedeg yn gyflym iawn - yn creu sain bron 100 gwaith yn gyflymach na real-time ar GPU.

Gorau ar gyfer: TTS o ansawdd uchel gyda chynnydd lleiaf, rhaglenni llifogydd

Ceisiwch Am Ddim

PiperPiper Rhydd

Peiriant testun-i-leferydd ysgafn yw Piper a ddatblygwyd gan Rhasspy sy'n defnyddio strwythurau VITS a laryncs. Mae'n rhedeg yn llwyr ar CPU, gan ei wneud yn berffaith ar gyfer dyfeisiau ymylon, awtomeiddio cartref, a rhaglenni sy'n gofyn am TTS all-lein. Gyda dros 100 o lais dros 30+ o ieithoedd, mae Piper yn darparu lleferydd sy'n swnio'n naturiol ar gyflymderau gwirioneddol hyd yn oed ar Raspberry Pi 4.

Gorau ar gyfer: Rhagolygon cyflym, hygyrchedd, a rhaglenni mewnadeiladedig

Ceisiwch Am Ddim

VITSVITS Rhydd

VITS (Dealltwriaeth Amrywiol gyda dysgu gwrthwynebol ar gyfer Testun-i-Leferydd diwedd-i-ddiwedd) yw dull TTS diwedd-i-ddiwedd paralel sy'n creu sain sy'n swnio'n fwy naturiol na'r modelau cyfredol o ddau gam. Mae'n mabwysiadu dealltwriaeth amrywiol wedi'i wella gyda llifoedd normaleiddio a phrosesu hyfforddi gwrthwynebol, gan gyflawni gwelliannau sylweddol mewn naturioldeb.

Gorau ar gyfer: Testun-i-leferydd pwrpas-cyffredinol gyda phrosodi naturiolName

Ceisiwch Am Ddim

MeloTTSMeloTTS Rhydd

Llyfrgell TTS aml-iaith yw MeloTTS gan MyShell.ai sy'n cynnal Saesneg (Americanaidd, Prydeinig, Indiaidd, Awstralaidd), Sbaeneg, Ffrangeg, Tsieineaidd, Japaneaidd a Corea. Mae'n hynod o gyflym, yn prosesu testun ar gyflymder sy'n debyg i gyflymder amser real ar y CPU yn unig. Mae MeloTTS wedi ei ddylunio ar gyfer defnydd cynhyrchu ac yn cynnal dehongliad CPU a GPU.

Gorau ar gyfer: Rhaglenni cynhyrchu sydd angen TTS cyflym, aml-ieithog

Ceisiwch Am Ddim

Kani TTS 2Kani TTS 2 Rhydd

Kani-TTS-2 gan NineNineSix yw model paramedr 400M ultra-ysgafn wedi'i adeiladu ar gefndir LiquidAI LFM2 gyda Nvidia NanoCodec. Mae'n rhedeg mewn dim ond 3GB o VRAM ac yn cyrraedd 10 eiliad o siarad mewn ~2 eiliad (RTF 0.2). Cynhelir clôn llais zero-shot trwy mewnosodiadau siaradwr.

Gorau ar gyfer: Creu cyflym, amgylcheddau adnoddau isel, rhagolygon cyflym

Ceisiwch Am Ddim

OuteTTSOuteTTS Rhydd

Mae OuteTTS yn ehangu modelau iaith mawr gyda galluoedd testun-i-ganu tra'n cadw'r adeiladwaith gwreiddiol. Mae'n cynnal amryw o ochr gefn gan gynnwys llama.cpp (CPU/GPU), Hugging Face Transformers, ExLlamaV2, VLLM, a hyd yn oed dehongliad porwr drwy Transformers.js. Mae'n cynnwys clonio llais zero-shot drwy broffiliau siaradwyr wedi'u cadw fel JSON.

Gorau ar gyfer: Datblygu Edge, TTS seiliedig ar borwr, amgylcheddau adnoddau isel

Ceisiwch Am Ddim

Pocket TTSPocket TTS Rhydd

Model testun-i-leferydd cymhleth 100M o paramedrau yw Pocket TTS gan Kyutai (crewyr Moshi) sy'n torri'r ffiniau. Mae'n rhedeg yn effeithlon ar CPU, yn cynnal clonio llais zero-shot o sampl sain sengl, ac yn cynhyrchu llais sy'n swnio'n naturiol. Mae maint bach y model yn ei wneud yn berffaith ar gyfer datblygiadau ar y ffin a chyfleusterau sydd â llai o adnoddau.

Gorau ar gyfer: Gosod ysgafn, amgylcheddau CPU yn unig, clonio llais cyflym

Ceisiwch Am Ddim

Kitten TTSKitten TTS Rhydd

Model testun-i-leferydd ultra-ysgafn yw Kitten TTS gan KittenML, wedi'i adeiladu ar ONNX. Gyda gwahanol fathau o 15M i 80M o baramedrau (25-80 MB ar y ddisg), mae'n darparu cyfansoddiad llais o ansawdd uchel ar y CPU heb angen GPU. Mae ganddo 8 llais mewnol, cyflymder llais addasadwy, a rhag-brosesu testun mewnol ar gyfer rhifau, arian, ac unedau. Mae'n berffaith ar gyfer rhaglenni eithaf a chynnydd isel.

Gorau ar gyfer: TTS ysgafn a gyflym, datblygiadau ymylon, rhaglenni â chynnydd isel

Ceisiwch Am Ddim

Ming-Omni TTSMing-Omni TTS Rhydd

Mae Ming-omni-tts-0.5B gan inclusionAI yn fodel siarad aml-modal cymharol ysgafn wedi'i adeiladu ar y gwraidd dwys BailingMM gyda datgodiwr sain sy'n cydweddu llif Patch-by-Patch. Mae'n darparu allbwn 44.1kHz (yn agos at ansawdd CD), yn cynnal clonio llais zero-shot o gyfeiriad 3+ eiliad, ac yn cynnwys rheoli teimladau / naws / BGM mewnol trwy gyfarwyddiadau JSON. Sefydlogrwydd rhagorol — 0.83% WER ar fesurau cyferbyniad Tsieineaidd.

Gorau ar gyfer: Naratifau dwyieithog uchel-gywirdeb, chwarae llais wedi'i reoli gan emosiynau, cynnwys llyfr sain Tsieineaidd

Ceisiwch Am Ddim

MOSS-TTS NanoMOSS-TTS Nano Rhydd

MOSS-TTS-Nano-100M yw amrywiad paramedr 100M OpenMOSS o'r teulu MOSS-TTS, yn rhannu'r adeiladwaith trawsnewidydd-oedi. Mae'n masnachu ansawdd uchaf y model 8B am bwysau ~80x llai a VRAM yn isel yn sylweddol ar gyfer pob cais, gan ei wneud yn addas ar gyfer datblygiadau lefel rhad ac uchel-trwybwn. Yr un cyrraedd 20 iaith.

Gorau ar gyfer: TTS haen-rydd, cynhyrchu llwyth uchel, defnydd rhyngweithiol â chynnydd isel

Ceisiwch Am Ddim

FreyaTTSFreyaTTS Rhydd

FreyaTTS-small yw model testun-i-leferydd Twrceg 183M-paramedr a adeiladwyd fel trawsnewidydd diffuant llif-cydweddiad amodol di-awto-ddiddymu. Mae'n gweithio'n uniongyrchol o nodau heb fonemist, ac mae'n allbwn sain 48 kHz - mwy na dau waith cyfradd sampl ein llais Twrceg arall. Ar y safon Freya-TR-Eval mae'n sgorio 8.0% WER, yn rhagor na XTTS-v2 a F5-TTS.

Gorau ar gyfer: Disgrifiad Twrceg, asiant llais, a unrhyw sain Twrceg sydd angen allbwn samplu uchel

Ceisiwch Am Ddim

BarkBark & Gwaredu Iaith

Model testun-i-sain seiliedig ar drawsnewidydd sy'n creu siarad, cerddoriaeth ac effeithiau sain realistig.

Datblygwr: Suno · Trwydded: MIT

Ceisiwch hi

Bark SmallBark Small & Gwaredu Iaith

Fersiwn ysgafnach o Bark gyda dehongli cyflymach a defnydd cof is. Name

Datblygwr: Suno · Trwydded: MIT

Ceisiwch hi

CosyVoice 2CosyVoice 2 & Gwaredu Iaith

Alibaba's scalable streaming TTS with human-parity naturalness and nearly-zero latency.

Datblygwr: Alibaba (Tongyi Lab) · Trwydded: Apache 2.0

Ceisiwch hi

Dia TTSDia TTS & Gwaredu Iaith

Model creu ymgom aml-seinydd sy'n creu sgyrsiau naturiol rhwng siaradwyr.

Datblygwr: Nari Labs · Trwydded: Apache 2.0

Ceisiwch hi

Parler TTSParler TTS & Gwaredu Iaith

Disgrifiwch y llais rydych ei eisiau mewn iaith naturiol a bydd Parler yn creu llais sy'n cydweddu.

Datblygwr: Hugging Face · Trwydded: Apache 2.0

Ceisiwch hi

Indic Parler TTSIndic Parler TTS & Gwaredu Iaith

Lleferydd o ansawdd uchel ar gyfer 8+ iaith Indiaidd gyda rheoli llais iaith naturiol.

Datblygwr: AI4Bharat · Trwydded: Apache 2.0

Ceisiwch hi

KhanomTan TTSKhanomTan TTS & Gwaredu Iaith

Testun-i-Lafar Thai-yn-y-prif gyda dewis o lais siaradwr. Name

Datblygwr: Wannaphong Phatthiyaphaibun · Trwydded: Apache 2.0

Ceisiwch hi

IndexTTS-2IndexTTS-2 & Gwaredu Iaith

TTS zero-shot gyda rheoli emosiynau grawn-fin a mynegiant uchel.

Datblygwr: Index Team · Trwydded: Bilibili Model License

Ceisiwch hi

Spark TTSSpark TTS & Gwaredu Iaith

Clonio llais TTS gydag arddull emosiynau a siarad rheoliadwy drwy alwadau.

Datblygwr: SparkAudio · Trwydded: CC BY-NC-SA 4.0

Ceisiwch hi

GPT-SoVITSGPT-SoVITS & Gwaredu Iaith

Clonio llais TTS ychydig-sgyrsiau sy'n ail-greu unrhyw lais o 5 eiliad o sain yn unig.

Datblygwr: RVC-Boss · Trwydded: MIT

Ceisiwch hi

OrpheusOrpheus & Gwaredu Iaith

Model TTS emosiynol lefel dynol wedi ei hyfforddi ar 100K o oriau o ddata siarad.

Datblygwr: Canopy Labs · Trwydded: Llama 3.2 Community

Ceisiwch hi

Qwen3 TTSQwen3 TTS & Gwaredu Iaith

TTS aml-ieithog Alibaba gyda chlonio llais, lleisiau rhagosodedig, a dylunio llais o destun.

Datblygwr: Alibaba (Qwen) · Trwydded: Apache 2.0

Ceisiwch hi

VieNeu-TTS-v2VieNeu-TTS-v2 & Gwaredu Iaith

TTS Fietnameg + Saesneg yn newid cod gyda 7 llais rhagosodedig a chlonio llais zero-shot. CPU yn unig, dim angen GPU.

Datblygwr: Phạm Nguyễn Ngọc Bảo · Trwydded: Apache 2.0

Ceisiwch hi

Chatterbox TurboChatterbox Turbo & Gwaredu Iaith

Chatterbox cyflymach gydag oedi o dan 200ms a thagiau para- ieithyddol ar gyfer chwerthin, sychder, a mwy.

Datblygwr: Resemble AI · Trwydded: MIT

Ceisiwch hi

VoxCPMVoxCPM & Gwaredu Iaith

TTS di-tokenizer yn cynhyrchu sain 44.1kHz gyda chysondeb paragraff cyd-destun.

Datblygwr: OpenBMB · Trwydded: Apache 2.0

Ceisiwch hi

VibeVoiceVibeVoice & Gwaredu Iaith

Model Microsoft ar gyfer cynnwys aml-seinydd ar ffurf hir fel podlediadau a llyfr sain.

Datblygwr: Microsoft · Trwydded: MIT

Ceisiwch hi

CosyVoice3CosyVoice3 & Gwaredu Iaith

TTS aml-ieithog y genhedlaeth nesaf gyda dau-sianel, rheoli teimladau, a chlonio llais zero-shot.

Datblygwr: Alibaba (FunAudioLLM) · Trwydded: Apache 2.0

Ceisiwch hi

NAMAA Saudi TTSNAMAA Saudi TTS & Gwaredu Iaith

TTS Saesneg-Arabeg agored cyntaf. Saesneg Saesneg naturiol gyda chlonio llais o ansawdd Chatterbox.

Datblygwr: NAMAA Space · Trwydded: MIT

Ceisiwch hi

Darwin TTSDarwin TTS & Gwaredu Iaith

Math Qwen3-TTS traws-modal gyda phwysau FFN wedi'u cymysgu o'r model iaith Qwen3-1.7B er mwyn clonio aml-ieithog mwy cryf. Name

Datblygwr: FINAL-Bench · Trwydded: Apache 2.0

Ceisiwch hi

MOSS-TTSDMOSS-TTSD & Gwaredu Iaith

Model parhaus ymgom aml-seinydd — creu sgyrsiau arddull pod-dafod gyda hyd at 5 seinydd a 60 munud o sain gydlynol.

Datblygwr: OpenMOSS · Trwydded: Apache 2.0

Ceisiwch hi

ChatterboxChatterbox Premium

Clonio llais zero-shot o'r radd flaenaf gyda rheoli teimladau o Resemble AI.

Ansawdd:

Ceisiwch hi

Tortoise TTSTortoise TTS Premium

Testun-i-leferydd aml-lais wedi'i ganolbwyntio ar ansawdd gydag adeiladwaith awto-adferol.

Ansawdd:

Ceisiwch hi

StyleTTS 2StyleTTS 2 Premium

Testun-i-ganu ar lefel dynol drwy ddargludiad arddull a hyfforddiant gwrthwynebiad.

Ansawdd:

Ceisiwch hi

OpenVoiceOpenVoice Premium

Clonio llais yn syth gyda rheoli graenus dros arddull, teimlad, a chaneuon.

Ansawdd:

Ceisiwch hi

Sesame CSMSesame CSM Premium

Model lleferydd cyfathrebu sy'n creu cyfathrebu naturiol gydag amseru ac emosiynau addas.

Ansawdd:

Ceisiwch hi

CosyVoice 2CosyVoice 2

Alibaba's scalable streaming TTS with human-parity naturalness and nearly-zero latency.

Ieithoedd: en, zh, ja, ko, fr, de, it, es

Cloi Llythyren

IndexTTS-2IndexTTS-2

TTS zero-shot gyda rheoli emosiynau grawn-fin a mynegiant uchel.

Ieithoedd: en, zh

Cloi Llythyren

Spark TTSSpark TTS

Clonio llais TTS gydag arddull emosiynau a siarad rheoliadwy drwy alwadau.

Ieithoedd: en, zh

Cloi Llythyren

GPT-SoVITSGPT-SoVITS

Clonio llais TTS ychydig-sgyrsiau sy'n ail-greu unrhyw lais o 5 eiliad o sain yn unig.

Ieithoedd: en, zh, ja, ko

Cloi Llythyren

ChatterboxChatterbox

Clonio llais zero-shot o'r radd flaenaf gyda rheoli teimladau o Resemble AI.

Ieithoedd: en

Cloi Llythyren

Tortoise TTSTortoise TTS

Testun-i-leferydd aml-lais wedi'i ganolbwyntio ar ansawdd gydag adeiladwaith awto-adferol.

Ieithoedd: en

Cloi Llythyren

OpenVoiceOpenVoice

Clonio llais yn syth gyda rheoli graenus dros arddull, teimlad, a chaneuon.

Ieithoedd: en, zh, ja, ko, fr, es

Cloi Llythyren

VieNeu-TTS-v2VieNeu-TTS-v2

TTS Fietnameg + Saesneg yn newid cod gyda 7 llais rhagosodedig a chlonio llais zero-shot. CPU yn unig, dim angen GPU.

Ieithoedd: vi, en

Cloi Llythyren

Chatterbox TurboChatterbox Turbo

Chatterbox cyflymach gydag oedi o dan 200ms a thagiau para- ieithyddol ar gyfer chwerthin, sychder, a mwy.

Ieithoedd: en

Cloi Llythyren

VoxCPMVoxCPM

TTS di-tokenizer yn cynhyrchu sain 44.1kHz gyda chysondeb paragraff cyd-destun.

Ieithoedd: en, zh

Cloi Llythyren

Pocket TTSPocket TTS

Model paramedr ysgafn 100M gan Kyutai gyda chlonio llais o sampl sengl. Name

Ieithoedd: en, fr

Cloi Llythyren

CosyVoice3CosyVoice3

TTS aml-ieithog y genhedlaeth nesaf gyda dau-sianel, rheoli teimladau, a chlonio llais zero-shot.

Ieithoedd: en, zh, ja, ko, de, es, fr, it, ru

Cloi Llythyren

NAMAA Saudi TTSNAMAA Saudi TTS

TTS Saesneg-Arabeg agored cyntaf. Saesneg Saesneg naturiol gyda chlonio llais o ansawdd Chatterbox.

Ieithoedd: ar

Cloi Llythyren

Darwin TTSDarwin TTS

Math Qwen3-TTS traws-modal gyda phwysau FFN wedi'u cymysgu o'r model iaith Qwen3-1.7B er mwyn clonio aml-ieithog mwy cryf. Name

Ieithoedd: en, ko, ja, zh

Cloi Llythyren

MOSS-TTSDMOSS-TTSD

Model parhaus ymgom aml-seinydd — creu sgyrsiau arddull pod-dafod gyda hyd at 5 seinydd a 60 munud o sain gydlynol.

Ieithoedd: en, zh

Cloi Llythyren

Ming-Omni TTSMing-Omni TTS

Model siarad aml-modal 0.5B compact o inclusionAI gydag allbwn 44.1kHz uchel-ddilysrwydd a chlonio llais zero-shot.

Ieithoedd: en, zh

Cloi Llythyren

MOSS-TTS NanoMOSS-TTS Nano

Math bach 100M MOSS-TTS - yr un strwythur, 80x yn llai, diffyg amser rhydd-haen.

Ieithoedd: en, zh, de, es, fr, ja, it, ko, ru, ar, pt

Cloi Llythyren

API Datblygwr-Arwain

API REST sy'n gydnaws â OpenAI. Un diwedd-bwynt, 22+ model. Cynhaliaeth llif ar gyfer cymwysiadau amser real.

  • Fformat cydnaws â OpenAI
  • Llif TTS ar gyfer rhaglenni amser real
  • Prosesu batch ar gyfer swyddi mawr
  • Hysbysiadau Webhook
Gweld Dogfennaeth API
pip install ttsai npm install @ttsainpm/ttsai
Python
from tts_ai import TTSClient

client = TTSClient(api_key="sk-tts-xxx")
audio = client.generate(
    text="Hello from TTS.ai!",
    model="kokoro",
    voice="af_bella",
)
client.save(audio, "output.mp3")

Prisio Syml, Tryloyw

Dechreuwch yn rhydd. Graddio wrth i chi dyfu.

Rhydd

$0

15,000 o nodau + 1,500/diwrnod

  • 7 model am ddim gan gynnwys Kokoro
  • 5,000 o nodau y genhedlaeth
  • API cyrchiad wedi'i gynnwys
Cofrestru

Cychwynydd

$9/% 1 mis

500 credyd/mis

  • Pob 22+ model
  • 100,000 o nodau y genhedlaeth
  • Clonio Llywio
Cychwyn
Poblogaf

Pro

$29/% 1 mis

2,000 credyd/mis

  • Popeth yn y Cychwynydd
  • Cyrchiad API
  • Prosesu blaenoriaeth
Cael Proffesiynol

Busnes

$99/% 1 mis

10,000 credyd/mis

  • Popeth mewn Pro
  • API Bulk
  • Ciw blaenoriaeth
Nôl Busnes

Gweld pob cynllun gan gynnwys pecynnau credyd →

Cwestiynau a Ofynnir yn Aml

TTS.ai yw'r platfform llais AI mwyaf cwmpasu, yn cynnig 22+ modelau testun-i-ganu, clonio llais, llais-i-testun, ac offer sain. Mae pob model yn ffynhonnell agored heb gloi mewn gwerthwr.

Ie! Mae TTS.ai yn cynnig testun-i-leferydd am ddim gyda modelau Kokoro, Piper, VITS, a MeloTTS. Nid oes angen cyfrif. Cofrestru i gael 15,000 o nodau am ddim a mynediad i bob model. Mae cynlluniau talu yn dechrau ar $5/mis.

Ar gyfer cyflymder, defnyddiwch Kokoro neu Piper. Ar gyfer ansawdd, ceisiwch CosyVoice 2 neu StyleTTS 2. Ar gyfer clonio llais, defnyddiwch Chatterbox neu GPT-SoVITS. Ar gyfer cyfathrebu, defnyddiwch Dia TTS. Ceisiwch sawl model ar yr un testun i'w gymharu.

Ydy. API REST OpenAI-cydnaws ar gyfer TTS, STT, clonio llais, ac offer sain. Yn cynnwys ar bob cynllun gan gynnwys y rhad, gyda therfynau cyflymder sy'n graddio yn ôl lefel (Am Ddim: 10 req/min, Llymach: 20, Cychwynnol: 30, Proffesiynol: 60, Busnes: 300). Gweler dogfennaeth ar tts.ai/api/.

Mae ansawdd y llais yn amrywio yn ôl y model. Mae modelau premiwm fel CosyVoice 2, StyleTTS 2, a Chatterbox yn cynhyrchu llais o ansawdd sy'n debyg i'r un dynol, gydag arddull naturiol ac emosiynau. Mae modelau am ddim fel Kokoro yn cynnig ansawdd rhagorol ar gyfer y rhan fwyaf o achosion defnydd.

Mae TTS.ai yn cynnal mwy na 30 o ieithoedd drwy ei llyfrgell modelau. Mae gan Saesneg y gynhaliaeth modelau ehangaf, ond mae modelau fel CosyVoice 2 yn cwmpasu Tsieinëeg, Japaneg a Corea; mae GPT-SoVITS yn trin Tsieinëeg, Japaneg, Corea a Saesneg; ac mae MeloTTS yn cynnal Saesneg, Sbaeneg, Ffrangeg, Tsieinëeg, Japaneg a Corea.

Ydy. Mae pob prosesu'n digwydd ar ein gweinyddion GPU arbenigol. Nid ydym yn cadw eich mewnbwn testun na'r sain a gynhyrchir ar ôl ei anfon. Defnyddir samplau llais a lwythwyd i fyny ar gyfer clonio ar gyfer y sesiwn cyfredol yn unig ac nid ydynt yn cael eu cadw. Ni ydym byth yn rhannu eich data â thrydydd partïon na'u defnyddio i hyfforddi modelau.

I chi yw'r sain a gynhyrchir ar bob cynllun. Ar gyfer defnydd personol, nid masnachol, yw'r sain a gynhyrchir ar y lefel rhad ac am ddim. Mae unrhyw gynllun talu (o $5/mis) yn ychwanegu trwydded fasnachol barhaol ar gyfer fideos YouTube, llyfr sain, podcasts, cymwysiadau, hysbysebion a gwaith cleientiaid wedi'u gwerthu, heb angen am unrhyw gyfeiriad, ac mae uwchraddio hefyd yn cynnwys sain a gynhyrchwyd gennych yn gynharach ar y lefel rhad ac am ddim. Gall sain a gynhyrchwyd ar y lefel rhad ac am ddim cyn 14 Medi 2026 gyda llais a drwyddedwyd yn fasnachol barhau i gael ei ddefnyddio'n fasnachol heb uwchraddio. Ni chaiff lleisiau a modelau sydd wedi'u marcio fel 'Defnydd personol a dim ond defnydd masnachol' yn y dewiswr llais eu cynnwys ar gyfer defnydd masnachol, ar unrhyw gynllun, oherwydd caniateir eu defnydd gan eu haelodau ar gyfer defnydd masnachol yn unig (adran 7A o'r Telerau).

Mae TTS.ai yn creu sain yn y fformat WAV yn rhagosodedig ar gyfer ansawdd uchaf. Gallwch drosi i MP3, FLAC, OGG, neu M4A gan ddefnyddio ein hidlydd sain am ddim. Mae'r API yn cefnogi penodi eich fformat allbwn hoffus yn uniongyrchol yn y cais.

Lawrlwythwch sampl sain byr (hyd at 5 eiliad) o'r llais yr ydych am ei cloni, ac yna teipiwch unrhyw destun i greu siarad yn y llais hwn. Mae modelau fel Chatterbox, GPT-SoVITS, a CosyVoice 2 yn cynnal cloni llais. Mae'r llais wedi'i cloni yn dal y ton, y geiriau, a'r arddull siarad.

Nid oes angen cyfrif ar y modelau am ddim (Kokoro, Piper, VITS, MeloTTS) ac nid oes angen unrhyw gost ychwanegol am y modelau premiwm — maent yn tynnu eich caniatâd am ddim (10,000/mis gyda chyfrif, neu 5,000/diwrnod heb gyfrif). Mae'r modelau safonol (2,000 o nodau/1K o fewnbwn) yn cynnwys Bark, CosyVoice 2, F5-TTS, a Dia. Mae'r modelau premiwm (4,000 o nodau/1K o fewnbwn) yn cynnwys OpenVoice, Chatterbox, StyleTTS 2, a Tortoise. Mae modelau talu'n cynnig ansawdd uwch, mwy o lais, a nodweddion ychwanegol fel clonio llais.

Ydy. Mae'r API yn cynnal prosesu batch ar gyfer trosi niferoedd mawr o destun i lais. Anfonwch nifer o geisiadau a nôl canlyniadau'n ansyml gan ddefnyddio UUIDs swyddi. Mae'r cynllun Busnes ($99/mis) a mwy yn cynnwys mynediad i'r rhes flaenoriaeth ar gyfer prosesu batch cyflymach. Mae'n berffaith ar gyfer cynhyrchu llyfr sain, cynnwys cwrs, a phrosiectau diddanu ar raddfa fawr.
4.1/5 (63)

Beth allwn ni ei wella? Mae eich adborth yn ein helpu i ddatrys problemau.

Dechrau Defnyddio Lleferydd AI Heddiw

Ymuno â chrewyr, datblygwyr a busnesau sy'n defnyddio TTS.ai