Adrodd Nam / Cais Nodweddion

Modelau Testun- i- Leferydd Côd AgoredName

Mae pob model TTS ar ein platfform yn ffynhonnell agored, a defnyddia'r mwyafrif MIT neu Apache 2.0. Mae rhai modelau a lleisiau wedi'u trwyddedu ar gyfer defnydd di-fasnach yn unig ac maent wedi'u marcio 'Defnydd personol a di-fasnach yn unig'. Defnyddiwch nhw drwy ein API gwesteiedig, neu eu hun-gwesteiwch nhw ar eich strwythur eich hun gydag awdurdod llawn.

Ffynhonell Agored Trwydded MIT Apache Hunan-Westeiadwy GitHub

Ceisiwch Nawr

Am ddim gyda Kokoro, Piper, VITS, MeloTTS
Bydd eich sain a gynhyrchwyd yn ymddangos yma
Creuwyd
0:00
Lawrlwytho
Hoffwch TTS.ai? Meddwl am eich ffrindiau!

Manteision TTS Côd Agored

Pam mae modelau ffynhonnell agored yn bwysig i'ch prosiectau

Pob un o dan Drwydded Ffynhonell Agored

Mae pob model ar TTS.ai yn ffynhonnell agored, a mae pob tudalen model yn rhestru ei drwydded. Dim bocs du perchnogaethol na cloi mewn gwerthwr.

Trwyddedau Côd Agored

Mae'r rhan fwyaf o'r modelau wedi'u trwyddedu o dan MIT neu Apache 2.0. Mae rhai yn defnyddio trwyddedau eraill, a marcio "Personal and non-commercial use only" yw modelau neu lais sydd wedi'u trwyddedu ar gyfer defnydd di-fasnach.

Hunan-Westeiadwy

Lawrlwythwch unrhyw ddull a rhedegwch ef ar eich caledwedd eich hun. Rheolaeth lawn dros eich data, cylchdroi, a strwythur. Dim angen dibynnu ar y cwmwl.

Optimeiddio GPU

Mae'r modelau wedi eu gwella ar gyfer GPUs NVIDIA gyda chynhaliaeth CUDA. Mae Piper yn rhedeg ar CPU yn unig. Mae angen 2-8GB o VRAM ar y rhan fwyaf o'r modelau ar gyfer dehongli effeithlon.

Cynhaliwyd gan y Gymuned

Mae cymunedau ffynhonnell agored gweithredol yn cadw a gwella'r modelau hyn. Croesewir cyfraniadau — cyflwyno namau, gwelliannau, a lleisiau newydd ar GitHub.

Trwydded Masnachol ar Gael

Mae cynllun talu o $5/mis yn cynnwys y drwydded fasnachol ar gyfer yr hyn rydych yn ei greu, heb unrhyw hawliau perchnogaeth na ffioedd defnydd; mae'r lefel rhad ac am ddim ar gyfer defnydd personol. Mae modelau a lleisiau wedi'u marcio "Personol a defnydd di-fasnachol yn unig" yn cael eu heithrio.

Ein Catalog Modelau Ffynhonell Agored

Pob model, ei drwydded, a beth mae'n ei wneud orau

KokoroKokoro

Free

Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.

& Ffurfweddu... 5/5

Gorau ar gyfer: Apache 2. 0 - model am ddim o ansawdd gorau, 82M o baramedrau, hawdd ei hunan- westeio

Ceisio Kokoro

PiperPiper

Free

A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.

& Ffurfweddu... 3/5

Gorau ar gyfer: MIT — CPU yn unig, perffaith ar gyfer dyfeisiau ymylon a hunan-westeio mewnadeiladedig

Ceisio Piper

VITSVITS

Free

Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.

& Ffurfweddu... 3/5

Gorau ar gyfer: MIT — pensaernïaeth sylfaenol a ddefnyddir gan lawer o'r modelau islaw

Ceisio VITS

BarkBark

Standard

Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.

Araf 4/5

Gorau ar gyfer: MIT — galluoedd creu sain unigryw y tu hwnt i TTS safonol

Ceisio Bark

Tortoise TTSTortoise TTS

Premium

Multi-voice text-to-speech focused on quality with autoregressive architecture.

Araf 5/5 Clonio Llywio

Gorau ar gyfer: Apache 2. 0 - ansawdd uchaf, gweithrediad cyfeirio wedi' i astudio' n eang

Ceisio Tortoise TTS

OpenVoiceOpenVoice

Premium

Instant voice cloning with granular control over style, emotion, and accent.

Canolig 4/5 Clonio Llywio

Gorau ar gyfer: MIT - cloni llais ffynhonnell agored gyda rheolydd arddull granular

Ceisio OpenVoice

Sut i ddefnyddio TTS ffynhonnell agored

Defnyddio ein API gwestai neu redeg modelau eich hun

1

Archwilio Modelau Ffynhonell Agored

Pori ein catalog o 20+ modelau TTS ffynhonnell agored. Mae pob tudalen model yn dangos y trwydded, strwythur, galluoedd, a gofynion hunan-westeio.

2

Ceisiwch yn eich Porwr

Prawfwch unrhyw ddull yn uniongyrchol ar TTS.ai heb osod unrhyw beth. Mae ein gweinyddion GPU yn trin prosesu fel y gallwch chi asesu ansawdd cyn ymrwymo i hunan-hostio.

3

Hunan-Gyswllt neu Defnyddio ein API

Cloni cronfeydd model o GitHub a rhedeg yn lleol, neu ddefnyddio ein API gwestai ar gyfer cynhyrchu. Mae hunan-westai yn rhoi rheoli llawn; mae ein API yn darparu strwythur rheoli.

4

Adeiladu Eich Cymhwysiad

Cyfuno TTS â'ch cynnyrch gan ddefnyddio modelau hunan-gartrefedig neu ein API REST. Gwiriwch drwydded pob model yn gyntaf: mae rhai modelau a lleisiau ar gyfer defnydd di-fasnach yn unig.

Cymhariaeth Trwyddedau

Trwydded pob model ar TTS.ai

Model Trwydded Defnydd Masnachol Addasiad Hunan-Westeiwr Dyfarniad
Kokoro Apache 2.0 Angenrheidiol
Piper MIT peiriant; mae trwyddedau llais yn amrywio Rhai lleisiau yn unig Dewisol
VITS MIT Dewisol
MeloTTS MIT Dewisol
Chatterbox MIT Dewisol
Tortoise TTS Apache 2.0 Angenrheidiol
StyleTTS 2 MIT Dewisol
OpenVoice MIT Dewisol
Sesame CSM Apache 2.0 Angenrheidiol
Orpheus Llama 3.2 "Built with Llama"
Spark TTS CC BY-NC-SA 4.0 Defnydd personol a di-fasnach yn unig Angenrheidiol
OuteTTS CC BY-NC-SA 4.0 Defnydd personol a di-fasnach yn unig Angenrheidiol

Hunan-Gostnodi vs API Gwestai

Rhedeg modelau eich hun neu gadewch i ni drin y strwythur

Hunan-Westeiwr ar Eich Caledwedd

Mae pob model ar TTS.ai ar gael fel cywaith ffynhonnell agored ar GitHub neu Hugging Face. Lawrlwythwch y pwysau, gosodwch y dibyniaeth, a rhedeg dehongliad ar eich GPUs eich hun. Mae gennych reolaeth lawn dros y gohiriad, preifatrwydd, a graddio.

  • Preifatrwydd data llawn - sain byth yn gadael eich gweinydd
  • Dim costau ar gyfer pob cais ar ôl gosod cychwynnol
  • Addasiad manwl ar eich data eich hun
  • Angen caledwedd GPU (argymhellir NVIDIA)
  • Ydych chi'n rheoli diweddariadau, graddnodi, a dibyniaethau

Defnyddio API TTS.ai

Get instant access to all 20+ models through a single REST API. We handle GPU provisioning, model updates, queue management, and scaling. One API key gives you access to every model — no need to manage separate deployments.

  • Dim caledwedd GPU angenrheidiol
  • Pob 20+ model trwy un API
  • Diweddariadau a gwelliannau model ymysgogol
  • 99.9% o amser ar gael gyda chynlluniau gormodol
  • Dim ond talu am yr hyn a ddefnyddiwch

Cychwyn Cyflym: API neu Hunan-Westeiwr

Defnyddio ein API gwestai, neu osod Kokoro yn lleol mewn munudau

Opsiwn 1: API Gwestai TTS.ai Hawsaf
import requests

response = requests.post("https://api.tts.ai/v1/tts", json={
    "text": "Open source TTS with a simple API.",
    "model": "kokoro",
    "voice": "af_heart",
    "format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})

with open("output.wav", "wb") as f:
    f.write(response.content)
Opsiwn 2: Hunan-Westeiwr efo pip Rheoli Llawn
# Install Kokoro locally
pip install kokoro

# Generate speech on your own GPU
import kokoro

pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
    kokoro.save(audio, f"output_{i}.wav")

Ffynhonell Agored, Prisiau Cystadleuol

Mae ein API gwestai yn gwneud TTS ffynhonnell agored yn hygyrch heb reoli GPUs.

Haen Rhydd

$0

50 credyd ar gofrestru

  • 4 model ffynhonnell agored am ddim
  • Dim cofrestru ar gyfer defnydd sylfaenol
  • Defnydd personol, nid masnachol

Cychwynydd

$9

500 credyd/mis

  • Pob 20+ model ffynhonnell agored
  • Clonio llais
  • Cyrchiad API

Pro

$29

2000 credyd/mis

  • Prosesu blaenoriaeth GPU
  • Pob model premiwm
  • Cynhaliaeth Menter
Gweld Prisiau Llawn

Cwestiynau a Ofynnir yn Aml

Cwestiynau cyffredin am ffynhonnell agored testun-i-leferydd

Ydy, mae pob model ar TTS.ai yn ffynhonnell agored, a defnyddia'r mwyafrif MIT neu Apache 2.0. Defnyddia rhai drwyddedau eraill, gan gynnwys rhai sydd wedi eu trwyddedu ar gyfer defnydd di-fasnach yn unig, sydd wedi eu marcio "Personol a defnydd di-fasnach yn unig" yn y dewisydd llais. Mae pob tudalen model yn rhestru ei drwydded.

Mae'r ddau yn drwyddedau ffynhonnell agored caniataol sy'n caniatáu defnydd masnachol, newid, ac ail-ddarlledu. Ychwanega Apache 2. 0 ganiatadau trwyddedau eglur ac yn gofyn am nodi newidiadau os ydych yn newid y côd. Mae MIT yn symlach gyda llai o ofynion. Mae'r ddau yn gyfeillgar i fusnesau.

Ie. Gall pob model fod yn hunan-gartrefol. Cloniwch y storfa model o GitHub, gosodwch ddibyniaethau, lawrlwythwch bwysau model, a rhedeg dehongliad. Rydym yn darparu dogfennaeth ar gyfer gofynion hunan-gartrefol pob model gan gynnwys GPU, RAM, a fersiwn Python.

Mae'r gofynion yn amrywio yn ôl y model. Nid oes angen GPU ar Piper (CPU yn unig). Mae angen 1-2GB VRAM ar Kokoro a MeloTTS. Mae angen 4GB VRAM ar y rhan fwyaf o'r modelau safonol. Mae angen 8GB ar Tortoise a Sesame CSM. Gall NVIDIA RTX 3060 (12GB) redeg y rhan fwyaf o'r modelau'n gyfforddus.

Ie. Caniatâ trwyddedau ffynhonnell agored addasu, gan gynnwys addasu manwl. Mae modelau fel GPT-SoVITS a Bark yn darparu sgriptiau addasu manwl. Gallwch hyfforddi modelau ar eich data llais eich hun i greu llais addasedig neu wella perfformiad i ieithoedd penodol.

Mae'r modelau ffynhonnell agored uchaf (Kokoro, StyleTTS 2, Chatterbox) bellach yn cyfateb neu'n rhagori ar wasanaethau masnachol fel ElevenLabs a Google TTS mewn meini prawf ansawdd. Y prif fantais o wasanaethau masnachol yw'r strwythur a'r cefnogaeth a reolir, nid ansawdd sain.

Mae rhai wedi eu tynnu: XTTS/XTTS-v2 (CPML Coqui, dim masnach), F5-TTS (CC-BY-NC, dim masnach) a Higgs-v2 (Trwydded Boson, cyfyngedig). Mae rhai modelau a lleisiau sy'n weddill, fel TTS Spark, OuteTTS a llawer o bleidiau Piper, wedi eu trwyddedu ar gyfer defnydd di-fasnach yn unig; maent wedi eu marcio "Personol a defnydd di-fasnach yn unig" yn y dewiswr llais, felly defnyddiwch lais gwahanol ar gyfer prosiectau masnach.

Ie. Mae'r rhan fwyaf o fathau'n derbyn cyfraniadau'r gymuned drwy GitHub. Gallwch gyflwyno adroddiadau nam, recordiadau llais ar gyfer ieithoedd newydd, gwelliannau i'r cod, a dogfennaeth. Gwiriwch storfa GitHub pob math am gyfarwyddiadau cyfraniadau a materion gweithredol.

Llwytho modelau ar gais a dadlwytho pan yn wag i rannu cof GPU. Mae ein gweinydd GPU yn rhedeg 20+ model ar 4x Tesla P40 (96GB cyfanswm VRAM) gan ddefnyddio llwytho dynamig. Ar gyfer hunan-westeio, gall GPU 24GB sengl wasanaethu 3-5 model ar yr un pryd.

Mae llawer o enghreifftiau yn darparu delweddau Docker swyddogol neu ffeiliau Dockerfi. I redeg enghreifftiau lluosog, gallwch adeiladu gosod Docker addasedig gyda NVIDIA Container Toolkit ar gyfer cyrchu GPU. Gall ein pensaernïaeth gweinydd API wasanaethu fel gweithrediad cyfeirio.

Mae angen Python 3.10-3.12 ar y rhan fwyaf o fathau. Mae angen Python 3.11 ar Coqui TTS (VITS) yn benodol. Rydym yn argymell Python 3.12 ar gyfer y rhan fwyaf o fathau. Gwiriwch requirements.txt pob math am gydnawsedd fersiwn cywir.

Os ydych yn hunan-gartrefu, yn aml iawn, felly: caniata'r trwyddedau MIT a Apache 2.0 yn glir i ddefnydd masnachol, a defnyddia'r rhan fwyaf o'r modelau yma nhw, felly gallwch adeiladu cynhyrchion SaaS, cymwysiadau symudol, gemau a gwasanaethau heb unrhyw gostau trwyddedu na rhoddion. Gwiriwch y trwydded ar bob tudalen model yn gyntaf, oherwydd mae rhai modelau a llais yn anfasnachol. Mae sain a gynhyrchir ar TTS.ai ei hun yn dilyn eich cynllun: defnydd personol ar y lefel rhad ac am ddim, defnydd masnachol ar unrhyw gynllun talu.
5.0/5 (1)

Beth allwn ni ei wella? Mae eich adborth yn ein helpu i ddatrys problemau.

Ceisiwch TTS ffynhonnell agored heddiw

20+ modelau ffynhonnell agored, pob un gyda'i drwydded ei hun yn y rhestr. Defnyddiwch ein API neu hunan-host, eich dewis chi yw.