Відкрити текст джерела для моделей мовлення
Every TTS model on our platform is open source, and most use MIT or Apache 2.0. A few models and voices are licensed for non-commercial use only and are marked 'Personal and non-commercial use only'. Use them through our hosted API, or self-host them on your own infrastructure with full control.
Спробуйте зараз
Користі для синтезу TTS з відкритим кодом
Чому моделі з відкритим кодом мають значення для ваших проектів
Всі відкриті ліцензування
Кожна модель TTS.ai є відкритим джерелом, кожна з моделей містить свої ліцензії. Немає пропатентованих чорних коробок і немає блокування постачальника.
Ліцензії на відкриті коди
Most models are licensed under MIT or Apache 2.0. A few use other licenses, and models or voices licensed for non-commercial use are marked "Personal and non-commercial use only".
Self- Hostable
Звантажте будь- яку модель і запустіть її на вашому комп' ютері. Повноцінне керування вашими даними, запізненням та інфраструктурою. Не потрібно залежних від хмар.
Оптимізовано GPU
Моделі оптимізовано для NVIDIA GPU з підтримкою CUDA. Piper запущено лише для процесора. Для ефективного обчислення більшості моделей потрібно 2- 8GB VRAM.
Підтримують суспільство
Активні спільноти з відкритим кодом підтримують і покращують ці моделі. Внески вітають помилки, покращення і нові голоси на GitHub.
Доступна комерційна ліцензія
У оплачуваному плані з 5/ м міститься комерційна ліцензія на те, що ви створюєте, без ніяких вкладень на гроші або внесків у користування; безкоштовний прив' язок до нього для особистого використання. Моделі і голоси, позначені " Особисте і некомерційне використання," не буде виключено.
Наш каталог з відкритим кодом моделі
Кожна модель, її ліцензія і те, що вона робить найкраще
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Найкраще для: Apache 2.0 } Найкраща якість безкоштовна модель, 82Мпараметри, простий для самостійного вузла
Спробувати Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Найкраще для: Тільки MIT, ідеальна для пристроїв меж і вбудована самопідтримка
Спробувати Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Найкраще для: MIT ⇩ базова архітектура, що використовується багатьма нижніми моделями.
Спробувати VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Найкраще для: MIT ⇩ unique audio general general generications out of стандартні TTS
Спробувати Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Найкраще для: Apache 2.0 ⇩ Максимальна якість, широко досліджена довідкова реалізація
Спробувати Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Найкраще для: MIT ⇩ open-source голос клонування з керуванням у вигляді гранулярного стилю
Спробувати OpenVoiceЯк користуватися відкритим кодом TTS
Використовувати наш програмний інтерфейс або самостійно запускати моделі
Видиступні моделі Open- Source
Переглядати наш каталог з 20+ з відкритим кодом моделей TTS. На кожній з моделей буде показано ліцензію, архітектуру, можливості і вимоги для самоутвердження.
Спробуйте у переглядачі
Перевіряйте будь- яку модель безпосередньо на TTS.ai без встановлення нічого. Наші сервери GPU працюють з обробкою так, щоб ви могли оцінити якість перед виконанням самовпорядкування.
Сам- Хост або використовуйте наш API
Клонувати моделі експропріаторів з GitHub і працювати локально, або використовувати & imported API для виробництва. Самопідтримка надає повний контроль; наш API надає можливість керувати інфраструктурою.
Будуйте вашу програму
Інтегрувати TTS у ваш продукт за допомогою самоутримання або нашого програмного інтерфейсу REST. Спочатку перевірте ліцензію кожного з моделей: декілька моделей і голосів призначено лише для некомерційного використання.
Порівняння ліцензії
Ліцензія кожної моделі TTS.ai
| Модель | Ліцензія | Комерційне використання | Зміна | Сам- ХостCity in Quebec Canada | Прибуток |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Обов' язково | |||
| Piper | MIT engine; права голосу у різних правах; права на голос можуть бути різними | Лише деякі голоси | Необов' язкове | ||
| VITS | MIT | Необов' язкове | |||
| MeloTTS | MIT | Необов' язкове | |||
| Chatterbox | MIT | Необов' язкове | |||
| Tortoise TTS | Apache 2.0 | Обов' язково | |||
| StyleTTS 2 | MIT | Необов' язкове | |||
| OpenVoice | MIT | Необов' язкове | |||
| Sesame CSM | Apache 2.0 | Обов' язково | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Лише особисте і некомерційне використання | Обов' язково | ||
| OuteTTS | CC BY-NC-SA 4.0 | Лише особисте і некомерційне використання | Обов' язково |
Само- готування/ Вузлий API
Виконуйте моделі самі або дозвольте нам працювати з інфраструктурою.
Сам- Хост на вашому апараті
Будь- яку модель на TTS.ai можна використовувати як проект з відкритим кодом на GitHub або Hback Face. Звантажте ваги, встановіть залежності і запустіть власні GPU. Повноцінний контроль за запізненням, конфіденційністю і масштабуванням.
- Повна конфіденційність даних ♫ Звук ніколи не виходить з вашого сервера
- Немає витрат на отримання після початкового налаштування
- Нетипове налаштування для ваших власних даних
- Потрібне обладнання GPU (рекомендовано NVIDIA)
- Ви керуєте оновленнями, масштабуванням і залежностями
Використовувати API TTS.ai вузлів
Отримати безпосередній доступ до всіх моделей 20+ через єдиний API REST. Ми керуємо можливостями GPU, оновленням моделей, керування чергою і масштабуванням. Одна клавіша API надає вам доступ до кожної моделі ⇩ не потрібно керувати окремими версіями.
- Обладнання GPU не потрібне
- Всі 20 моделей за одним API
- Автоматичне оновлення і вдосконалення моделей
- 99. 9% наднормової інфраструктури
- Плати лише за те, що ти використовуєш.
Швидкий запуск: API або само- Host
Використовувати локальний інтерфейс користувача Koro у хвилинах
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Відкритий код, економний Прибуток
Наш програмный API делает программы с открытым кодом доступными без управления GPU.
Вільний в' язк
$0
15 кредитів при підписуванні
- 4 моделі з відкритим кодом вільні
- Без підписок для базового використання
- Особисте, некомерційне використання
Започаткування
$9
500 000 символів/ місяців
- Всі 20 моделей з відкритим кодом
- Клонування голосів
- Доступ до API
Pro
$29
2 000 000 символів/місяців
- Обробка GPU пріоритету
- Всі внескові моделі
- Підтримка підприємництва
Часті запитання
Поширені питання щодо відкритого вихідного тексту у мовлення
Ваші відгуки допомагають нам вирішити проблеми.
Спробуйте відкрити код TTS сьогодні
20 моделей з відкритим кодом, кожна з яких містить ліцензію. Скористайтеся нашим API або вузлом, вибір буде вашим.