Parler TTS

Parler TTS TTS

Describe the voice you want in plain English and Parler generates speech matching that description.

Teken op vir 5 000 karakterbeperking

Oorvloei jou teks in SSML etiket vir presiese beheer:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Merk die gekose model verstaan ooit die woord ooit om een in jou teks te laat val waar dit gebeur:

Hierdie model lees gewone teks, so inlyn etiket word geignoreer. Vir etiket-gebaseerde emosie, wissel na 'n uitdrukkingende model soos Orpheus of Bark.

Definieer pasmaak uitspraak (woord = uitspraak):

-12 +12
0.5x 2.0x
Vry met Pyper, VITS, MiloTTS
Jou gegenereer oudio sal hier verskyn. Kies 'n model, invoer teks, en kliek Genereer.
Klank Genereer suksesvol
0:00
Aflaai klaar gemaak Aflaai klaar gemaak Skakel verstrek in 24h
Vryvlak: persoonlike gebruik. Kommonsielisensie van R5/m
Liefde TTS.ai, vertel jou vriende!

Aangaande Parler TTS

Parler TTS, developed by Hugging Face, replaces voice presets with natural-language control: instead of picking from a fixed list, you write a description such as "a warm female voice with a slight British accent, speaking slowly and clearly," and the model synthesizes speech to match. This makes it unusually flexible for creative work where you need a specific, custom voice character without recording or cloning anyone. It is an 880M-parameter transformer encoder-decoder trained on roughly 45,000 hours of speech, and it is released under the permissive Apache 2.0 license. Parler is English-focused and best suited to applications that benefit from on-demand, describable voice characteristics.

Beste vir: Creative applications where you need custom voice characteristics

Blaai deur almal Parler TTS stemme

Met'n blik

Ontwikkelingvloeistof is minDeveloper
Hugging Face
Lisensie
Apache 2.0
Tier
standard
Spoed
medium
Stem kloning
Nee
Tale
English
Voeg- agteraan- by Taal
500

Parler TTS stemme

Default

English
Kalender Neutral

Parler TTS TTS ← FAQ

You describe it in natural language — gender, accent, pace, tone, and recording quality — and Parler generates speech matching the description. There are no preset voices to choose from.

Hugging Face. It is an 880M-parameter transformer encoder-decoder trained on around 45,000 hours of speech and released under Apache 2.0.

No. Parler generates a voice from a text description rather than from a reference recording. For cloning a specific voice, use a model like Chatterbox or GPT-SoVITS.
← Alle stemme