Realtime TTS
Streaming text-to-speech na may sub-second first-audio latency. Built para sa mga ahente ng boses at live na mga application.
Teksto
StreamingMga setting ng boses
Paano Streaming TTS gumagana
1. Ipadala ang teksto
Ang 1/1000 ng isang segundo ay isang segundong-degree o isang-degree na segundo.
2. Modelo ng mga Generates
Ang mga ito ay tinatawag na mga sampler at ginagamit sa pag-record ng audio.
3. Stream ng mga piraso
Ang mga 64-bit na mga kompyuter ay maaaring mag-imbak ng mga datos sa isang 64-bit na base64.
4. Makikinig ng live
User narinig ang simula ng pangungusap sa ilalim ng isang segundo, kahit na sa mahabang input.
Gamitin ang mga kaso
Kung saan sub-ikalawang latency unlocks bagong karanasan.
Mga Ahente ng Tinig
Ang mga ito ay mga karaniwang mga tao na may mga katangiang tulad ng isang tao.
Mga Live na Dubbed
Isalin at dub ng isang stream sa real time nang walang buffering pauses.
Laro
Ang mga NPC ay maaaring mag-react sa mga desisyon ng manlalaro nang direkta, walang pre-render VO.
Aksesibilidad
Screen readers at mga kasamang tool na nagsisimulang magsalita sa sandaling mag-click ang isang user.
Realtime TTS Plano
Magsimula nang libre, i-upgrade kapag kailangan mo ng higit pa
- Kokoro streaming (libreng modelo)
- 500 mga character sa bawat henerasyon
- 10 libreng stream / araw bawat anonymous user
- Sub-ikalawang unang-audio latency
- SSE streaming sa HTTPS
- 15,000 character sa pag-signup
- 5,000 mga character sa bawat stream
- API key para sa programang pag-access
- Generation kasaysayan
- Walang araw-araw na stream cap
- MOSS-TTS-Realtime (kapag live)
- 100,000 mga character sa bawat stream
- < Prioridad GPU queue
- Voice agent + Twilio pagsasama
- Mas mataas na limitasyon ng rate
Mga Madalas Itanong
Ano ang maaari naming mapabuti? Tutulong sa amin ang iyong feedback na ayusin ang mga isyu.
Stream ng Pagsasalita sa Real Time
Libre para sa unang 10 henerasyon sa isang araw. Mag-sign up upang i-unlock ang buong allowance character at API access.