Bark

Bark TT TT TTT TTT T TT TT T T TTT TTT TTT

Suno's transformer-based text-to-audio model that generates speech plus laughter, sighs, music, and sound effects.

签名 对 5,000 字符限制的 5 000 个字符

在 SSML 标记中折行文本以精确控制 :

<speak><prosody rate="slow">Slow speech</prosody></speak>

标记选中模式的理解度 - 单击将一个输入到文本中, 发生时 :

这个模型读的是简单的文字, 所以内嵌标签会被忽略。 对于基于标签的情感, 请切换到像 Orpheus 或 Bark 这样的表达模式 。

定义自定义发音( Word = 发音) :

-12 +12
0.5x 2.0x
免费的管道、VITS、MelotTS
您生成的音频将在此显示。 选择一个模型, 输入文本, 并单击生成 。
音频生成成功
0:00
下载音频 下载.strt 24小时后链接过期
免费:个人使用。 5美元/美元商业许可证
使这个声音成为你自己的声音 30秒后打开声音
喜欢TTS.ai吗?告诉你的朋友吧!

关于 Bark

Bark comes from Suno and takes a different approach from most TTS systems: it is a GPT-style transformer trained as a text-to-audio model rather than a pure text-to-speech one. Because it generates raw audio tokens, it can produce nonverbal sounds — laughing, sighing, crying — as well as background music and sound effects alongside the spoken words. It ships with 100+ speaker presets and handles 13+ languages including English, Chinese, French, German, Hindi, Japanese, and Korean. The trade-off is speed and length: at 350M parameters it runs slowly (~15s per clip) and caps at 200 characters, so it shines for short, emotive, creative audio rather than long narration.

最佳: Creative audio content, audiobooks with emotion, sound effects

全部浏览 Bark 声音

一眼看一眼,

开发者
Suno
许可证
MIT
级别
standard
速度
slow
语音克隆
否 无
语言
English, Chinese, French, German, Hindi, Italian, Japanese, Korean, Polish, Portuguese, Russian, Spanish, Turkish
最大字符
200

Bark 声音

Chinese Speaker 1

Chinese
标准 Neutral

Chinese Speaker 2

Chinese
标准 Neutral

English Female 1

English
标准 Female

English Female 2

English
标准 Female

English Female 3

English
标准 Female

English Female 4

English
标准 Female

English Male 1

English
标准 Male

English Male 2

English
标准 Male

English Male 3

English
标准 Male

English Male 4

English
标准 Male

English Male 5

English
标准 Male

English Male 6

English
标准 Male

French Speaker 1

French
标准 Neutral

French Speaker 2

French
标准 Neutral

German Speaker 1

German
标准 Neutral

German Speaker 2

German
标准 Neutral

Hindi Speaker 1

Hindi
标准 Neutral

Italian Speaker 1

Italian
标准 Neutral

Japanese Speaker 1

Japanese
标准 Neutral

Japanese Speaker 2

Japanese
标准 Neutral

Korean Speaker 1

Korean
标准 Neutral

Korean Speaker 2

Korean
标准 Neutral

Polish Speaker 1

Polish
标准 Neutral

Portuguese Speaker 1

Portuguese
标准 Neutral

Russian Speaker 1

Russian
标准 Neutral

Spanish Speaker 1

Spanish
标准 Neutral

Spanish Speaker 2

Spanish
标准 Neutral

Turkish Speaker 1

Turkish
标准 Neutral

Bark TTS - 常见问题

Yes. Bark is a text-to-audio model, so beyond speech it can generate nonverbal cues like laughing, sighing and crying, plus music and background sound effects — one of its defining capabilities.

Yes. Bark is MIT-licensed, which permits commercial use.

Bark caps at 200 characters per request and is on the slower side (around 15 seconds per clip), so it is best suited to short, expressive snippets rather than long-form audio. It does not support voice cloning.
← 所有声音