Bark

Bark نووسراو بۆ بیستراو

Suno's transformer-based text-to-audio model that generates speech plus laughter, sighs, music, and sound effects.

تۆماربکە بۆ ٥٠٠٠ هێما

نوسراوەکەت بگۆڕە بۆ تگەکانی SSML بۆ کۆنتڕۆڵی ڕاستەقینە:

<speak><prosody rate="slow">Slow speech</prosody></speak>

تگەکان کە مۆدێلی هەڵبژێردراو تێیدەگات - بکەرەوە بۆ ئەوەی یەکێکیان بخەیتە ناو دەقەکەتەوە کە تیایدا ڕوودەدات:

ئەم مۆدێلە نوسراوێکی ئاسایی دەخوێنێتەوە، بۆیە تاگەکانی ناو ڕستە پشتگوێ دەخرێت. بۆ هەستێکی لەسەر بنەمای تاگ، بگەڕێ بۆ مۆدێلێکی دەربڕین وەک ئۆرفیۆس یان بارک.

پێناسەکردنی دەنگی خۆت (وشە = دەنگی):

-12 +12
0.5x 2.0x
بەبێ پارە لەگەڵ Piper, VITS, MeloTTS
دەنگی دروستکراوت لێرەدا دەردەکەوێت. مۆدێلێک هەڵبژێرە، نوسراوێک دابنێ، پاشان کلیک بکە لەسەر دروستکردن.
دەنگ بە سەرکەوتن دروست کرا
0:00
دابەزاندنی دەنگ دابەزاندن پەیوەستەکە دوای ٢٤ کاتژمێر کۆتایی دێت
پلەی ئازاد: بەکارهێنانی تایبەتی. مۆڵەتی بازرگانی لە ٥$/ مانگ
خۆشت دەوێت TTS.ai؟ بە هاوڕێکانت بڵێ!

دەربارەی Bark

Bark comes from Suno and takes a different approach from most TTS systems: it is a GPT-style transformer trained as a text-to-audio model rather than a pure text-to-speech one. Because it generates raw audio tokens, it can produce nonverbal sounds — laughing, sighing, crying — as well as background music and sound effects alongside the spoken words. It ships with 100+ speaker presets and handles 13+ languages including English, Chinese, French, German, Hindi, Japanese, and Korean. The trade-off is speed and length: at 350M parameters it runs slowly (~15s per clip) and caps at 200 characters, so it shines for short, emotive, creative audio rather than long narration.

باشترین بۆ: Creative audio content, audiobooks with emotion, sound effects

سەردانی هەموویان بکە Bark دەنگی

چاوپێکەوتن

پەرەپێدەر
Suno
مۆڵەتی بەکارھێنەر
MIT
یه‌مه‌ن
standard
خێرایی
slow
دووبارە دروستکردنی دەنگی
نەخێر
زمان
English, Chinese, French, German, Hindi, Italian, Japanese, Korean, Polish, Portuguese, Russian, Spanish, Turkish
زۆرترین پیت
200

Bark دەنگی

Chinese Speaker 1

Chinese
ستاندارد Neutral

Chinese Speaker 2

Chinese
ستاندارد Neutral

English Female 1

English
ستاندارد Female

English Female 2

English
ستاندارد Female

English Female 3

English
ستاندارد Female

English Female 4

English
ستاندارد Female

English Male 1

English
ستاندارد Male

English Male 2

English
ستاندارد Male

English Male 3

English
ستاندارد Male

English Male 4

English
ستاندارد Male

English Male 5

English
ستاندارد Male

English Male 6

English
ستاندارد Male

French Speaker 1

French
ستاندارد Neutral

French Speaker 2

French
ستاندارد Neutral

German Speaker 1

German
ستاندارد Neutral

German Speaker 2

German
ستاندارد Neutral

Hindi Speaker 1

Hindi
ستاندارد Neutral

Italian Speaker 1

Italian
ستاندارد Neutral

Japanese Speaker 1

Japanese
ستاندارد Neutral

Japanese Speaker 2

Japanese
ستاندارد Neutral

Korean Speaker 1

Korean
ستاندارد Neutral

Korean Speaker 2

Korean
ستاندارد Neutral

Polish Speaker 1

Polish
ستاندارد Neutral

Portuguese Speaker 1

Portuguese
ستاندارد Neutral

Russian Speaker 1

Russian
ستاندارد Neutral

Spanish Speaker 1

Spanish
ستاندارد Neutral

Spanish Speaker 2

Spanish
ستاندارد Neutral

Turkish Speaker 1

Turkish
ستاندارد Neutral

Bark پرسیاری زۆر کراوە

Yes. Bark is a text-to-audio model, so beyond speech it can generate nonverbal cues like laughing, sighing and crying, plus music and background sound effects — one of its defining capabilities.

Yes. Bark is MIT-licensed, which permits commercial use.

Bark caps at 200 characters per request and is on the slower side (around 15 seconds per clip), so it is best suited to short, expressive snippets rather than long-form audio. It does not support voice cloning.
← هەموو دەنگەکان