Bark

Bark TTS

Suno's transformer-based text-to-audio model that generates speech plus laughter, sighs, music, and sound effects.

Підписатися обмеження на 5,000 символів

Переносити ваш текст до міток SSML для точного керування:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Додати позначки емоцій доставки впливу (відносна підтримка model):

Ця модель читає простий текст, отже теґи вбудований буде проігноровано. Для емоцій, заснованих на мітках, перемкніться на модель експресивного вираження, на зразок Orpheus або Bark.

Визначити нетипові вимови (слово = вимова):

-12 +12
0.5x 2.0x
Вільно з Пайпером, VITS, Melotts
Тут з' явиться створений вами звуковий файл. Оберіть модель, введіть текст і натисніть кнопку Створити.
Звук успішно створено
0:00
Звантажити аудіо Звантажити. str Зв' язок закінчується через 24h
Вільний наручник: особисте використання. Комерційна ліцензія з $5/mo
У режимі низького зменшення вільного символу Отримати 200К символів щомісяця або одночасно 100К пачки за 5 доларів
Зробити це вашим власним голосом Клонувати голос за 30 секунд
Любити TTS.ai?

Про програму Bark

Bark comes from Suno and takes a different approach from most TTS systems: it is a GPT-style transformer trained as a text-to-audio model rather than a pure text-to-speech one. Because it generates raw audio tokens, it can produce nonverbal sounds — laughing, sighing, crying — as well as background music and sound effects alongside the spoken words. It ships with 100+ speaker presets and handles 13+ languages including English, Chinese, French, German, Hindi, Japanese, and Korean. The trade-off is speed and length: at 350M parameters it runs slowly (~15s per clip) and caps at 200 characters, so it shines for short, emotive, creative audio rather than long narration.

Найкраще для: Creative audio content, audiobooks with emotion, sound effects

Перегляд всього Bark голоси

На перший погляд

Розробник
Suno
Ліцензія
MIT
Тір
standard
Швидкість
slow
Клонування голосів
Ні
Мови
English, Chinese, French, German, Hindi, Italian, Japanese, Korean, Polish, Portuguese, Russian, Spanish, Turkish
Макс. символи
200

Bark голоси

Chinese Speaker 1

Chinese
Стандартний Neutral

Chinese Speaker 2

Chinese
Стандартний Neutral

English Female 1

English
Стандартний Female

English Female 2

English
Стандартний Female

English Female 3

English
Стандартний Female

English Female 4

English
Стандартний Female

English Male 1

English
Стандартний Male

English Male 2

English
Стандартний Male

English Male 3

English
Стандартний Male

English Male 4

English
Стандартний Male

English Male 5

English
Стандартний Male

English Male 6

English
Стандартний Male

French Speaker 1

French
Стандартний Neutral

French Speaker 2

French
Стандартний Neutral

German Speaker 1

German
Стандартний Neutral

German Speaker 2

German
Стандартний Neutral

Hindi Speaker 1

Hindi
Стандартний Neutral

Italian Speaker 1

Italian
Стандартний Neutral

Japanese Speaker 1

Japanese
Стандартний Neutral

Japanese Speaker 2

Japanese
Стандартний Neutral

Korean Speaker 1

Korean
Стандартний Neutral

Korean Speaker 2

Korean
Стандартний Neutral

Polish Speaker 1

Polish
Стандартний Neutral

Portuguese Speaker 1

Portuguese
Стандартний Neutral

Russian Speaker 1

Russian
Стандартний Neutral

Spanish Speaker 1

Spanish
Стандартний Neutral

Spanish Speaker 2

Spanish
Стандартний Neutral

Turkish Speaker 1

Turkish
Стандартний Neutral

Bark ТЖИ · СО

Yes. Bark is a text-to-audio model, so beyond speech it can generate nonverbal cues like laughing, sighing and crying, plus music and background sound effects — one of its defining capabilities.

Yes. Bark is MIT-licensed, which permits commercial use.

Bark caps at 200 characters per request and is on the slower side (around 15 seconds per clip), so it is best suited to short, expressive snippets rather than long-form audio. It does not support voice cloning.
← Всі голоси