Studio de conception vocale

Créez des voix d'IA personnalisées en ajustant les curseurs. Aucun enregistrement nécessaire — concevoir votre voix parfaite à partir de zéro.

Caractéristiques de la voix

C'est profond.Élevée
LentementRapide
Froid / ProfessionnelChaleureux / amical
EffacerRespirant
JeunesSujets âgés
Une voix féminine jeune adulte avec une hauteur moyenne et une vitesse normale. Chaleur équilibrée, livraison claire.

Texte pour parler

0/2000
2 caractères — Inscrivez-vous pour suivre l'utilisation

Aperçu

Ajustez les curseurs et cliquez sur Générer pour entendre votre voix conçue

Générer de la voix...

0:00

Préréglages de voix sauvegardés

Pas encore de préréglages enregistrés. Concevoir une voix et l'enregistrer pour une utilisation ultérieure.

Plans de conception vocale

Commencez gratuitement, mise à niveau lorsque vous avez besoin de plus

Les plus populaires
Compte gratuit
  • 15 000 caractères gratuits lors de l'inscription
  • Sexe, tangage, contrôle de la vitesse
  • Chaudières et sliders respirants
  • Préréglages d'émotion/de style
  • 2 000 caractères par génération
Inscription gratuite
Pour
  • Sauvegarder les conceptions vocales personnalisées
  • Contrôle de l'âge par réglage fin
  • Génération de lots
  • Accès à l'API
  • Utiliser des conceptions pour tous les outils
Mise à jour

Foire aux questions

Le Studio de conception vocale vous permet de créer des voix AI personnalisées en décrivant des caractéristiques comme le pas, la vitesse, la chaleur, la respiration et l'âge, sans enregistrement nécessaire. L'IA génère une voix correspondant à votre description en utilisant le mode de conception vocale Qwen3-TTS.

Vous ajustez les curseurs (pitch, vitesse, chaleur, respiration, âge) ou tapez une description en texte libre comme « voix chaude, amicale, jeune femme avec un léger accent britannique. » L'IA interprète votre description et génère la parole dans une voix synthétique correspondante.

La conception vocale utilise Qwen3-TTS en mode VoiceDesign. Ce modèle peut générer des voix à partir de descriptions de texte sans audio de référence. Il prend en charge une large gamme de caractéristiques vocales et produit des sons naturels.

Oui. Une fois que vous concevez une voix que vous aimez, cliquez sur "Enregistrer sous préréglage" pour stocker la description. Vous pouvez ensuite utiliser ce préréglage à travers la génération TTS, le chat vocal et les agents — votre voix personnalisée est disponible partout.

Le clonage vocal recrée la voix d'une personne réelle à partir d'un enregistrement. Le design vocal crée une voix synthétique entièrement nouvelle à partir d'une description. Le design est plus rapide (pas besoin d'audio) et crée des voix uniques qui ne copient personne.

Emplacement (deep to high), vitesse (slow to fast), chaleur (froid/professionnel à chaud/friendly), respiration (clair à respirant), âge (jeune à âgé), accent (américain, britannique, australien, etc.) et sexe. Vous pouvez également ajouter des descriptions personnalisées pour des traits spécifiques.

Les plans de démarrage incluent 20 presets, et les plans Pro incluent des presets de voix illimités. Chaque preset stocke la description complète afin que vous puissiez régénérer la même voix exacte.

Oui, sur un plan payant. Les voix créées dans le studio de design sont synthétiques et ne copient personne, donc il n'y a pas de problèmes de droits, et Qwen3-TTS est sous licence Apache 2.0. L'audio généré sur un plan payant peut être utilisé commercialement, et la mise à jour couvre également l'audio que vous avez fait plus tôt sur le niveau gratuit; l'audio de niveau gratuit est pour une utilisation personnelle et non commerciale.

Actuellement, la conception vocale fonctionne mieux pour l'anglais, le chinois, le japonais et le coréen — les langues Qwen3-TTS ont été formées. D'autres langues seront ajoutées à mesure que des modèles de conception vocale multilingues seront disponibles.

Oui. Ajustez les curseurs, puis cliquez sur Générer pour entendre une courte phrase d'échantillon dans la voix conçue. Il faut généralement moins d'une minute, et quelques minutes lorsque nos GPU sont occupés; la page continue de vérifier et de jouer l'échantillon dès qu'il est prêt, donc il n'est pas nécessaire de cliquer à nouveau. Une fois satisfait, générer plus de texte avec la voix conçue.

Chaque génération de conception vocale utilise des prix standard (2x caractères). Les prévisualisations en direct utilisent une courte phrase fixe pour minimiser le coût. Les comptes gratuits commencent par 15 000 caractères.

Par exemple, le curseur à 80 % des cartes à « voix haute ». Le curseur à 90 % ajoute « ton chaud et amical ». Ces descriptions sont combinées en un seul profil vocal qui invite Qwen3-TTS à générer la voix.
5.0/5 (1)

Que pourrions-nous améliorer? Vos commentaires nous aident à résoudre les problèmes.

Prêt à commencer?

Inscrivez-vous gratuitement et obtenez 50 crédits. Aucune carte de crédit requise.