Chapitre 3 : Text-to-Speech (TTS)
1. Comment ça marche ?
Vous tapez du texte, choisissez une voix, et l'IA génère l'audio. Mais ce n'est plus la voix robotique de GPS d'il y a 10 ans.
Les modèles neuronaux comprennent l'intonation, la respiration, et même l'ironie.
2. Choisir la bonne voix
- Narration (Livre audio) : Voix profonde, lente, apaisante.
- News/Tuto : Voix dynamique, rapide, claire.
- Pub : Voix enthousiaste, énergique.
3. Contrôler la prosodie (Mise en scène)
Avec ElevenLabs, vous pouvez ajuster :
- Stability : Plus c'est bas, plus la voix est expressive (mais risque de partir en vrille). Plus c'est haut, plus c'est monotone/stable.
- Similarity : À quel point ça ressemble à la voix originale.
4. Astuce de pro
Si l'IA prononce mal un mot ou fait une pause bizarre :
- Écrivez phonétiquement ("Gueugle" pour Google si besoin).
- Ajoutez des points de suspension "..." pour forcer une pause.
- Utilisez des guillemets pour changer le ton.
Conclusion
Vous savez faire parler la machine. Maintenant, faisons-la parler avec VOTRE voix. Prochain chapitre : Clonage.
Ateliers pratiques & Projets
Testez vos compétences avec nos exercices guidés et le tuteur IA.
Ateliers pratiques & Corrigés détaillés
Ateliers pratiques & Corrigés
#1 — Comprendre les bases : Text-to-Speech (TTS) : Bases et bonnes pratiques
Atelier #1Expliquez avec vos mots le concept principal de ce chapitre, puis illustrez-le par un exemple simple.
Consulter la solution type du formateur
#2 — Application guidée
Atelier #2Réalisez un exercice pratique en reprenant la structure vue dans le cours et en modifiant au moins 2 paramètres.
Consulter la solution type du formateur
#3 — Mini défi
Atelier #3Concevez une petite solution personnelle liée à ' Text-to-Speech (TTS) : Bases et bonnes pratiques' et justifiez vos choix techniques.