Edge TTS : Installation et Utilisation pour Générer des Podcasts
Edge TTS : Installation et Utilisation pour Générer des Podcasts
Introduction
Vous avez écrit un article passionnant. Vous aimeriez le proposer en version audio pour vos lecteurs. Mais vous n'avez pas envie de payer 50€/mois pour un service TTS professionnel, et l'enregistrement vocal vous prend des heures.
Solution : Edge TTS.
C'est l'outil utilisé par Microsoft Edge pour sa fonction "Lire à voix haute". Et devinez quoi ? C'est open source, gratuit et illimité.
Sur IDex, j'utilise Edge TTS pour générer tous mes podcasts. Aucun coût, une qualité remarquable, et 5 voix neurales françaises au choix. Voici comment faire.
Qu'est-ce qu'Edge TTS ?
Edge TTS est un package Python qui expose l'API de synthèse vocale de Microsoft Azure Cognitive Services. La particularité ?
- 100% gratuit — Aucune limite de caractères
- Illimité — Générez autant de fichiers audio que vous voulez
- Voix neurales — Qualité professionnelle (Neural TTS)
- Offline-friendly — Appel API, téléchargement, c'est tout
C'est la même technologie que ElevenLabs ou Amazon Polly... mais sans la facture mensuelle.
Note : Microsoft ne documente pas officiellement cette API. Edge TTS fonctionne par "ingénierie inversée" du navigateur Edge. Ça marche aujourd'hui, mais ça pourrait changer demain. En attendant, profitons !
Installation avec pipx
La méthode recommandée : pipx. Pourquoi ?
- Installe Edge TTS dans un environnement isolé
- Évite les conflits avec vos autres packages Python
- Crée une commande globale
edge-ttsaccessible partout
# Installer pipx (si ce n'est pas déjà fait)
sudo apt install pipx
# Installer Edge TTS
pipx install edge-tts
# Vérifier l'installation
edge-tts --help
Si tout est bon, vous devriez voir l'aide de la commande avec toutes les options disponibles.
Alternative avec pip :
Mais pipx est plus propre pour un outil système comme Edge TTS.
Les Voix Neurales Françaises Disponibles
Edge TTS propose 5 voix neurales françaises. Voici le détail :
| Voix | Genre | Type | Description |
|---|---|---|---|
fr-FR-DeniseNeural |
Femme | Standard | Général, friendly |
fr-FR-EloiseNeural |
Femme | Standard | Général, friendly |
fr-FR-HenriNeural |
Homme | Standard | Général, friendly ⭐ |
fr-FR-RemyMultilingualNeural |
Homme | Multilingue | Anglais, français, espagnol... |
fr-FR-VivienneMultilingualNeural |
Femme | Multilingue | Anglais, français, espagnol... |
Ma recommandation : fr-FR-HenriNeural
C'est la voix que j'utilise pour tous les podcasts IDex. Elle est : - Chaude sans être trop grave - Claire et intelligible - Agréable à l'écoute sur du long terme - Naturelle (pas robotique)
Comment voir toutes les voix disponibles ?
Vous verrez aussi les voix standards (non-neurales), mais évitez-les — la qualité est nettement inférieure.
Commandes de Base
Générer un fichier audio simple
Résultat : Un fichier test.mp3 de 2 secondes avec la phrase prononcée.
Depuis un fichier texte
C'est plus pratique pour les longs textes (articles, chapitres, etc.)
Edge TTS lit le fichier ligne par ligne et génère l'audio correspondant.
Ajuster la Vitesse
Par défaut, la vitesse est normale (rate = 1.0). Mais pour les podcasts, j'aime bien +30%.
Pourquoi ? Une lecture légèrement plus rapide est plus dynamique et maintient mieux l'attention.
# Vitesse normale (1.0)
edge-tts --voice fr-FR-HenriNeural --file article.md --write-media podcast.mp3
# +30% (1.3) — Ma recommandation podcasts
edge-tts --voice fr-FR-HenriNeural --file article.md --rate="+30%" --write-media podcast.mp3
# +50% (1.5) — Très rapide, pour réécouter vite
edge-tts --voice fr-FR-HenriNeural --file article.md --rate="+50%" --write-media podcast.mp3
# -20% (0.8) — Lent, pour bien comprendre
edge-tts --voice fr-FR-HenriNeural --file article.md --rate="-20%" --write-media podcast.mp3
Plage utile : 0.5 à 2.0. Au-delà, ça devient vite incompréhensible.
Ajuster le Volume
Par défaut, le volume est normal (volume = +0%). Vous pouvez ajuster de -50% à +50%.
# Volume normal
edge-tts --voice fr-FR-HenriNeural --file article.md --volume="+0%" --write-media podcast.mp3
# Un peu plus fort
edge-tts --voice fr-FR-HenriNeural --file article.md --volume="+10%" --write-media podcast.mp3
# Plus doux
edge-tts --voice fr-FR-HenriNeural --file article.md --volume="-20%" --write-media podcast.mp3
Note : La plupart du temps, le volume par défaut convient. Ajustez si votre environnement d'écoute est bruyant.
Workflow Complet : De l'Article au Podcast
Voici mon workflow complet pour IDex :
1. Créer l'article
L'article est en Markdown dans docs/blog/2026-02-19-mon-article.md.
2. Extraire le texte
Le fichier Markdown contient du frontmatter (YAML) qu'il faut supprimer pour le TTS :
# Supprimer le frontmatter (les 11 premières lignes)
tail -n +11 2026-02-19-mon-article.md > article-texte.md
3. Générer le MP3
4. Placer dans le dossier podcasts
5. Reconstruire MkDocs
Le podcast est maintenant disponible sur https://podcasts.planckaert.me/2026-02-19-mon-article.mp3.
Script d'Automatisation
Pour éviter de refaire ces commandes à chaque fois, voici un script bash :
#!/bin/bash
# genere-podcast.sh — Génère un podcast depuis un article IDex
ARTICLE="$1"
if [ -z "$ARTICLE" ]; then
echo "Usage: $0 <article-md>"
exit 1
fi
# Extraire le nom
NOM=$(basename "$ARTICLE" .md)
DATE=$(echo $NOM | grep -oP '\d{4}-\d{2}-\d{2}')
# Supprimer le frontmatter
tail -n +11 "$ARTICLE" > /tmp/$NOM-texte.md
# Générer le MP3
edge-tts --voice fr-FR-HenriNeural --file /tmp/$NOM-texte.md --rate="+30%" --write-media /tmp/$NOM.mp3
# Déplacer dans le dossier podcasts
mv /tmp/$NOM.mp3 ~/Documents/IDex/docs/audio/podcasts/$NOM.mp3
# Nettoyer
rm /tmp/$NOM-texte.md
echo "✅ Podcast généré : $NOM.mp3"
Utilisation :
Bonnes Pratiques
1. Toujours utiliser une voix neurale
Les voix non-neurales (fr-FR-Julie, etc.) sont de qualité médiocre. Vérifiez que le nom contient "Neural".
2. La vitesse +30% est idéale pour les podcasts
Testez différentes vitesses, mais +30% est un bon compromis entre clarté et dynamisme.
3. Attention au markdown
Edge TTS ne lit que le texte brut. Si votre markdown contient beaucoup de symboles (#, *, [), ils seront prononcés.
Solution : Nettoyez le texte avant génération, ou acceptez que certains symboles soient lus.
4. Coupez en morceaux si nécessaire
Edge TTS gère bien les longs textes, mais si votre article fait 5000+ mots, envisagez de le couper en chapitres.
# Chapitre 1
head -n 100 article.md | edge-tts --voice fr-FR-HenriNeural --file - --write-media chap1.mp3
# Chapitre 2
tail -n +101 article.md | head -n 100 | edge-tts --voice fr-FR-HenriNeural --file - --write-media chap2.mp3
5. Écoutez toujours avant de publier
Parfois, une phrase mal ponctuée ou un mot complexe seront mal prononcés. Une écoute rapide permet de repérer ces problèmes et de corriger la ponctuation dans le texte source.
Exemples Concrets
Podcast court (< 3 min)
edge-tts --voice fr-FR-HenriNeural \
--text "Aujourd'hui, nous allons découvrir Edge TTS, un outil gratuit pour générer de la synthèse vocale." \
--rate="+30%" \
--write-media intro.mp3
Article IDex complet (~10 min)
# Nettoyer le frontmatter
tail -n +11 2026-02-19-edge-tts.md > /tmp/edge-tts-texte.md
# Générer
edge-tts --voice fr-FR-HenriNeural \
--file /tmp/edge-tts-texte.md \
--rate="+30%" \
--write-media edge-tts-podcast.mp3
Résultat : Un fichier MP3 de ~8-9 MB pour un article de 1500 mots.
Alternatives (Pour Comparer)
| Service | Prix | Limite | Qualité |
|---|---|---|---|
| Edge TTS | Gratuit | Illimité | ⭐⭐⭐⭐⭐ |
| ElevenLabs | 0-20€/mois | 10k-50k chars | ⭐⭐⭐⭐⭐ |
| Amazon Polly | Payant | Illimité | ⭐⭐⭐⭐ |
| Google Cloud TTS | Payant | Illimité | ⭐⭐⭐⭐ |
Pour 95% des usages (podcasts, livres audio, notifications), Edge TTS est largement suffisant.
Conclusion
Edge TTS est une solution incroyable pour générer de la synthèse vocale sans budget :
- Installation facile avec pipx
- 5 voix neurales françaises de qualité
- Gratuit et illimité — Aucune limite d'utilisation
- Scriptable — Intégrable dans n'importe quel workflow
Sur IDex, tous mes podcasts sont générés avec Edge TTS + voix Henri + vitesse +30%. Le résultat ? Une version audio professionnelle pour chaque article, sans frais récurrents.
Prochaine étape : Testez-le vous-même !
pipx install edge-tts
edge-tts --voice fr-FR-HenriNeural --text "Bienvenue sur mon podcast" --rate="+30%" --write-media test.mp3
Écoutez test.mp3, et dites-moi ce que vous en pensez.
Sources : - Edge TTS - Documentation officielle (GitHub) - Microsoft Azure Cognitive Services - Neural TTS - IDex - Podcasts (https://podcasts.planckaert.me)
Photo by Mohammad Metri on Unsplash