Synthèse vocale en français par API : le guide
Donner une voix naturelle en français à vos applications : messages d'accueil, lecture d'articles, réponses vocales de chatbot, contenus audio. Deux gammes de prix — de 0,45 F à 11,6 F les 1 000 caractères — selon la qualité recherchée.
Les modèles disponibles
| Modèle | Qualité | Prix / 1 000 caractères |
|---|---|---|
| Kokoro 82M | Très bonne, ultra-économique | ~0,45 F |
| Gemini TTS | Naturelle, 8 voix | 11,6 F |
| Gemini 3.1 TTS | Encore plus expressive | 23,2 F |
| GPT-4o mini TTS | Expressive, contrôlable | 10,9 F |
Générer un fichier audio
curl https://api.deeprelay.io/v1/audio/speech \
-H "Authorization: Bearer dr_votre_cle" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash-preview-tts",
"input": "Bonjour et bienvenue chez MaBoutique. Tapez 1 pour suivre votre commande.",
"voice": "Kore"
}' --output accueil.wavEn Python
import requests
r = requests.post(
"https://api.deeprelay.io/v1/audio/speech",
headers={"Authorization": "Bearer dr_votre_cle"},
json={
"model": "gemini-2.5-flash-preview-tts",
"input": "Votre commande numéro 42 est en cours de livraison.",
"voice": "Charon", # Kore, Charon, Fenrir, Aoede, Puck, Zephyr, Leda, Orus
},
)
open("message.wav", "wb").write(r.content)Cas d'usage
- Serveurs vocaux (SVI) : générez vos messages d'accueil à la volée au lieu de les enregistrer en studio
- Notes vocales automatiques : votre bot WhatsApp répond en audio aux clients qui préfèrent écouter
- Accessibilité : lecture d'articles et de documents pour les publics peu à l'aise avec l'écrit
- Contenus : narration de vidéos, capsules audio pour les réseaux
💡 Astuce qualité : écrivez les nombres en toutes lettres (« mille cinq cents francs » plutôt que « 1500F ») et ponctuez généreusement — la voix respire aux virgules.
Limite : 5 000 caractères par requête — découpez les longs textes par paragraphes et concaténez les fichiers audio. Testez les 18 modèles de voix avec les 100 F offerts.