Guides / Synthèse vocale en français par API : le

Synthèse vocale en français par API : le guide

📖 5 min de lecture3 août 2026

Donner une voix naturelle en français à vos applications : messages d'accueil, lecture d'articles, réponses vocales de chatbot, contenus audio. Deux gammes de prix — de 0,45 F à 11,6 F les 1 000 caractères — selon la qualité recherchée.

Les modèles disponibles

ModèleQualitéPrix / 1 000 caractères
Kokoro 82MTrès bonne, ultra-économique~0,45 F
Gemini TTSNaturelle, 8 voix11,6 F
Gemini 3.1 TTSEncore plus expressive23,2 F
GPT-4o mini TTSExpressive, contrôlable10,9 F

Générer un fichier audio

terminal
curl https://api.deeprelay.io/v1/audio/speech \
  -H "Authorization: Bearer dr_votre_cle" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-2.5-flash-preview-tts",
    "input": "Bonjour et bienvenue chez MaBoutique. Tapez 1 pour suivre votre commande.",
    "voice": "Kore"
  }' --output accueil.wav

En Python

voix.py
import requests

r = requests.post(
    "https://api.deeprelay.io/v1/audio/speech",
    headers={"Authorization": "Bearer dr_votre_cle"},
    json={
        "model": "gemini-2.5-flash-preview-tts",
        "input": "Votre commande numéro 42 est en cours de livraison.",
        "voice": "Charon",  # Kore, Charon, Fenrir, Aoede, Puck, Zephyr, Leda, Orus
    },
)
open("message.wav", "wb").write(r.content)

Cas d'usage

💡 Astuce qualité : écrivez les nombres en toutes lettres (« mille cinq cents francs » plutôt que « 1500F ») et ponctuez généreusement — la voix respire aux virgules.

Limite : 5 000 caractères par requête — découpez les longs textes par paragraphes et concaténez les fichiers audio. Testez les 18 modèles de voix avec les 100 F offerts.