Synthèse vocale (Text-to-Speech) avec Velqa.dev
Velqa propose la synthèse vocale via kokoro-tts (hexgrad, via DeepInfra), sur l'API OpenAI-compatible https://api.velqa.dev/v1/audio/speech. Vous envoyez du texte et une voix, l'API renvoie directement les octets audio (mp3). Prend en charge 8 langues. Idéal pour lecteurs vocaux, notifications parlées, prototypes de voix.
Tarification et accès
Comme l'audio et l'image, la synthèse vocale est facturée à l'usage (au nombre de caractères), via le solde Recharge Boost (crédit prépayé) — elle n'est incluse dans aucun forfait Starter/Dev/Pro.
- Prix indicatif : ~20 MAD / M caractères
- Accès : tout compte disposant d'un solde Boost positif
- Le coût réel dépend du nombre de caractères du texte
input, débité de votre solde Boost.
Si le solde Boost est insuffisant, la requête est refusée (HTTP 402) avant même l'envoi au modèle.
Exemple avec curl
curl https://api.velqa.dev/v1/audio/speech \
-H "Authorization: Bearer $VELQA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kokoro-tts","input":"Bonjour, bienvenue sur Velqa.","voice":"af_heart"}' \
--output sortie.mp3Exemple avec Python
from openai import OpenAI
client = OpenAI(base_url="https://api.velqa.dev/v1", api_key="VELQA_API_KEY")
resp = client.audio.speech.create(
model="kokoro-tts",
voice="af_heart",
input="Bonjour, bienvenue sur Velqa.",
)
resp.stream_to_file("sortie.mp3")La réponse est un flux d'octets audio (mp3) à écrire dans un fichier — pas de JSON. Le coût réel (basé sur le nombre de caractères de input) est débité de votre solde Boost.
Voir aussi
- Transcription audio — l'opération inverse (audio → texte).
- Modèles disponibles — catalogue complet et prix en MAD.
