Synthèse vocale (Text-to-Speech) avec Velqa.dev
Velqa propose la synthèse vocale sur l'API OpenAI-compatible https://api.velqa.dev/v1/audio/speech. Vous envoyez du texte et une voix, l'API renvoie directement les octets audio (mp3). Idéal pour lecteurs vocaux, notifications parlées, prototypes de voix.\n\nDeux modèles, et le choix se joue sur la langue : kokoro-tts couvre 8 langues dont le français, mais pas l'arabe ; qwen3-tts fait l'arabe et le français, avec des voix nommées et un contrôle du ton en langage naturel.
Tarification et accès
Comme l'audio et l'image, la synthèse vocale est facturée à l'usage (au nombre de caractères), via le solde Recharge Boost (crédit prépayé) — elle n'est incluse dans aucun forfait Starter/Dev/Pro.
| Model ID | Prix public / M caractères | Langues | Voix |
|---|---|---|---|
kokoro-tts | 2 USD | 8 langues dont FR, sans arabe | ff_siwis, af_bella, af_sarah, am_adam, am_michael, bf_emma, bm_george, hf_alpha, hm_omega |
qwen3-tts | 44 USD | FR, EN, AR, détection auto | Vivian, Serena, Ryan, Dylan, Eric, Aiden |
qwen3-tts accepte en plus language (forcer la langue au lieu de la détecter) et instruct, une consigne en langage naturel sur le ton (« ton calme », « chuchoté », « parle lentement »).
- Accès : tout compte disposant d'un solde Boost positif
- Le coût réel dépend du nombre de caractères du texte
input, débité de votre solde Boost.
Si le solde Boost est insuffisant, la requête est refusée (HTTP 402) avant même l'envoi au modèle.
Exemple avec curl
curl https://api.velqa.dev/v1/audio/speech \
-H "Authorization: Bearer $VELQA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kokoro-tts","input":"Bonjour, bienvenue sur Velqa.","voice":"af_heart"}' \
--output sortie.mp3Exemple avec Python
from openai import OpenAI
client = OpenAI(base_url="https://api.velqa.dev/v1", api_key="VELQA_API_KEY")
resp = client.audio.speech.create(
model="kokoro-tts",
voice="af_heart",
input="Bonjour, bienvenue sur Velqa.",
)
resp.stream_to_file("sortie.mp3")La réponse est un flux d'octets audio (mp3) à écrire dans un fichier — pas de JSON. Le coût réel (basé sur le nombre de caractères de input) est débité de votre solde Boost.
Exemple en arabe avec qwen3-tts
curl https://api.velqa.dev/v1/audio/speech \
-H "Authorization: Bearer $VELQA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"qwen3-tts","input":"مرحبا، أهلا بك في فيلكا.","voice":"Vivian","language":"ar"}' \
--output sortie-ar.mp3Une voix inconnue échoue en HTTP 500 (Voice ID not found) — utilisez un nom du tableau ci-dessus.
Voir aussi
- Transcription audio — l'opération inverse (audio → texte).
- Modèles disponibles — catalogue complet et prix en USD.
