Aller au contenu principal
Velqa

Synthèse vocale (Text-to-Speech) avec Velqa.dev

Velqa propose la synthèse vocale sur l'API OpenAI-compatible https://api.velqa.dev/v1/audio/speech. Vous envoyez du texte et une voix, l'API renvoie directement les octets audio (mp3). Idéal pour lecteurs vocaux, notifications parlées, prototypes de voix.\n\nDeux modèles, et le choix se joue sur la langue : kokoro-tts couvre 8 langues dont le français, mais pas l'arabe ; qwen3-tts fait l'arabe et le français, avec des voix nommées et un contrôle du ton en langage naturel.

Tarification et accès

Comme l'audio et l'image, la synthèse vocale est facturée à l'usage (au nombre de caractères), via le solde Recharge Boost (crédit prépayé) — elle n'est incluse dans aucun forfait Starter/Dev/Pro.

Model IDPrix public / M caractèresLanguesVoix
kokoro-tts2 USD8 langues dont FR, sans arabeff_siwis, af_bella, af_sarah, am_adam, am_michael, bf_emma, bm_george, hf_alpha, hm_omega
qwen3-tts44 USDFR, EN, AR, détection autoVivian, Serena, Ryan, Dylan, Eric, Aiden

qwen3-tts accepte en plus language (forcer la langue au lieu de la détecter) et instruct, une consigne en langage naturel sur le ton (« ton calme », « chuchoté », « parle lentement »).

  • Accès : tout compte disposant d'un solde Boost positif
  • Le coût réel dépend du nombre de caractères du texte input, débité de votre solde Boost.

Si le solde Boost est insuffisant, la requête est refusée (HTTP 402) avant même l'envoi au modèle.

Exemple avec curl

curl https://api.velqa.dev/v1/audio/speech \
  -H "Authorization: Bearer $VELQA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kokoro-tts","input":"Bonjour, bienvenue sur Velqa.","voice":"af_heart"}' \
  --output sortie.mp3

Exemple avec Python

from openai import OpenAI

client = OpenAI(base_url="https://api.velqa.dev/v1", api_key="VELQA_API_KEY")
resp = client.audio.speech.create(
    model="kokoro-tts",
    voice="af_heart",
    input="Bonjour, bienvenue sur Velqa.",
)
resp.stream_to_file("sortie.mp3")

La réponse est un flux d'octets audio (mp3) à écrire dans un fichier — pas de JSON. Le coût réel (basé sur le nombre de caractères de input) est débité de votre solde Boost.

Exemple en arabe avec qwen3-tts

curl https://api.velqa.dev/v1/audio/speech \
  -H "Authorization: Bearer $VELQA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen3-tts","input":"مرحبا، أهلا بك في فيلكا.","voice":"Vivian","language":"ar"}' \
  --output sortie-ar.mp3

Une voix inconnue échoue en HTTP 500 (Voice ID not found) — utilisez un nom du tableau ci-dessus.

Voir aussi