Aller au contenu principal
Velqa

Modèles disponibles et prix Boost en USD

Les prix ci-dessous sont les prix publics Boost en dollars américains par million de tokens. Les modèles et prix actifs sont aussi exposés par le catalogue du tableau de bord ; une modification de prix est annoncée au moins 30 jours avant sa prise d'effet lorsqu'elle concerne un abonnement.

Model IDUsageEntrée USD/M tokensSortie USD/M tokens
glm-4.7-flashChat rapide0.0710.470
deepseek-v4-flashVolume économique0.1060.212
hy3Généraliste et agentic0.1650.682
mimo-v2.5Chat et agentic0.2500.500
minimax-m3Raisonnement agentic0.3531.410
glm-4.7Chat et code0.4702.056
kimi-k2.6Code agentic, longues sessions0.9404.113
glm-5.2Tâches autonomes longues1.0933.525
deepseek-v4-proRaisonnement premium1.5283.055
qwen3.7-maxRaisonnement premium1.6304.870
qwen3.8-maxFlagship code et travail pro2.3507.050
kimi-k3Raisonnement lourd, contexte 1 048 576 tokens3.34916.744
bge-m3Embeddings0.012—
qwen3-embedding-8bEmbeddings0.012—
qwen3-reranker-8bReranking0.059—

Les modalités unitaires sont facturées depuis le solde Boost, jamais sur le quota d'un forfait :

Model IDModalitéPrix public
whisper-large-v3Transcription audio0.01 USD / minute
kokoro-ttsSynthèse vocale, 8 langues sans arabe2 USD / M caractères
qwen3-ttsSynthèse vocale, arabe inclus + contrôle du ton44 USD / M caractères
flux-1-schnellImage, palier brouillon0.002 USD / image
flux-2-klein-4bImage, palier par défaut0.03 USD / image
flux-2-proImage, palier qualité0.032 USD / image
fastwan-t2v-1.3bVidéo 480p, rapide0.005 USD / seconde
wan2.2-t2v-a14bVidéo, palier qualité0.15 USD / seconde

Disponibilité par plan

  • Starter : deepseek-v4-flash, glm-4.7-flash, glm-4.7, hy3, plus les embeddings et le reranking.
  • Dev : Starter, plus minimax-m3, mimo-v2.5, kimi-k2.6 et glm-5.2.
  • Pro : Dev, plus deepseek-v4-pro et qwen3.7-max.
  • Boost uniquement : kimi-k3 et qwen3.8-max ne sont inclus dans aucun abonnement. Ils s'appellent avec une clé disposant d'un solde Boost, au prix au token du tableau ci-dessus.

Les modalités payées à l'usage demandent un solde Boost positif. Le catalogue du tableau de bord fait foi si un modèle est retiré ou rendu indisponible.

Nouveautés média du 2026-08-09

Quatre modèles ajoutés le même jour, tous chez DeepInfra comme le reste du catalogue média — aucune nouvelle relation fournisseur.

  • flux-1-schnell : 15x moins cher que le palier par défaut. C'est le modèle des brouillons et des séries d'essais, là où payer 0.03 USD par tentative n'a pas de sens.
  • flux-2-pro : qualité nettement au-dessus de flux-2-klein-4b pour ~7 % de plus. flux-2-klein-9b coûte exactement le même prix et n'apporte rien de plus : il n'a pas été ajouté.
  • qwen3-tts : comble le trou de kokoro-tts, qui ne parle pas arabe. Ajoute aussi le forçage de langue et une consigne de ton en langage naturel. 22x le prix de kokoro — à réserver aux cas où kokoro ne suffit pas.
  • fastwan-t2v-1.3b : 30x moins cher que wan2.2-t2v-a14b et surtout ~100x plus rapide (2,5 secondes de génération mesurées contre 4 min 35 s pour le même clip de 5 secondes). En 480p et avec moins de finesse : c'est le palier itération, wan2.2 reste le palier qualité.

Les deux modèles hors forfait

kimi-k3 (Moonshot AI) et qwen3.8-max (Alibaba) sont ajoutés au catalogue le 2026-08-09. Ils ne sont pas dans les forfaits parce que leur coût par token dépasse ce qu'un abonnement à prix fixe peut absorber : kimi-k3 coûte à lui seul plusieurs fois le budget d'un tour de travail sur les modèles inclus. Les vendre à l'unité est la seule façon honnête de les proposer sans dégrader les quotas des autres modèles.

  • kimi-k3 : raisonnement lourd et agentic, fenêtre de contexte de 1 048 576 tokens. Génération lente (de l'ordre de quelques tokens par seconde) — à réserver aux tâches où la qualité du raisonnement prime sur la latence, pas au chat interactif.
  • qwen3.8-max : flagship généraliste, orienté code et travail professionnel, contexte 256k sur la route principale.

Un appel à l'un de ces deux modèles avec une clé d'abonnement sans solde Boost est refusé : ils ne figurent pas dans la liste de modèles autorisés de la clé.