Aller au contenu principal
Velqa

DeepSeek V4 Flash API — prix et accès

Rapide et économique — chat, Q&A, gros volume

Entrée
$0.106 USD / 1M tokens
Sortie
$0.212 USD / 1M tokens
Contexte
64k
Disponible sur
Starter et au-dessus
Fournisseur
DeepSeek

Voir les forfaits et les prix en USD

Essayer DeepSeek V4 Flash dans le playground

DeepSeek V4 Flash est le modèle que nous conseillons pour tout ce qui doit tourner en grand volume à faible coût, sans que personne n'attende la réponse devant son écran : réponse à des tickets, extraction de champs, classification, complétion de formulaires. Il est disponible dès Starter et son prix par million de tokens est parmi les plus bas du catalogue, ce qui compte quand l'application envoie des milliers d'appels par jour. Ce n'est en revanche pas le modèle à mettre derrière un chat en direct : voir les latences mesurées plus bas.

Sa fenêtre de contexte de 64k est la plus courte des modèles de sa famille : pour un document long ou une conversation qui s'étale, mieux vaut passer sur DeepSeek V4 Pro, qui garde le même fournisseur mais monte à 160k avec un raisonnement nettement plus solide. Comparé à GLM-4.7 Flash, positionné sur le même segment de prix, l'arbitrage se joue sur le coût de sortie contre tout le reste : DeepSeek V4 Flash facture environ moitié moins par million de tokens de sortie, tandis que GLM-4.7 Flash offre 200k de contexte et se montre bien plus rapide, aussi bien à démarrer qu'à terminer (chiffres mesurés sur sa propre page).

Ce n'est pas le bon choix pour un agent qui enchaîne des appels d'outils sur plusieurs étapes : la qualité de planification y est limitée, et Hunyuan Hy3, disponible au même palier Starter, tient mieux ce type de tâche pour un coût encore raisonnable.

Mesuré chez Velqa

Temps jusqu'au premier token
5.56 s
Débit
19.4 tokens/s

Médiane de 5 appels en streaming contre api.velqa.dev, le 2026-08-10.

Résultats annoncés par le fournisseur

L'appeler

Endpoint compatible OpenAI — on change l'URL de base et l'identifiant du modèle, rien d'autre.

curl https://api.velqa.dev/v1/chat/completions \
  -H "Authorization: Bearer $VELQA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [{"role": "user", "content": "Bonjour"}]
  }'

Questions fréquentes

Combien coûte DeepSeek V4 Flash sur Velqa ?
DeepSeek V4 Flash coûte $0.106 par million de tokens d'entrée et $0.212 par million de tokens de sortie, en USD. Il est inclus dès le forfait Starter.
Peut-on utiliser DeepSeek V4 Flash sans abonnement ?
Oui. DeepSeek V4 Flash s'appelle avec du crédit Boost prépayé, sans forfait mensuel, et le playground permet de l'essayer sans créer de compte.
DeepSeek V4 Flash est-il compatible avec l'API OpenAI ?
Oui. Pointez votre client sur https://api.velqa.dev/v1 et donnez "deepseek-v4-flash" comme modèle — DeepSeek V4 Flash répond sur l'endpoint standard chat completions, streaming compris.