GLM-4.7 Flash API — prix et accès
Version légère et économique de GLM-4.7
- Entrée
- $0.071 USD / 1M tokens
- Sortie
- $0.470 USD / 1M tokens
- Contexte
- 200k
- Disponible sur
- Starter et au-dessus
- Fournisseur
- Zhipu AI
Essayer GLM-4.7 Flash dans le playground
GLM-4.7 Flash est la version économique de GLM-4.7 : même famille, même bonne tenue du français et de l'arabe, mais un prix par token très inférieur. Disponible dès Starter, il est fait pour un assistant à fort trafic — support client, FAQ, tri de messages entrants — où le volume de conversations compte plus que la finesse de chaque réponse. Sa fenêtre de 200k est d'ailleurs plus large que celle de GLM-4.7 lui-même, ce qui permet d'y verser de gros documents sans découpage.
Comparé à GLM-4.7, la version complète de la famille, Flash perd en qualité sur les raisonnements en plusieurs étapes et les réponses longues et nuancées. Comparé à DeepSeek V4 Flash, son concurrent direct sur le même segment de prix, GLM-4.7 Flash garde l'avantage sur la taille de contexte, utile pour de la recherche documentaire.
Ce n'est pas le bon choix quand la réponse doit être argumentée ou technique : pour ça, GLM-4.7 ou GLM-5.2 tiennent mieux la route, au prix d'un coût par conversation plus élevé.
Mesuré chez Velqa
- Temps jusqu'au premier token
- 0.65 s
- Débit
- 85.6 tokens/s
Médiane de 5 appels en streaming contre api.velqa.dev, le 2026-08-10.
L'appeler
Endpoint compatible OpenAI — on change l'URL de base et l'identifiant du modèle, rien d'autre.
curl https://api.velqa.dev/v1/chat/completions \
-H "Authorization: Bearer $VELQA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4.7-flash",
"messages": [{"role": "user", "content": "Bonjour"}]
}'Modèles proches
Questions fréquentes
- Combien coûte GLM-4.7 Flash sur Velqa ?
- GLM-4.7 Flash coûte $0.071 par million de tokens d'entrée et $0.470 par million de tokens de sortie, en USD. Il est inclus dès le forfait Starter.
- Peut-on utiliser GLM-4.7 Flash sans abonnement ?
- Oui. GLM-4.7 Flash s'appelle avec du crédit Boost prépayé, sans forfait mensuel. L'essayer dans le playground demande en revanche un compte : l'accès anonyme au playground est réservé au modèle de démonstration.
- GLM-4.7 Flash est-il compatible avec l'API OpenAI ?
- Oui. Pointez votre client sur https://api.velqa.dev/v1 et donnez "glm-4.7-flash" comme modèle — GLM-4.7 Flash répond sur l'endpoint standard chat completions, streaming compris.
