Utiliser Claude Code avec Kimi K2.6 ou DeepSeek au Maroc — velqa.dev
Configurez Claude Code pour utiliser Kimi K2.6, DeepSeek ou MiniMax M3 via velqa.dev, payable en dirhams marocains (MAD). Pas de carte Visa internationale nécessaire.
Velqa expose une API compatible Anthropic (/v1/messages) en plus de l'API OpenAI-compatible : Claude Code fonctionne donc nativement, sans plugin ni proxy local.
Prérequis
- Claude Code installé (
npm install -g @anthropic-ai/claude-code) - Une clé API velqa.dev (voir le quickstart)
Configuration
Claude Code lit deux variables d'environnement pour pointer vers un endpoint alternatif. Ajoutez-les à votre ~/.bashrc ou ~/.zshrc :
export ANTHROPIC_BASE_URL="https://api.velqa.dev"
export ANTHROPIC_AUTH_TOKEN="sk-..." # votre clé velqa.devPuis choisissez le modèle Velqa à utiliser :
export ANTHROPIC_MODEL="kimi-k2.6"
export ANTHROPIC_SMALL_FAST_MODEL="glm-4.7-flash"
export CLAUDE_CODE_MAX_OUTPUT_TOKENS="16384"ANTHROPIC_SMALL_FAST_MODEL est utilisé par Claude Code pour les tâches internes rapides (résumés, titres) — y mettre le modèle le moins cher réduit sensiblement votre consommation.
CLAUDE_CODE_MAX_OUTPUT_TOKENS borne la sortie à la limite réelle du modèle (16384 pour la plupart, 8192 pour deepseek-v4-flash). Sans lui, une grosse complétion + le prompt peuvent dépasser la fenêtre d'un modèle à petit contexte et déclencher Trop de tokens demandés. Reessaie plus tard.
Fenêtre de contexte : rien à régler (auto-compaction native)
Contrairement à Cline / opencode / Roo / Kilo, Claude Code n'a pas de champ « Context Window » à renseigner : il compacte automatiquement le contexte (autoCompactEnabled, activé par défaut) quand la session approche de la limite. Le seul garde-fou côté taille que vous ajoutez est donc CLAUDE_CODE_MAX_OUTPUT_TOKENS ci-dessus, pour la sortie.
Nuance : Claude Code ne connaît pas la fenêtre exacte d'un modèle non-Claude et suppose une valeur large. Sur les modèles à grande fenêtre (deepseek-v4-pro / qwen3.7-max 1M, hy3 / mimo-v2.5 262k, kimi-k2.6 131k) l'auto-compaction tombe juste. Sur deepseek-v4-flash (64k), préférez un outil où vous fixez la fenêtre à la main (opencode, Cline) ou réservez Claude Code aux modèles à grande fenêtre.
Alternativement, sans variables globales, vous pouvez configurer par projet dans .claude/settings.json :
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.velqa.dev",
"ANTHROPIC_MODEL": "kimi-k2.6",
"ANTHROPIC_SMALL_FAST_MODEL": "glm-4.7-flash"
}
}(La clé reste dans ANTHROPIC_AUTH_TOKEN en variable d'environnement — ne la mettez jamais dans un fichier versionné.)
Test rapide
claude "explique ce repo en 3 phrases"Si la réponse arrive, la connexion fonctionne. Vous pouvez vérifier le modèle actif dans Claude Code avec /status.
Modèles recommandés
| Modèle | Cas d'usage | Plan minimum |
|---|---|---|
kimi-k2.6 | Agent de code complexe, longues sessions | Dev (199 MAD) |
hy3 | Généraliste et agentic, excellent rapport perf/prix | Starter (99 MAD) |
minimax-m3 | Raisonnement agentic, meilleur rapport perf/prix | Dev (199 MAD) |
glm-4.7-flash | Tâches rapides, small/fast model — le plus réactif | Starter (99 MAD) |
deepseek-v4-flash | Gros volume économique, revue de code légère | Starter (99 MAD) |
glm-4.7 | Chat général, bon en FR / AR | Starter (99 MAD) |
Dépannage
« Please run /login · API Error: 403 ... »
Le préfixe « Please run /login » est ajouté par Claude Code lui-même : dès qu'il reçoit une erreur 401 ou 403, il suppose un problème de connexion et propose de se reconnecter. Ne lancez pas `/login` — avec Velqa il n'y a pas de compte Anthropic à connecter. Lisez plutôt la suite du message, qui contient la vraie cause :
- `key not allowed to access model ... Tried to access <nom>` : le nom de modèle demandé n'existe pas ou n'est pas inclus dans votre clé. Vérifiez
ANTHROPIC_MODELetANTHROPIC_SMALL_FAST_MODEL— une faute de frappe dans l'ID (ex.kimi-k2.66au lieu dekimi-k2.6) suffit. La liste des IDs valides est sur velqa.dev/models. - `Authentication Error` ou clé refusée : vérifiez
ANTHROPIC_AUTH_TOKEN(clé complète, sans espace) et que la clé n'a pas été révoquée dans le tableau de bord. - Le modèle est valide mais toujours refusé : votre plan ne l'inclut peut-être pas (voir le tableau ci-dessus) — ou votre clé date d'avant un ajout de modèle ; régénérez-la depuis le tableau de bord ou contactez le support.
Limitations connues
- Les fonctionnalités propres aux modèles Claude d'Anthropic (vision sur certains modèles, prompt caching Anthropic natif) dépendent du modèle open-weight choisi derrière — le cache est géré côté Velqa quand le provider le supporte.
- Si un outil envoie des en-têtes
anthropic-betanon supportés, ils sont ignorés proprement par la passerelle.
Tarifs en MAD
Consultez velqa.dev/models pour les prix à jour en MAD/M tokens. Les tarifs Recharge Boost sont affichés en dirhams directement dans le tableau de bord.
