Aller au contenu principal
Velqa

Utiliser Claude Code avec Kimi K2.6 ou DeepSeek au Maroc — velqa.dev

Configurez Claude Code pour utiliser Kimi K2.6, DeepSeek ou MiniMax M3 via velqa.dev, payable en dirhams marocains (MAD). Pas de carte Visa internationale nécessaire.

Velqa expose une API compatible Anthropic (/v1/messages) en plus de l'API OpenAI-compatible : Claude Code fonctionne donc nativement, sans plugin ni proxy local.

Prérequis

  • Claude Code installé (npm install -g @anthropic-ai/claude-code)
  • Une clé API velqa.dev (voir le quickstart)

Configuration

Claude Code lit deux variables d'environnement pour pointer vers un endpoint alternatif. Ajoutez-les à votre ~/.bashrc ou ~/.zshrc :

export ANTHROPIC_BASE_URL="https://api.velqa.dev"
export ANTHROPIC_AUTH_TOKEN="sk-..."   # votre clé velqa.dev

Puis choisissez le modèle Velqa à utiliser :

export ANTHROPIC_MODEL="kimi-k2.6"
export ANTHROPIC_SMALL_FAST_MODEL="glm-4.7-flash"
export CLAUDE_CODE_MAX_OUTPUT_TOKENS="16384"

ANTHROPIC_SMALL_FAST_MODEL est utilisé par Claude Code pour les tâches internes rapides (résumés, titres) — y mettre le modèle le moins cher réduit sensiblement votre consommation.

CLAUDE_CODE_MAX_OUTPUT_TOKENS borne la sortie à la limite réelle du modèle (16384 pour la plupart, 8192 pour deepseek-v4-flash). Sans lui, une grosse complétion + le prompt peuvent dépasser la fenêtre d'un modèle à petit contexte et déclencher Trop de tokens demandés. Reessaie plus tard.

Fenêtre de contexte : rien à régler (auto-compaction native)

Contrairement à Cline / opencode / Roo / Kilo, Claude Code n'a pas de champ « Context Window » à renseigner : il compacte automatiquement le contexte (autoCompactEnabled, activé par défaut) quand la session approche de la limite. Le seul garde-fou côté taille que vous ajoutez est donc CLAUDE_CODE_MAX_OUTPUT_TOKENS ci-dessus, pour la sortie.

Nuance : Claude Code ne connaît pas la fenêtre exacte d'un modèle non-Claude et suppose une valeur large. Sur les modèles à grande fenêtre (deepseek-v4-pro / qwen3.7-max 1M, hy3 / mimo-v2.5 262k, kimi-k2.6 131k) l'auto-compaction tombe juste. Sur deepseek-v4-flash (64k), préférez un outil où vous fixez la fenêtre à la main (opencode, Cline) ou réservez Claude Code aux modèles à grande fenêtre.

Alternativement, sans variables globales, vous pouvez configurer par projet dans .claude/settings.json :

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://api.velqa.dev",
    "ANTHROPIC_MODEL": "kimi-k2.6",
    "ANTHROPIC_SMALL_FAST_MODEL": "glm-4.7-flash"
  }
}

(La clé reste dans ANTHROPIC_AUTH_TOKEN en variable d'environnement — ne la mettez jamais dans un fichier versionné.)

Test rapide

claude "explique ce repo en 3 phrases"

Si la réponse arrive, la connexion fonctionne. Vous pouvez vérifier le modèle actif dans Claude Code avec /status.

Modèles recommandés

ModèleCas d'usagePlan minimum
kimi-k2.6Agent de code complexe, longues sessionsDev (199 MAD)
hy3Généraliste et agentic, excellent rapport perf/prixStarter (99 MAD)
minimax-m3Raisonnement agentic, meilleur rapport perf/prixDev (199 MAD)
glm-4.7-flashTâches rapides, small/fast model — le plus réactifStarter (99 MAD)
deepseek-v4-flashGros volume économique, revue de code légèreStarter (99 MAD)
glm-4.7Chat général, bon en FR / ARStarter (99 MAD)

Dépannage

« Please run /login · API Error: 403 ... »

Le préfixe « Please run /login » est ajouté par Claude Code lui-même : dès qu'il reçoit une erreur 401 ou 403, il suppose un problème de connexion et propose de se reconnecter. Ne lancez pas `/login` — avec Velqa il n'y a pas de compte Anthropic à connecter. Lisez plutôt la suite du message, qui contient la vraie cause :

  • `key not allowed to access model ... Tried to access <nom>` : le nom de modèle demandé n'existe pas ou n'est pas inclus dans votre clé. Vérifiez ANTHROPIC_MODEL et ANTHROPIC_SMALL_FAST_MODEL — une faute de frappe dans l'ID (ex. kimi-k2.66 au lieu de kimi-k2.6) suffit. La liste des IDs valides est sur velqa.dev/models.
  • `Authentication Error` ou clé refusée : vérifiez ANTHROPIC_AUTH_TOKEN (clé complète, sans espace) et que la clé n'a pas été révoquée dans le tableau de bord.
  • Le modèle est valide mais toujours refusé : votre plan ne l'inclut peut-être pas (voir le tableau ci-dessus) — ou votre clé date d'avant un ajout de modèle ; régénérez-la depuis le tableau de bord ou contactez le support.

Limitations connues

  • Les fonctionnalités propres aux modèles Claude d'Anthropic (vision sur certains modèles, prompt caching Anthropic natif) dépendent du modèle open-weight choisi derrière — le cache est géré côté Velqa quand le provider le supporte.
  • Si un outil envoie des en-têtes anthropic-beta non supportés, ils sont ignorés proprement par la passerelle.

Tarifs en MAD

Consultez velqa.dev/models pour les prix à jour en MAD/M tokens. Les tarifs Recharge Boost sont affichés en dirhams directement dans le tableau de bord.