Aller au contenu principal
Velqa

Utiliser GLM 5.2 et MiniMax M3 avec opencode — velqa.dev

Configurez opencode pour utiliser GLM 5.2 ou MiniMax M3 via velqa.dev, facturé en USD via Stripe.

Prérequis

  • opencode installé (npm install -g opencode-ai ou via votre gestionnaire de paquets)
  • Une clé API velqa.dev (voir le quickstart)

Configuration

opencode lit son fichier de config depuis ~/.config/opencode/config.json (global) ou ./opencode.json à la racine de votre projet (prioritaire).

Créez ou modifiez ce fichier :

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "velqa": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "Velqa",
      "options": {
        "baseURL": "https://api.velqa.dev/v1",
        "apiKey": "{env:VELQA_API_KEY}"
      },
      "models": {
        "glm-5.2": {
          "name": "GLM 5.2",
          "limit": {
            "context": 131072,
            "output": 16384
          }
        },
        "minimax-m3": {
          "name": "MiniMax M3",
          "limit": {
            "context": 131072,
            "output": 16384
          }
        },
        "hy3": {
          "name": "Hunyuan Hy3",
          "limit": {
            "context": 262144,
            "output": 16384
          }
        },
        "glm-4.7-flash": {
          "name": "GLM-4.7 Flash",
          "limit": {
            "context": 200000,
            "output": 16384
          }
        },
        "deepseek-v4-flash": {
          "name": "DeepSeek V4 Flash",
          "limit": {
            "context": 65536,
            "output": 8192
          }
        }
      }
    }
  },
  "compaction": {
    "auto": true,
    "prune": true,
    "reserved": 10000
  }
}

Le bloc limit (fenêtre de contexte + sortie max par modèle) et le bloc compaction sont importants : ils disent à opencode quand compacter automatiquement une session longue. compaction.prune retire les anciennes sorties d'outils devenues obsolètes. Sans eux, le contexte grossit sans limite pendant une session agentique et finit par déclencher Trop de tokens demandes. Reessaie plus tard. — en plus de consommer votre quota plus vite. Les valeurs context correspondent à la fenêtre réelle de chaque modèle (voir velqa.dev/models).

Exportez ensuite la variable d'environnement (ajoutez-la à votre ~/.bashrc ou ~/.zshrc) :

export VELQA_API_KEY="sk-..."

Alternativement, vous pouvez mettre la clé en dur dans le fichier (déconseillé si le fichier est versionné) :

"apiKey": "sk-..."

Test rapide

Lancez opencode dans votre projet :

opencode

Tapez /models pour vérifier que les modèles Velqa apparaissent dans la liste. Sélectionnez kimi-k2.6 et posez une question — la réponse confirmera que la connexion fonctionne.

Modèles recommandés

ModèleCas d'usagePlan minimum
glm-5.2Agent de code complexeDev
hy3Généraliste et agenticStarter
minimax-m3Génération de code, refactoringDev
glm-4.7-flashChat général, tâches rapidesStarter
deepseek-v4-flashGros volume économiqueStarter

Tarifs en USD

Consultez velqa.dev/models pour les prix à jour en USD/M tokens. Les tarifs Recharge Boost sont affichés en USD directement dans le tableau de bord.