Les meilleurs modèles open-weight. Une seule API.
Connecte Claude Code, Cline, opencode ou ton application à Kimi, DeepSeek, Qwen et d'autres modèles avec une API compatible OpenAI et Anthropic.
- Chat & code
- Audio → texte
- Génération d'images
Sans comptePaiement StripeHébergé en UEClés chiffrées AES-256-GCM
# pointe juste ta base_url
base_url = "https://api.velqa.dev/v1"
api_key = "sk-..."
model = "kimi-k3"Tout ton stack IA, sans multiplier les intégrations.
Code, audio, embeddings et images passent par la même infrastructure. Une clé, un suivi et une expérience cohérente.


Modèles disponibles
Open-weight uniquement — pas de closed source.
Raisonnement lourd et agentique, contexte 1M — lent, hors forfait
Flagship 2.4T — code et travail pro, hors forfait
Flagship raisonnement lourd
Embeddings multilingues (FR / AR) — RAG et recherche sémantique
Transcription audio multilingue (arabe / darija / FR) — facturé à la minute
Génération d'images texte → image, multilingue — facturé à l'image
Comment passe une requête
Une seule gateway, un routage transparent vers le meilleur modèle disponible.
Ta requête
SDK OpenAI ou Anthropic, base_url pointée vers Velqa.
Gateway Velqa
Vérifie ton quota, choisit le modèle disponible.
Bascule automatique
Quota dépassé → pay-as-you-go, sans coupure.
Réponse
Même format qu'en direct, latence stable depuis l'UE.
Des agents qui exécutent, pas seulement des modèles qui répondent.
Le Sandbox lance du code Python ou Node.js dans un environnement isolé. Ton agent lit des fichiers, exécute des commandes et itère seul — chaque tour mesuré et facturé au réel. Inclus sur les trois plans : de 1 h à 15 h de calcul par mois, puis 0,30 $ US / h.
Runtimes Python 3 & Node.js
Choisis l'environnement, ajoute tes instructions, l'agent démarre en quelques secondes.
Isolation par agent
Chaque agent tourne dans son propre bac à sable, séparé du reste. Rien ne fuite entre les exécutions.
Facturé au tour
Le calcul est mesuré et débité tour par tour, visible dans le dashboard. Aucun coût dormant.
analyse-csv
Python 3 · isolé
Pourquoi Velqa
Pensé pour les développeurs exigeants, sans compromis technique.
Paiement par carte
Stripe. Pas de frais cachés.
Compatible OpenAI & Anthropic
Une seule base_url, deux formats d'API. Ton SDK et tes outils existants fonctionnent sans modification.
Quotas transparents
Sessions à réinitialisation fixe (5 h et 7 j), consommation visible en temps réel dans le dashboard. Tu sais toujours où tu en es.
Pas de coupure sèche
Quota dépassé ? Bascule automatique en pay-as-you-go. Ton agent continue de tourner, tu gardes le contrôle.
Hébergé en Europe
Gateway en UE, latence stable et prévisible. Tes prompts ne transitent pas par des relais opaques.
Clés chiffrées
AES-256-GCM au repos, rotation en un clic, budgets et limites par clé. La sécurité n'est pas une option.
PAGE AGENT
Un assistant qui comprend votre page.
Page Agent lit le contexte visible de votre site pour répondre, guider vos visiteurs et préparer des actions utiles.
- Comprend le contexte de votre page
- Confirmation avant une action sensible
- Données masquées et protégées
- Exécution limitée et contrôlée
Un cockpit, pas une boîte noire.
Suis les requêtes, le quota de session et le budget depuis un seul écran. Les signaux importants restent visibles avant qu’ils deviennent des problèmes.
Explorer le dashboardOpérationnel en 3 étapes
Du compte à la première requête en moins de 2 minutes.
- 01
Crée ton compte
Inscription en 30 secondes. Choisis un plan et paie via Stripe.
- 02
Génère ta clé API
Depuis le dashboard, une clé sk-... avec budget et limites dédiés. Rotation possible à tout moment.
- 03
Pointe ta base_url
Claude Code, opencode, Cline, Roo Code ou ton propre code : change une ligne de config et c'est parti.
Tarifs
Abonnement prépayé. Annuel : −8 % sur Dev et Pro.
Prix en USD, hors taxes. Paiement via Stripe.
Résiliable à tout moment.
Starter
Pour tester une idée ou un side-project
- Jusqu'à 70M tokens / mois
- ~307 prompts / 5 h, ~615 / semaine
- DeepSeek V4 Flash, GLM-4.7 Flash, GLM-4.7 et Hunyuan Hy3
- Sandbox agent — ~1 h incluses / mois
- Bibliothèque média : 7 jours
- Support communauté
Dev
Pour coder tous les jours avec ton agent
- Jusqu'à 140M tokens / mois
- ~789 prompts / 5 h, ~1579 / semaine
- Tout Starter, + MiniMax M3, MiMo V2.5, Kimi K2.6 et GLM-5.2
- Sandbox agent — ~5 h incluses / mois
- Bibliothèque média : 30 jours
- Support email
Pro
Pour l'usage individuel intensif et les modèles premium
- Jusqu'à 290M tokens / mois
- ~878 prompts / 5 h, ~1757 / semaine
- Tout Dev, + DeepSeek V4 Pro et Qwen3.7 Max
- Sandbox agent — ~15 h incluses / mois
- Bibliothèque média : 90 jours
- Support prioritaire
Quota en budget $, pas en tokens fixes : reste sur un modèle économique et ça dure plus longtemps. Dépassement → bascule automatique Recharge Boost. Pas de coupure sèche.
Sandbox agent inclus sur les trois plans : de 1 h à 15 h de calcul par mois selon le plan. Au-delà, 0,30 $ US / h prélevé sur ta Recharge Boost — ou un pack d'heures à tarif dégressif.
Besoin d'un usage sur mesure ? Contactez-nous.
Compatible avec tes outils
Pointe juste ta base_url. Rien d'autre.
# Cline — settings.json
"openAIBaseURL": "https://api.velqa.dev/v1",
"openAIApiKey": "sk-..."Questions fréquentes
Une autre question ? Écris-nous, on répond vite.
Quels moyens de paiement acceptez-vous ?
Cartes internationales via Stripe. Tous les prix sont affichés en USD, hors taxes.
L'API est-elle vraiment compatible OpenAI et Anthropic ?
Oui. Le endpoint /v1 accepte le format OpenAI (chat/completions) et le format Anthropic (messages). Tout SDK ou outil qui permet de changer la base_url fonctionne directement.
Que se passe-t-il si je dépasse mon quota ?
Aucune coupure : les requêtes basculent automatiquement en pay-as-you-go, débité de ton solde. Tu peux aussi désactiver ce comportement pour ton compte.
Quels modèles proposez-vous ?
Uniquement des modèles open-weight de pointe : Kimi K3, Qwen3.8 Max, DeepSeek V4, GLM-4.7, MiniMax M3… mais aussi des modèles d'embeddings (BGE-M3, Qwen3 Embedding), de transcription audio (Whisper Large v3) et de génération d'images (FLUX.2). La liste évolue chaque mois selon les benchmarks.
Puis-je annuler mon abonnement ?
Oui, à tout moment depuis le dashboard. Le plan reste actif jusqu'à la fin de la période payée, sans reconduction.
Où sont hébergées vos infrastructures ?
Le gateway et la base de données sont hébergés dans l'Union européenne. Les clés API sont chiffrées AES-256-GCM au repos.
Prêt à coder avec les meilleurs modèles ?
Compte gratuit, première clé API en quelques clics.
