Les meilleurs modèles open-weight. Une seule API.
Connecte Claude Code, Cline, opencode ou ton application à Kimi, DeepSeek, Qwen et d'autres modèles avec une API compatible OpenAI et Anthropic.
- Chat & code
- Embeddings
- Audio → texte
- Génération d'images
# pointe juste ta base_url
base_url = "https://api.velqa.dev/v1"
api_key = "sk-..."
model = "kimi-k2.6"Tout ton stack IA, sans multiplier les intégrations.
Code, audio, embeddings et images passent par la même infrastructure. Une clé, un suivi et une expérience cohérente.

Modèles disponibles
Open-weight uniquement — pas de closed source.
Agentic coding SOTA, longues sessions
Flagship raisonnement lourd
Raisonnement premium, contexte 1M
Embeddings multilingues (FR / AR) — RAG et recherche sémantique
Transcription audio multilingue (arabe / darija / FR) — facturé à la minute
Génération d'images texte → image, multilingue — facturé à l'image
Comment passe une requête
Une seule gateway, un routage transparent vers le meilleur modèle disponible.
Ta requête
SDK OpenAI ou Anthropic, base_url pointée vers Velqa.
Gateway Velqa
Vérifie ton quota, choisit le modèle disponible.
Bascule automatique
Quota dépassé → pay-as-you-go, sans coupure.
Réponse
Même format qu'en direct, latence stable depuis l'UE.
Des agents qui exécutent, pas seulement des modèles qui répondent.
Le Sandbox lance du code Python ou Node.js dans un environnement isolé. Ton agent lit des fichiers, exécute des commandes et itère seul — chaque tour mesuré et facturé au réel. En bêta sur les plans Dev et Pro.
Runtimes Python 3 & Node.js
Choisis l'environnement, ajoute tes instructions, l'agent démarre en quelques secondes.
Isolation par agent
Chaque agent tourne dans son propre bac à sable, séparé du reste. Rien ne fuite entre les exécutions.
Facturé au tour
Le calcul est mesuré et débité tour par tour, visible dans le dashboard. Aucun coût dormant.
analyse-csv
Python 3 · isolé
Pourquoi Velqa
Pensé pour les développeurs du Maghreb, sans compromis technique.
Paiement en dirhams
Prix en MAD TTC. Paiements en dirhams à l'ouverture de la bêta — compte et clé API gratuits dès maintenant.
Compatible OpenAI & Anthropic
Une seule base_url, deux formats d'API. Ton SDK et tes outils existants fonctionnent sans modification.
Quotas transparents
Fenêtre glissante de 5h, consommation visible en temps réel dans le dashboard. Tu sais toujours où tu en es.
Pas de coupure sèche
Quota dépassé ? Bascule automatique en pay-as-you-go. Ton agent continue de tourner, tu gardes le contrôle.
Hébergé en Europe
Gateway en UE, latence stable depuis le Maghreb. Tes prompts ne transitent pas par des relais opaques.
Clés chiffrées
AES-256-GCM au repos, rotation en un clic, budgets et limites par clé. La sécurité n'est pas une option.
Un cockpit, pas une boîte noire.
Suis les requêtes, le quota glissant et le budget depuis un seul écran. Les signaux importants restent visibles avant qu’ils deviennent des problèmes.
Explorer le dashboardOpérationnel en 3 étapes
Du compte à la première requête en moins de 2 minutes.
- 01
Crée ton compte
Inscription en 30 secondes. Compte gratuit pendant la bêta — les paiements ouvrent bientôt.
- 02
Génère ta clé API
Depuis le dashboard, une clé sk-... avec budget et limites dédiés. Rotation possible à tout moment.
- 03
Pointe ta base_url
Claude Code, opencode, Cline, Roo Code ou ton propre code : change une ligne de config et c'est parti.
Tarifs
Abonnement mensuel prépayé. Annuel = 2 mois offerts.
Prix en MAD TTC. Paiements à l'ouverture de la bêta.
Starter
Pour tester une idée ou un side-project
- Jusqu'à 70M tokens / mois
- ~95 prompts / 5 h, ~615 / semaine
- DeepSeek V4 Flash, GLM-4.7 Flash, GLM-4.7 et Hunyuan Hy3
- Support communauté
Dev
Pour coder tous les jours avec ton agent
- Jusqu'à 140M tokens / mois
- ~395 prompts / 5 h, ~1579 / semaine
- Tout Starter, + MiniMax M3, MiMo V2.5, Kimi K2.6 et GLM-5.2
- Support email
Pro
Pour l'usage individuel intensif et les modèles premium
- Jusqu'à 290M tokens / mois
- ~439 prompts / 5 h, ~1757 / semaine
- Tout Dev, + DeepSeek V4 Pro et Qwen3.7 Max
- File prioritaire + support prioritaire
Quota en budget $, pas en tokens fixes : reste sur un modèle économique et ça dure plus longtemps. Dépassement → bascule automatique Recharge Boost. Pas de coupure sèche.
Besoin d'un usage sur mesure ? Contactez-nous.
Compatible avec tes outils
Pointe juste ta base_url. Rien d'autre.
# Cline — settings.json
"openAIBaseURL": "https://api.velqa.dev/v1",
"openAIApiKey": "sk-..."Questions fréquentes
Une autre question ? Écris-nous, on répond vite.
Quels moyens de paiement acceptez-vous ?
Pendant la bêta, les paiements ne sont pas encore ouverts : compte et clé API gratuits, les plans payants arrivent. Tous les prix sont affichés en MAD TTC.
L'API est-elle vraiment compatible OpenAI et Anthropic ?
Oui. Le endpoint /v1 accepte le format OpenAI (chat/completions) et le format Anthropic (messages). Tout SDK ou outil qui permet de changer la base_url fonctionne directement.
Que se passe-t-il si je dépasse mon quota ?
Aucune coupure : les requêtes basculent automatiquement en pay-as-you-go, débité de ton solde. Tu peux aussi désactiver ce comportement par clé.
Quels modèles proposez-vous ?
Uniquement des modèles open-weight de pointe : DeepSeek V4, Kimi K2.6, GLM-4.7, MiniMax M3, Qwen3.7 Max… mais aussi des modèles d'embeddings (BGE-M3, Qwen3 Embedding), de transcription audio (Whisper Large v3) et de génération d'images (FLUX.2). La liste évolue chaque mois selon les benchmarks.
Puis-je annuler mon abonnement ?
Oui, à tout moment depuis le dashboard. Le plan reste actif jusqu'à la fin de la période payée, sans reconduction.
Où sont hébergées vos infrastructures ?
Le gateway et la base de données sont hébergés dans l'Union européenne. Les clés API sont chiffrées AES-256-GCM au repos.
Prêt à coder avec les meilleurs modèles, payés en dirhams ?
Compte gratuit, première clé en 2 minutes.


