Modèles disponibles sur velqa.dev — Prix en dirhams (MAD)
Tous les modèles ci-dessous sont accessibles via l'API OpenAI-compatible (https://api.velqa.dev/v1/chat/completions) et l'API Anthropic-compatible (https://api.velqa.dev/v1/messages) de velqa.dev. Prix Recharge Boost indicatifs, issus du dimensionnement 2026-07 (voir dashboard pour les prix en vigueur).
Tableau des modèles
| Model ID | Provider source | Cas d'usage | Type | Prix indicatif (MAD/M tokens input) | Prix indicatif (MAD/M tokens output) |
|---|---|---|---|---|---|
glm-4.7-flash | Zhipu AI | Chat rapide, tâches courantes — le plus réactif | Fast/Chat | ~0,7 MAD | ~4,7 MAD |
deepseek-v4-flash | DeepSeek | Gros volume économique, revue de code légère | Fast/Chat | ~1,1 MAD | ~2,1 MAD |
hy3 | Tencent | Généraliste et agentic, excellent rapport perf/prix | Chat/Agentic | ~1,7 MAD | ~6,8 MAD |
glm-4.7 | Zhipu AI | Chat, agentic coding, bon en FR / AR | Chat/Coding | ~4,7 MAD | ~21 MAD |
minimax-m3 | MiniMax | Raisonnement agentic, meilleur rapport perf/prix | Coding | ~3,5 MAD | ~14 MAD |
mimo-v2.5 | Xiaomi | Généraliste omnimodal (texte, image, vidéo, audio) | Chat/Agentic | ~4,7 MAD | ~24 MAD |
kimi-k2.6 | Moonshot AI | Agent de code, longues sessions, raisonnement | Coding | ~9 MAD | ~41 MAD |
glm-5.2 | Zhipu AI | Tâches autonomes longues, contexte 1M | Coding | ~11 MAD | ~35 MAD |
deepseek-v4-pro | DeepSeek | Flagship raisonnement lourd, contexte 1M | Premium | ~15 MAD | ~31 MAD |
qwen3.7-max | Alibaba | Raisonnement premium, contexte 1M | Premium | ~15 MAD | ~44 MAD |
bge-m3 | BAAI | Embeddings multilingues FR / AR — RAG, recherche sémantique | Embeddings | ~0,12 MAD | — |
qwen3-embedding-8b | Alibaba | Embeddings haute qualité — top MTEB multilingue, jusqu'à 4096 dims | Embeddings | ~0,12 MAD | — |
qwen3-reranker-8b | Alibaba | Reranking multilingue (FR / AR) — complète l'embedding pour le RAG | Rerank | ~0,6 MAD | — |
whisper-large-v3 | OpenAI (via DeepInfra) | Transcription audio multilingue (FR / AR / darija), max 10 min | Audio (STT) | ~0,10 MAD / min | — |
kokoro-tts | hexgrad (via DeepInfra) | Synthèse vocale texte → audio, 8 langues | Audio (TTS) | ~20 MAD / M caractères | — |
flux-2-klein-4b | Black Forest Labs (via DeepInfra) | Génération d'images texte → image, max 4/requête, 1024×1024 max | Image | ~0,30 MAD / image | — |
Les prix sont convertis au taux de change du moment et affichés en dirhams arrondis dans le tableau de bord. Le taux appliqué est mis à jour quotidiennement.
Disponibilité par plan
| Modèle | Starter (99 MAD) | Dev (199 MAD) | Pro (399 MAD) | Recharge Boost |
|---|---|---|---|---|
glm-4.7-flash | Oui | Oui | Oui | Oui |
deepseek-v4-flash | Oui | Oui | Oui | Oui |
hy3 | Oui | Oui | Oui | Oui |
glm-4.7 | Oui | Oui | Oui | Oui |
minimax-m3 | Non | Oui | Oui | Oui |
mimo-v2.5 | Non | Oui | Oui | Oui |
kimi-k2.6 | Non | Oui | Oui | Oui |
glm-5.2 | Non | Oui | Oui | Oui |
deepseek-v4-pro | Non | Non | Oui | Oui |
qwen3.7-max | Non | Non | Oui | Oui |
bge-m3 | Oui | Oui | Oui | Oui |
qwen3-embedding-8b | Oui | Oui | Oui | Oui |
qwen3-reranker-8b | Oui | Oui | Oui | Oui |
whisper-large-v3 | Non | Non | Non | Oui |
kokoro-tts | Non | Non | Non | Oui |
flux-2-klein-4b | Non | Non | Non | Oui |
Notes
- Les identifiants de modèles (
model_id) sont stables — ce sont ceux à utiliser dans vos configs d'outils. - Le plan Starter est conçu pour les étudiants et l'exploration ; les modèles de coding avancés requièrent le plan Dev minimum.
- Le mode Recharge Boost (pay-as-you-go) donne accès à tous les modèles depuis un solde de crédits prépayés, sans abonnement.
- Les prix en MAD/M tokens seront mis à jour à chaque changement tarifaire des providers sources. Suivez @velqa_dev pour les annonces.
