Le modèle velqa-auto — routage automatique du chat selon votre offre
velqa-auto est un ID de modèle virtuel : envoyez "model": "velqa-auto" et Velqa route automatiquement votre requête de chat vers un modèle adapté, à l'aide d'un classifieur heuristique. C'est le bon choix par défaut quand vous ne voulez pas choisir un modèle à la main. Comme tout le reste, c'est payable en dirhams.
Comment ça marche
- Velqa analyse votre requête (nature de la tâche, longueur…) et sélectionne un modèle approprié parmi ceux disponibles.
- Le routage respecte votre offre :
velqa-autone choisira jamais un modèle que votre plan n'inclut pas. Un utilisateur Starter est routé parmi les modèles Starter ; un utilisateur Pro ou Recharge Boost a accès à l'ensemble. - C'est uniquement pour le chat (
/v1/chat/completions). Il n'y a pas d'auto-routage pour les embeddings, l'audio ou les images — indiquez un ID de modèle explicite pour ceux-ci.
Exemple (Python)
from openai import OpenAI
client = OpenAI(base_url="https://api.velqa.dev/v1", api_key="sk-...")
resp = client.chat.completions.create(
model="velqa-auto",
messages=[{"role": "user", "content": "Résume ce texte en 3 points."}],
)
print(resp.choices[0].message.content)Exemple (curl)
curl https://api.velqa.dev/v1/chat/completions \
-H "Authorization: Bearer sk-..." \
-H "Content-Type: application/json" \
-d '{"model":"velqa-auto","messages":[{"role":"user","content":"Bonjour"}]}'Quand l'utiliser
- Utilisez `velqa-auto` pour des applications généralistes, des prototypes, ou quand vos requêtes sont hétérogènes et que vous voulez un bon compromis coût/qualité sans gérer la sélection.
- Indiquez un modèle explicite quand vous avez besoin d'un comportement reproductible, d'un modèle précis pour du coding lourd, ou d'une fenêtre de contexte particulière. Voir la liste des modèles.
Voir aussi : aperçu du chat.
