Aller au contenu principal
Velqa

Transcription audio (Speech-to-Text) avec Velqa.dev

Velqa propose la transcription audio via whisper-large-v3 (multilingue, fort en français / arabe / darija), sur l'API OpenAI-compatible https://api.velqa.dev/v1/audio/transcriptions. Idéal pour transcrire des réunions, des notes vocales ou des appels clients.

Tarification et accès

Contrairement aux modèles de chat et d'embeddings, l'audio est facturé à la minute et non aux tokens, via le solde Recharge Boost (crédit prépayé) — il n'est inclus dans aucun forfait Starter/Dev/Pro.

  • Prix indicatif : ~0,10 MAD / minute
  • Accès : tout compte disposant d'un solde Boost positif
  • Durée max par fichier : 10 minutes
  • Le prix exact facturé dépend de la durée réelle du fichier (arrondie), affichée dans l'historique d'usage du tableau de bord.

Si le solde Boost est insuffisant pour couvrir la durée maximale réservée, la requête est refusée (HTTP 402) avant même l'envoi au modèle.

Exemple avec curl

curl https://api.velqa.dev/v1/audio/transcriptions \
  -H "Authorization: Bearer $VELQA_API_KEY" \
  -F file=@reunion.mp3 \
  -F model=whisper-large-v3

Exemple avec Python

from openai import OpenAI

client = OpenAI(base_url="https://api.velqa.dev/v1", api_key="VELQA_API_KEY")
with open("reunion.mp3", "rb") as f:
    tr = client.audio.transcriptions.create(model="whisper-large-v3", file=f)
print(tr.text)

La réponse contient text, le texte transcrit. Le coût réel (basé sur la durée du fichier) est débité de votre solde Boost.