Aller au contenu

Modèles & pricing

Facturation en crédits prépayés (€). Les comptes démarrent à 0 € : contactez-nous pour créditer votre wallet. Prix au million (M) de tokens. Grille indicative, susceptible d’évoluer.

Modèlemodel (API)SouverainImagesContexteEntréeSortie
Ministral 3 (3B)ministral131k0,132 €/M0,132 €/M
Mistral Small 4mistral-small262k0,132 €/M0,396 €/M
GPT-OSS 120Bgpt-oss131k0,18 €/M0,72 €/M
Ministral 3 (8B)ministral-8b262k0,198 €/M0,198 €/M
Ministral 3 (14B)ministral-14b262k0,264 €/M0,264 €/M
Gemma 4 26Bgemma262k0,30 €/M0,60 €/M
Qwen3.6 35Bqwen-small262k0,30 €/M1,80 €/M
Mistral Large 3mistral-large262k0,66 €/M1,98 €/M
Qwen3.5 397Bqwen-large250k0,72 €/M4,32 €/M
Mistral Medium 3.5mistral-medium262k1,98 €/M9,90 €/M
Modèlemodel (API)SouverainImagesContexteEntréeSortie
Codestralcodestral256k0,396 €/M1,188 €/M
Devstral 2devstral262k0,528 €/M2,64 €/M
Modèlemodel (API)SouverainDimensionsEntréeSortie
Mistral Embedmistral-embed10240,132 €/M
Qwen3 Embedqwen-embed10240,120 €/M
Codestral Embedcodestral-embed15360,198 €/M

mistral-small est le modèle par défaut et couvre la grande majorité des usages. ministral est le plus économique, bon pour la classification et le routage ; ses variantes 8B et 14B offrent le double de contexte pour quelques centimes de plus. mistral-medium raisonne le mieux et mistral-large tient les longs enchaînements d’outils, mais il répond nettement plus lentement : réservez-le aux traitements différés.

gpt-oss, gemma, qwen-small et qwen-large sont des modèles à poids ouverts servis depuis nos propres serveurs à Paris. gpt-oss et gemma sont les moins chers du catalogue en sortie ; qwen-small est taillé pour les enchaînements d’outils à faible coût ; qwen-large est le plus capable des quatre. Tous les quatre raisonnent avant de répondre, ce qui améliore les réponses difficiles mais consomme des tokens de sortie : voyez l’encadré ci-dessous si vous voulez couper.

La liste des modèles disponibles et leur grille tarifaire sont exposées publiquement (sans clé API) :

Fenêtre de terminal
curl https://api.miraca.fr/v1/pricing

(La liste « brute » compatible OpenAI reste disponible sur GET /v1/models, sans la grille tarifaire.)

{
"object": "list",
"data": [
{
"id": "mistral-small",
"name": "Mistral Small 4",
"mode": "chat",
"sovereign": true,
"vision": true,
"quality": 3,
"agentic": 3,
"reasoning_efforts": ["none", "high"],
"context_max": 262144,
"pricing": {
"currency": "EUR",
"input_per_million_tokens": 0.132,
"output_per_million_tokens": 0.396
}
},
{
"id": "mistral-embed",
"name": "Mistral Embed",
"mode": "embedding",
"sovereign": true,
"vision": false,
"quality": null,
"agentic": null,
"reasoning_efforts": [],
"context_max": 8192,
"pricing": {
"currency": "EUR",
"input_per_million_tokens": 0.132,
"output_per_million_tokens": null
}
}
]
}
  • id : la valeur à passer dans le champ model de vos requêtes.
  • mode : chat ou embedding (pour embedding, output_per_million_tokens vaut null).
  • sovereign : true = inférence traitée dans l’UE, sous notre maîtrise (tout le catalogue actuel) ; false = passthrough hors UE (opt-in par requête).
  • vision : le modèle sait lire des images jointes à un message. Établi en testant chaque modèle, pas recopié d’une documentation : plusieurs backends acceptent une image sans la regarder et répondent au hasard.
  • quality : note de 1 à 5 issue de notre banc d’essai (dix questions agentiques sur une base de connaissance, avec outils). null = non évalué, ce qui ne veut pas dire mauvais. Ce n’est pas un score de benchmark public : il mesure ce que cette plateforme demande, chercher et croiser sans inventer.
  • agentic : note de 1 à 5 sur l’enchaînement d’outils — savoir chercher, croiser, et exploiter le résultat d’une recherche plutôt que répondre de mémoire. Distincte de quality : un modèle peut donner de bonnes réponses et mal se conduire en agent.
  • reasoning_efforts : niveaux acceptés par le paramètre reasoning_effort. Liste vide = ce modèle n’a pas de réglage de raisonnement, et le lui envoyer vaut 400.
  • pricing : prix en € par million de tokens, tels qu’ils sont décomptés de vos crédits.

Le GET /v1/models de l’API OpenAI-compatible (api.miraca.fr) reste disponible avec votre clé, mais ne renvoie que les identifiants — sans prix.