Modèles & pricing
Facturation en crédits prépayés (€). Les comptes démarrent à 0 € : contactez-nous pour créditer votre wallet. Prix au million (M) de tokens. Grille indicative, susceptible d’évoluer.
Conversation
Section intitulée « Conversation »| Modèle | model (API) | Souverain | Images | Contexte | Entrée | Sortie |
|---|---|---|---|---|---|---|
| Ministral 3 (3B) | ministral | ✅ | — | 131k | 0,132 €/M | 0,132 €/M |
| Mistral Small 4 | mistral-small | ✅ | ✅ | 262k | 0,132 €/M | 0,396 €/M |
| GPT-OSS 120B | gpt-oss | ✅ | — | 131k | 0,18 €/M | 0,72 €/M |
| Ministral 3 (8B) | ministral-8b | ✅ | ✅ | 262k | 0,198 €/M | 0,198 €/M |
| Ministral 3 (14B) | ministral-14b | ✅ | ✅ | 262k | 0,264 €/M | 0,264 €/M |
| Gemma 4 26B | gemma | ✅ | ✅ | 262k | 0,30 €/M | 0,60 €/M |
| Qwen3.6 35B | qwen-small | ✅ | ✅ | 262k | 0,30 €/M | 1,80 €/M |
| Mistral Large 3 | mistral-large | ✅ | ✅ | 262k | 0,66 €/M | 1,98 €/M |
| Qwen3.5 397B | qwen-large | ✅ | ✅ | 250k | 0,72 €/M | 4,32 €/M |
| Mistral Medium 3.5 | mistral-medium | ✅ | ✅ | 262k | 1,98 €/M | 9,90 €/M |
| Modèle | model (API) | Souverain | Images | Contexte | Entrée | Sortie |
|---|---|---|---|---|---|---|
| Codestral | codestral | ✅ | — | 256k | 0,396 €/M | 1,188 €/M |
| Devstral 2 | devstral | ✅ | — | 262k | 0,528 €/M | 2,64 €/M |
Embeddings
Section intitulée « Embeddings »| Modèle | model (API) | Souverain | Dimensions | Entrée | Sortie |
|---|---|---|---|---|---|
| Mistral Embed | mistral-embed | ✅ | 1024 | 0,132 €/M | — |
| Qwen3 Embed | qwen-embed | ✅ | 1024 | 0,120 €/M | — |
| Codestral Embed | codestral-embed | ✅ | 1536 | 0,198 €/M | — |
mistral-small est le modèle par défaut et couvre la grande majorité des usages.
ministral est le plus économique, bon pour la classification et le routage ; ses
variantes 8B et 14B offrent le double de contexte pour quelques centimes de plus.
mistral-medium raisonne le mieux et mistral-large tient les longs enchaînements
d’outils, mais il répond nettement plus lentement : réservez-le aux traitements différés.
gpt-oss, gemma, qwen-small et qwen-large sont des modèles à poids ouverts
servis depuis nos propres serveurs à Paris. gpt-oss et gemma sont les moins chers
du catalogue en sortie ; qwen-small est taillé pour les enchaînements d’outils à
faible coût ; qwen-large est le plus capable des quatre. Tous les quatre
raisonnent avant de répondre, ce qui améliore les réponses difficiles mais
consomme des tokens de sortie : voyez l’encadré ci-dessous si vous voulez couper.
Catalogue via l’API
Section intitulée « Catalogue via l’API »La liste des modèles disponibles et leur grille tarifaire sont exposées publiquement (sans clé API) :
curl https://api.miraca.fr/v1/pricing(La liste « brute » compatible OpenAI reste disponible sur GET /v1/models, sans la grille tarifaire.)
{ "object": "list", "data": [ { "id": "mistral-small", "name": "Mistral Small 4", "mode": "chat", "sovereign": true, "vision": true, "quality": 3, "agentic": 3, "reasoning_efforts": ["none", "high"], "context_max": 262144, "pricing": { "currency": "EUR", "input_per_million_tokens": 0.132, "output_per_million_tokens": 0.396 } }, { "id": "mistral-embed", "name": "Mistral Embed", "mode": "embedding", "sovereign": true, "vision": false, "quality": null, "agentic": null, "reasoning_efforts": [], "context_max": 8192, "pricing": { "currency": "EUR", "input_per_million_tokens": 0.132, "output_per_million_tokens": null } } ]}id: la valeur à passer dans le champmodelde vos requêtes.mode:chatouembedding(pourembedding,output_per_million_tokensvautnull).sovereign:true= inférence traitée dans l’UE, sous notre maîtrise (tout le catalogue actuel) ;false= passthrough hors UE (opt-in par requête).vision: le modèle sait lire des images jointes à un message. Établi en testant chaque modèle, pas recopié d’une documentation : plusieurs backends acceptent une image sans la regarder et répondent au hasard.quality: note de 1 à 5 issue de notre banc d’essai (dix questions agentiques sur une base de connaissance, avec outils).null= non évalué, ce qui ne veut pas dire mauvais. Ce n’est pas un score de benchmark public : il mesure ce que cette plateforme demande, chercher et croiser sans inventer.agentic: note de 1 à 5 sur l’enchaînement d’outils — savoir chercher, croiser, et exploiter le résultat d’une recherche plutôt que répondre de mémoire. Distincte dequality: un modèle peut donner de bonnes réponses et mal se conduire en agent.reasoning_efforts: niveaux acceptés par le paramètrereasoning_effort. Liste vide = ce modèle n’a pas de réglage de raisonnement, et le lui envoyer vaut 400.pricing: prix en € par million de tokens, tels qu’ils sont décomptés de vos crédits.
Le
GET /v1/modelsde l’API OpenAI-compatible (api.miraca.fr) reste disponible avec votre clé, mais ne renvoie que les identifiants — sans prix.