
Vous voulez intégrer de l’IA dans vos outils, mais deux questions bloquent : combien ça va coûter chaque mois, et où partent vos données ? La gamme 2026 de Mistral AI répond aux deux, à condition de choisir le bon modèle. Voici ma grille de choix, les prix réels et les limites à connaître avant de vous lancer.
En bref : Mistral Small 4, sorti le 16 mars 2026, est un modèle ouvert sous licence Apache 2.0 : 119 milliards de paramètres dont environ 6 actifs, un contexte de 256 000 tokens et un prix API de 0,15 $ par million de tokens en entrée et 0,60 $ en sortie. Il réunit raisonnement, lecture d’images et code. Mistral Medium 3.5, sorti le 22 mai 2026, est le modèle phare : 128 milliards de paramètres, poids ouverts, 1,50 $ en entrée et 7,50 $ en sortie. Comme ces modèles sont téléchargeables, une PME peut les faire tourner chez un hébergeur européen comme Infomaniak ou sur son propre serveur : aucune donnée ne sort. Pour la plupart des usages PME, Small 4 suffit.

La gamme Mistral en juillet 2026 : qui fait quoi ?
Mistral propose aujourd’hui une quinzaine de modèles. Pour une PME, cinq comptent vraiment. Les prix sont exprimés par million de tokens (un token est un fragment de mot), en entrée puis en sortie.
- Small 4 (mars 2026) : le polyvalent, rapide et peu cher, à 0,15 $ / 0,60 $. Licence Apache 2.0.
- Medium 3.5 (mai 2026) : le plus performant, pour les agents et les tâches complexes, à 1,50 $ / 7,50 $. Il atteint 77,6 % sur le test de code SWE-Bench Verified.
- Large 3 (décembre 2025) : un grand modèle ouvert de 675 milliards de paramètres, à 0,50 $ / 1,50 $.
- Ministral 3 (3B, 8B, 14B) : des petits modèles pour tourner sur un serveur modeste. Ministral 8B coûte 0,15 $ en entrée comme en sortie.
- OCR 4 (juin 2026) : la lecture de documents scannés, à 4 $ les 1 000 pages.
Small 4 simplifie la vie : il fusionne trois anciens modèles spécialisés, Magistral pour le raisonnement, Pixtral pour les images et Devstral pour le code. Un seul modèle à brancher au lieu de trois, et donc moins de réglages à maintenir dans vos automatisations.
Pourquoi un modèle ouvert protège mieux vos données
Un modèle « open-weight » (dont les poids sont publiés) peut être téléchargé et installé ailleurs que chez son éditeur. Small 4, Large 3 et Ministral 3 sont sous licence Apache 2.0 : usage commercial libre. Medium 3.5 publie aussi ses poids, sous une licence MIT modifiée.
Conséquence directe : vous choisissez où tourne l’IA. Trois options s’offrent à une PME.
- L’API de Mistral, éditeur français : le plus simple, facturé à l’usage.
- Un hébergeur européen : Infomaniak AI Services propose Mistral-Small-4-119B à 0,20 CHF / 0,75 CHF par million de tokens, traité en Suisse, avec une API compatible OpenAI.
- Votre propre serveur ou un cloud privé : aucune donnée ne sort de votre périmètre.
Avec un modèle fermé, seule la première option existe, chez l’éditeur ou ses partenaires cloud. Un modèle ouvert est donc aussi une protection concrète contre le vendor lock-in : si les prix ou les conditions changent, vous emportez le modèle ailleurs, sans reconstruire vos outils.
Quel modèle Mistral pour quel usage en PME ?
- Répondre aux clients, trier des e-mails, classer des demandes : Small 4.
- Extraire les données de factures ou de bons de livraison scannés : OCR 4, puis Small 4 pour structurer le résultat.
- Agents qui enchaînent plusieurs outils (CRM, devis, relances) : Medium 3.5.
- Assistant interne sur un petit serveur, sans connexion extérieure : Ministral 3 en 14B ou 8B.
- Analyse de documents volumineux : Small 4, grâce à son contexte de 256 000 tokens, ou Medium 3.5 si le raisonnement est complexe.
Ma règle sur mes projets : je démarre avec Small 4 et je ne monte en gamme que si les résultats ne tiennent pas sur des cas réels. Le plus souvent, Small 4 suffit. Quand il bloque, c’est en général sur des tâches à plusieurs étapes, et Medium 3.5 prend le relais.

Coût réel : Mistral face à Claude
Prenons un agent de support client qui traite 10 millions de tokens en entrée et 2 millions en sortie par mois, un volume courant pour quelques milliers d’échanges. Voici la facture API mensuelle, hors taxes :
- Mistral Small 4 : environ 2,70 $.
- Claude Haiku 4.5 (1 $ / 5 $) : environ 20 $.
- Mistral Medium 3.5 : environ 30 $.
- Claude Sonnet 5 (2 $ / 10 $) : environ 40 $.
Sur Small 4, l’écart est net : près de quinze fois moins cher que Sonnet 5. Mistral propose aussi un traitement par lots à −50 % et un cache d’entrée jusqu’à −90 % pour les textes répétés. À ce niveau de prix, le coût de l’IA devient marginal. Ce qui pèse dans le budget, c’est le temps de mise en place et de suivi.
Soyons honnêtes : les modèles de Claude restent une référence pour les tâches les plus exigeantes, notamment la rédaction nuancée. Mais pour les usages courants d’une PME, payer dix fois plus ne se justifie pas toujours. Testez les deux sur vos propres cas avant de trancher.
Les limites à connaître avant de choisir
- Auto-héberger n’est pas gratuit : il faut un serveur avec GPU, des mises à jour et une surveillance. Pour une PME, un hébergeur comme Infomaniak est souvent le bon compromis.
- Attention aux clouds américains : les modèles Mistral sont aussi proposés sur AWS Bedrock ou Azure. Dans ce cas, c’est l’hébergeur américain qui traite vos données.
- Lisez la licence de Medium 3.5 : la licence MIT modifiée impose de vérifier les conditions avant un usage commercial auto-hébergé.
- Les tests publiés ne remplacent pas vos cas réels : évaluez le modèle sur 20 à 30 exemples tirés de votre activité.
Mise en garde : un modèle bon marché qui se trompe une fois sur dix coûte plus cher qu’un modèle premium, dès qu’un humain doit tout revérifier. Mesurez la qualité avant de comparer les prix.
Comment je l’utilise sur mes projets
Un cabinet de 8 personnes reçoit ses factures fournisseurs en PDF. OCR 4 lit les documents, Small 4 extrait le fournisseur, le montant et l’échéance, et un workflow n8n remplit la base comptable. Pour quelques centaines de factures par mois, le coût de l’IA se compte en dollars.
Une production TV voulait un assistant interne sur ses documents d’émission, sans qu’ils quittent l’Europe. Small 4 via Infomaniak AI Services, branché sur une app métier, répond aux questions de l’équipe en citant ses sources.
Une agence événementielle de 12 personnes utilise Medium 3.5 pour un agent de relance de devis : il consulte le CRM, rédige la relance et la propose au commercial avant envoi. Le modèle plus puissant se justifie ici, car l’agent enchaîne plusieurs outils.
J’explique plus en détail pourquoi je m’appuie sur Mistral pour ce type de projet dans Mistral : développer des agents IA.
À lire aussi
- Le Chat devient Vibe : agents et Work mode chez Mistral
- Mistral AI dévoile son OCR
- Déployer n8n chez Infomaniak pour 10 CHF par mois
Vous voulez savoir quel modèle convient à vos volumes et à vos données ? Parlons-en 30 minutes, sans engagement : je vous fais une estimation de coût à partir de vos cas réels.
Questions fréquentes
Mistral Small 4 est-il vraiment open source ?
Ses poids sont publiés sous licence Apache 2.0, qui autorise l’usage commercial sans redevance. Vous pouvez donc le télécharger et le faire tourner où vous voulez. Ce n’est pas gratuit pour autant : il faut payer l’hébergement, ou l’API de Mistral à 0,15 $ par million de tokens en entrée et 0,60 $ en sortie.
Quelle différence entre Mistral Small 4 et Medium 3.5 ?
Small 4 est un modèle rapide et économique, qui réunit raisonnement, images et code, idéal pour le tri, les réponses et l’extraction. Medium 3.5 est le modèle phare de Mistral, dix fois plus cher, pensé pour les agents qui enchaînent plusieurs outils et les tâches complexes. Commencez par Small 4, montez en gamme si nécessaire.
Peut-on utiliser Mistral Small 4 sans envoyer ses données à Mistral ?
Oui. Comme ses poids sont ouverts, vous pouvez l’utiliser via Infomaniak AI Services, où le traitement a lieu en Suisse, pour 0,20 CHF en entrée et 0,75 CHF en sortie par million de tokens. Vous pouvez aussi l’installer sur votre propre serveur : dans ce cas, aucune donnée ne quitte votre périmètre.
Mistral est-il moins cher que Claude ?
Sur les modèles comparables, oui. Pour un agent qui traite 10 millions de tokens en entrée et 2 millions en sortie par mois, comptez environ 2,70 $ avec Small 4, contre 20 $ avec Claude Haiku 4.5 et 40 $ avec Claude Sonnet 5. Le choix doit tout de même se faire sur la qualité mesurée sur vos cas.
Faut-il un développeur pour utiliser Mistral Small 4 ?
Pas nécessairement. Vous pouvez l’utiliser via l’assistant Mistral Vibe, ou le brancher dans un outil d’automatisation comme n8n avec une simple clé API, y compris chez Infomaniak dont l’API est compatible OpenAI. Un accompagnement reste utile pour cadrer les usages, écrire les consignes et mesurer la qualité des réponses.
Sources
- Mistral AI — Mistral Small 4, 16 mars 2026
- Mistral AI — Mistral Medium 3.5, 22 mai 2026
- Mistral AI — Mistral 3 (Large 3 et Ministral 3), 2 décembre 2025
- Mistral AI Docs — OCR 4, juin 2026
- Infomaniak — Tarifs AI Services, relevé du 22 septembre 2026
- Anthropic — Tarifs API Claude, relevé du 22 septembre 2026













