Mistral Vibe CLI et Devstral : licence, hébergement et prix d'un agent de code
Mistral Vibe CLI : qu'est-ce que c'est et comment l'installer ?
Mistral Vibe CLI est un agent de code open source, sous licence Apache 2.0. On lui décrit une tâche en langage naturel, il l'exécute dans votre terminal. Il s'installe en une commande, puis se branche sur une clé API.
Mais la licence du CLI ne couvre pas les modèles : c'est là que la souveraineté se joue.
L'installation tient en trois étapes, d'après le dépôt GitHub mistralai/mistral-vibe :
- Installer le CLI. Sur Linux ou macOS :
curl -LsSf https://mistral.ai/vibe/install.sh | bash. Les alternatives sontuv tool install mistral-vibeoupip install mistral-vibe, avec Python 3.12 ou plus. - Fournir la clé API. Trois voies : la commande
vibe --setup, la variableMISTRAL_API_KEYou le fichier~/.vibe/.env. - Régler l'outil. La configuration vit dans
~/.vibe/config.toml, ou dans./.vibe/config.tomlpour un seul projet. Vous lancez ensuite l'assistant en ligne de commande depuis le dossier du projet.
Les principales caractéristiques de Mistral Vibe 2 pour le code
L'agent lit votre base de code et le statut git, puis modifie plusieurs fichiers pour mener une tâche jusqu'au bout. C'est la promesse du codage agentique, et la page produit de Mistral la reprend.
La mise à jour 2.0 de Mistral Vibe, sortie le 2 février 2026 selon le Blog du Modérateur, a notamment ajouté :
- des sous-agents personnalisés ;
- des workflows déclenchés par des slash commands (des commandes courtes tapées après
/) ; - des modes d'agent unifiés.
Pour les développeurs qui vivent dans un IDE, Mistral annonce des extensions pour VS Code, JetBrains et Zed. Elles passent par l'Agent Client Protocol (ACP), un protocole qui relie l'agent à l'éditeur.
Reste l'extension par skills. Une équipe peut écrire ses propres skills (des instructions réutilisables pour une tâche précise) et se constituer une bibliothèque de skills partagée.
Pour un CTO, c'est le levier qui compte le plus. Les conventions de l'équipe s'écrivent une fois, au lieu d'être répétées dans chaque prompt.
L'accès au CLI dépend désormais de l'abonnement : le détail des offres vient plus bas.
Devstral 2 et Devstral Small 2 : deux modèles, deux licences
Mistral a annoncé Vibe CLI en décembre 2025 avec une famille de modèles, Devstral 2. Elle compte deux tailles, et leurs licences n'ont rien à voir.
Devstral Small 2 (24 milliards de paramètres) est sous Apache 2.0, comme le CLI. Vous pouvez l'utiliser, le modifier et le déployer en entreprise sans condition de taille.
Devstral 2 (123 milliards de paramètres) est sous une licence « modified MIT ». Le terme « open source » masque une clause. Si le chiffre d'affaires mensuel consolidé de votre entreprise dépasse 20 millions de dollars, vous perdez tout droit d'usage.
La licence de Devstral 2 sur Hugging Face le dit en toutes lettres. Elle renvoie ces entreprises vers une licence commerciale ou vers les services hébergés de Mistral.
Pour un CTO, « Mistral Vibe est open source » recouvre donc trois situations :
- le CLI, sous Apache 2.0 ;
- Devstral Small 2, sous Apache 2.0 ;
- Devstral 2, ouvert sous condition de revenu.
Côté performance, Mistral publie 72,2 % sur SWE-bench Verified pour Devstral 2, et 68,0 % pour Devstral Small 2. SWE-bench Verified est un banc de tâches de correction tirées de vrais dépôts GitHub.
Ce sont des chiffres de l'éditeur. Je n'en ai lu aucune reproduction indépendante, et je n'ai pas mesuré ces modèles moi-même.
Devstral 2 annonce aussi une fenêtre de contexte de 256 000 tokens : la quantité de code que le modèle lit d'un seul tenant.
Auto-héberger Devstral avec Vibe CLI : matériel et limites
L'auto-hébergement est l'argument souverain par excellence. Le matériel requis tranche vite la question.
Selon Mistral, Devstral 2 exige au minimum quatre GPU de classe H100. Ce n'est pas un poste de développeur, c'est un serveur d'inférence. Devstral Small 2 tourne sur un seul GPU, y compris sur du matériel grand public NVIDIA, et même sur CPU seul.
Pour servir le modèle, la fiche Hugging Face recommande vLLM, un moteur de service de modèles. Ollama et llama.cpp sont pris en charge, avec un avertissement. Si les performances déçoivent en local, le problème se signale au framework concerné.
Héberger le modèle ne suffit pas. Trois réglages décident de ce qui sort de votre réseau :
- La clé API. Le dépôt GitHub demande par défaut une clé Mistral. La documentation présente le compte Mistral comme optionnel. Le CLI accepte aussi des clés compatibles OpenAI, ce qui ouvre la porte à un serveur interne.
- La télémétrie. Elle se coupe avec
enable_telemetry = falsedansconfig.toml. - Le modèle. L'offre Vibe pour le code met aussi en avant Mistral Medium 3.5. Vérifiez lequel tourne avant de parler de souveraineté.
Pour les entreprises, Mistral propose aussi un déploiement en VPC (un réseau cloud privé) ou sur site.
Un outil n'est donc pas souverain par sa licence seule. Il l'est par le modèle, l'hébergement et la télémétrie réunis.
Prix de Mistral Vibe : API et abonnements au 30 septembre 2026
Au 30 septembre 2026, la page tarifs de Mistral affiche :
- Free : gratuit, avec des sessions de code limitées et 10 $ de crédits API par mois ;
- Pro : 14,99 $ par mois, avec 15 $ de crédits API annoncés ;
- Team : 24,99 $ par utilisateur et par mois, plus 50 $ par mois de frais fixes ;
- Enterprise : sur devis.
Côté API, l'annonce de décembre 2025 fixait Devstral 2 à 0,40 $ par million de tokens en entrée. La sortie coûtait 2,00 $ par million de tokens. Devstral Small 2 était annoncé à 0,10 $ et 0,30 $.
Ces prix API datent de l'annonce : je ne les ai pas retrouvés sur la page tarifs actuelle.
Vibe CLI ou Claude Code : quel agent de code IA choisir ?
Je ne classerai pas Vibe CLI face à Claude Code, l'agent de code d'Anthropic. Je n'ai pas de banc de test pour le faire, et un classement sans mesure ne vaut rien.
Je peux en revanche vous donner les trois questions qui départagent, dans l'ordre :
- Quelle licence pour le modèle ? Sous 20 M$ de revenu mensuel, les deux Devstral s'offrent à vous. Au-dessus, seul Devstral Small 2 reste libre d'usage.
- Où tourne-t-il ? Serveur interne, VPC ou API d'un éditeur : c'est ce qui décide où va votre code.
- Combien pour l'équipe ? L'abonnement par siège et le paiement au million de tokens n'ont pas le même point d'équilibre.
Posez-les aussi à Claude Code, à GitHub Copilot ou à tout autre agent de codage IA.
Rien n'oblige à n'en garder qu'un. Ma chaîne de production d'articles tourne avec un orchestrateur : analyse des SERP, recherche, structure, rédaction, fact-check, relecture.
Chaque étape s'exécute dans sa propre session d'agent IA, qui lit les sorties de l'étape précédente. Dans ce schéma, changer d'agent pour une étape ne casse rien. Ce pipeline fait partie des outils IA pour le SEO que j'utilise au quotidien.
Vous cherchez un développeur Java / Spring Boot et Angular qui travaille déjà avec des agents IA ? Je code sur cette stack depuis 2015. Réserver un appel découverte de 30 minutes.