Vous voulez un assistant qui répond à vos équipes à partir de vos documents, ou un agent qui va chercher lui-même les informations dans votre ERP et votre CRM. La question du coût d’un agent IA arrive alors vite, mais les réponses disponibles sont rarement utiles. Les guides américains annoncent en effet des fourchettes de 5 000 à 500 000 dollars. Les éditeurs affichent quant à eux un prix par utilisateur qui ne dit rien du travail d’intégration. Enfin, les démonstrations en ligne laissent croire qu’un agent se monte en un après-midi.
Chez Playmoweb, nous concevons des applications mobiles, web, IoT et IA à Angers depuis plus de 12 ans. Nous avons d’ailleurs publié en août 2026 le retour d’expérience d’un assistant IA connecté à un ERP via un serveur MCP. Ce guide donne des repères en euros pour une PME ou une ETI française, à partir de cette expérience. Vous y trouverez d’abord les trois niveaux d’agent et les postes de coût. Nous calculons ensuite le coût des tokens sur un exemple, avec les tarifs publics de septembre 2026. Le guide s’achève sur les coûts cachés que les devis oublient.
Sommaire
Le mot « agent » est utilisé pour tout et n’importe quoi, d’où une grande partie de l’écart entre les devis. En réalité, trois objets différents se cachent derrière le même terme.
Un chatbot répond à des questions à partir de ce qu’il sait ou de ce qu’on lui donne à lire, sans toucher à votre système d’information. Une automatisation (un scénario Make ou n8n, un script) enchaîne plutôt des actions prédéfinies et s’arrête au premier cas imprévu.
Un agent IA, enfin, combine les deux : un modèle de langage qui comprend une demande, décide quels outils appeler (lire une fiche client, interroger le stock, créer un devis), interprète les résultats et enchaîne jusqu’à atteindre l’objectif. Cette capacité de décision fait sa valeur, mais c’est aussi elle qui coûte. Il faut en effet connecter les outils, encadrer les droits de l’agent et vérifier qu’il agit correctement. Pour cela, le protocole MCP s’est imposé comme la manière standard de brancher un agent sur vos outils métier.
Nous découpons les projets d’agent IA en trois niveaux, selon la question posée à l’agent : « que disent nos documents ? », « que dit notre outil métier ? » ou « fais-le pour moi ».
Niveau 1, l’assistant documentaire. L’agent répond à partir de vos documents (procédures, contrats, fiches produits) grâce à une technique appelée RAG. Concrètement, il retrouve les passages pertinents puis rédige une réponse sourcée. Puisqu’il n’écrit rien dans le système d’information, le risque reste limité.
Niveau 2, l’agent connecté à un outil métier. L’agent interroge en direct votre ERP ou votre CRM via un serveur MCP. Il dispose de droits en lecture, et parfois aussi de quelques actions ciblées. C’est le cas de notre assistant connecté à l’ERP EBP. Grâce à lui, un commercial demande où en est la commande d’un client et obtient la réponse sans ouvrir l’ERP.
Niveau 3, l’agent multi-outils qui agit. L’agent combine ici plusieurs sources et plusieurs actions. Par exemple, il lit un mail, vérifie le stock, prépare un devis dans l’ERP et le soumet à validation. Mais chaque outil supplémentaire multiplie les cas à tester et les autorisations à encadrer.
Voici les ordres de grandeur que nous observons en 2026 pour une PME ou une ETI (équipe de développement expérimentée) :
| Niveau | Budget de lancement | Coût mensuel d’exploitation | Délai |
|---|---|---|---|
| Assistant documentaire (RAG) | 15 à 40 k€ | Quelques centaines d’euros | 4 à 8 semaines |
| Agent connecté à un outil métier (ERP, CRM via MCP) | 40 à 100 k€ | De quelques centaines à un ou deux milliers d’euros | 2 à 4 mois |
| Agent multi-outils qui agit | 100 k€ et plus | De un à plusieurs milliers d’euros | 4 mois et plus |
Important : ces fourchettes couvrent le cadrage, la conception, le développement, l’évaluation et la mise en production. Elles excluent en revanche la remise en état de vos données, les licences des outils interrogés et l’accompagnement au changement. Pour situer ces montants, un agent de niveau 2 coûte à lancer à peu près autant qu’une application métier mobile de complexité moyenne.
Un devis d’agent IA sérieux se lit poste par poste, d’autant que certains pèsent plus que prévu.
Le cadrage. Il s’agit de choisir le cas d’usage et de définir les droits de l’agent. Il faut également identifier les données nécessaires et les utilisateurs pilotes. C’est le poste le moins cher, et pourtant le plus rentable. En effet, un cas d’usage mal choisi produit un agent que personne n’utilise.
La connexion aux données et aux outils. Pour un assistant documentaire, il s’agit de collecter, découper et indexer les documents. En revanche, pour un agent connecté, il faut développer le serveur MCP qui expose votre ERP ou votre CRM. Il faut aussi gérer les droits d’accès. Sur un niveau 2, ce poste est d’ailleurs souvent le plus lourd du budget. Un ERP a en effet rarement une API propre, complète et documentée.
Le développement de l’agent. Ce poste comprend les instructions (le « prompt système »), l’orchestration et l’interface (Teams, Slack, intranet ou application dédiée). Il inclut enfin la journalisation de ce que fait l’agent.
L’évaluation et les tests. C’est le poste que les devis oublient, mais que nous refusons de réduire. Un agent ne se teste pas comme un logiciel classique. Il faut d’abord un jeu de questions représentatives avec les réponses attendues. Il faut ensuite mesurer le taux de réponses correctes, puis recommencer après chaque modification. Comptez donc 10 à 20 % du budget de développement sur un agent de niveau 2 ou 3.
L’hébergement. Il couvre l’infrastructure de l’agent, la base de recherche documentaire et les serveurs MCP. Pour la plupart des PME, ce coût reste toutefois modeste face aux tokens.
Le coût des tokens à l’usage. Chaque question est facturée par le fournisseur du modèle selon le volume de texte lu et produit. Ce poste est nul au lancement, puis il croît avec l’adoption : nous le détaillons ci-dessous.
La maintenance. Les modèles évoluent tous les quelques mois, vos outils changent de version et les documents se périment. Comme pour une application, prévoyez donc 15 à 25 % du coût initial par an.
Les fournisseurs facturent au million de tokens (un token correspond à environ trois quarts de mot). Par ailleurs, le texte lu par le modèle (« input ») coûte moins cher que le texte produit (« output »). Voici les tarifs publics mi-septembre 2026 des trois fournisseurs les plus courants chez nos clients :
| Modèle | Input (par million de tokens) | Output (par million de tokens) |
|---|---|---|
| Mistral Small 4 | 0,15 $ | 0,60 $ |
| Mistral Large 3 | 0,50 $ | 1,50 $ |
| Mistral Medium 3.5 | 1,50 $ | 7,50 $ |
| OpenAI GPT-5.6 Luna | 0,20 $ | 1,20 $ |
| OpenAI GPT-5.6 Terra | 2,00 $ | 12,00 $ |
| Anthropic Claude Haiku 4.5 | 1,00 $ | 5,00 $ |
| Anthropic Claude Sonnet 5 | 2,00 $ | 10,00 $ |
| Anthropic Claude Opus 5 | 5,00 $ | 25,00 $ |
Prix en dollars, à revérifier avant de figer votre budget, car ils changent régulièrement.
Prenons un agent de niveau 2 déployé auprès de 50 collaborateurs qui posent chacun 20 questions par jour ouvré, soit environ 22 000 requêtes par mois. Chaque requête envoie environ 6 000 tokens au modèle (instructions, résultats de l’ERP, historique de la conversation) et en produit 500. Cela représente au total 132 millions de tokens en entrée et 11 millions en sortie par mois.
Avec Claude Sonnet 5, la facture mensuelle ressort à environ 374 $ (264 $ d’input et 110 $ d’output). GPT-5.6 Terra revient à environ 396 $, tandis que Mistral Medium 3.5 ressort à environ 280 $. Mistral Large 3 descend même à environ 83 $. Un petit modèle comme Mistral Small 4 ou GPT-5.6 Luna coûte moins de 40 $. Pour un même usage, l’écart entre les extrêmes de ce tableau dépasse donc un facteur 10.
Un agent de niveau 3 change d’échelle, car chaque tâche enchaîne plusieurs appels d’outils. Il renvoie en outre à chaque étape tout le contexte accumulé. Prenons 200 tâches par jour, chacune à 40 000 tokens d’entrée et 3 000 de sortie. On atteint dans ce cas 176 millions de tokens d’entrée et 13 millions de sortie par mois. La facture ressort ainsi à environ 484 $ avec Claude Sonnet 5, et à environ 1 210 $ avec Claude Opus 5. Le cache des fournisseurs permet de réduire ces montants. Chez Anthropic comme chez OpenAI, le contexte répété est alors facturé 10 % du prix d’entrée. Ce levier suppose toutefois d’avoir prévu le cache dans l’architecture.
Les postes ci-dessus figurent dans un devis correct. Les suivants, à l’inverse, n’y figurent presque jamais. Ce sont pourtant eux qui font déraper les projets.
Trois leviers font pourtant baisser le coût d’un agent IA sans en dégrader la valeur.
Notre offre de développement IA commence d’ailleurs toujours par un cadrage qui chiffre ces trois choix avant d’engager le développement.
Avant de demander un devis d’agent IA, posez-vous ces six questions :
Si vous hésitez, un cadrage de quelques jours permet de chiffrer le projet et de choisir le bon niveau. Il évite également les deux erreurs les plus fréquentes : viser trop large, ou sous-estimer la connexion aux données.
Vous avez un projet d’agent IA ? Contactez-nous pour un échange gratuit et sans engagement : nous vous dirons en toute transparence quel niveau d’agent correspond à votre besoin et ce qu’il coûte. 👉 playmoweb.com/nous-contacter