Agent IA pour PME: budget setup, run et pièges
Combien coûte un agent IA en PME ? Les fourchettes de setup et de run, le vrai coût du HITL, et ce qu'il faut cadrer avant de signer un devis.

Agent IA PME: ce que tu paies vraiment
Un agent IA pour une PME ne se paie pas comme un abonnement SaaS unique. La facture se répartit sur trois couches:
- Le setup: le cadrage, le build, les connecteurs et les garde-fous
- Le run: les modèles, l'hébergement et les outils
- Le pilotage humain: la validation (HITL), les incidents et les améliorations
Si un prestataire ne te montre que le prix du setup, regarde le run. S'il ne te montre que le run, regarde le setup et demande qui sera l'owner métier. Tant que les trois couches ne sont pas posées, le devis reste un teaser.
Pour donner des ordres de grandeur, voici les fourchettes kengdev (HT, France, 2026):
| Prestation | À partir de |
|---|---|
| Audit | 1 500 € |
| Agent / automatisation | 4 000 € |
| Hermès (offre packagée) | 3 500 € de setup |
Le détail dépend ensuite des outils à connecter et du niveau de risque du flux.
Setup: où part l'argent
Le setup se découpe en trois phases, et chacune a son poste de dépense:
- Le cadrage fixe la friction visée, le KPI, l'allowlist d'actions et les données autorisées. Sans lui, le build part dans le vide.
- Le build couvre les prompts et les skills, les outils (CRM, mail, Drive), les tests, et une interface de validation si besoin.
- La mise en prod ajoute les secrets, les logs, les plafonds de tokens et le runbook.
Plus le flux touche au client ou à l'argent, plus la validation humaine et les tests pèsent dans le devis. Et un agent « qui marche en démo » sans monitoring n'est pas en production.
Run: tokens, hébergement, TMA
Le coût en tokens varie beaucoup d'un flux à l'autre. Un flux de qualification simple coûte peu, alors que le multi-agents, le long contexte et les outils en boucle multiplient la facture. Mesure dès la première semaine.
Pour l'hébergement, tu choisis entre une API cloud pure et un VPS européen en self-host. Le self-host type Hermès ajoute l'infra et la maintenance; l'API cloud demande moins d'ops mais crée une dépendance au fournisseur.
La TMA couvre les corrections, les petits ajouts et la surveillance. Prévois un forfait mensuel léger ou un budget de tickets: une TMA à zéro, c'est de la dette silencieuse.
HITL: le coût qu'on oublie
Le human-in-the-loop n'est pas gratuit: quelqu'un lit, valide et corrige les sorties de l'agent. Au démarrage, c'est normal. Mais si 100% des sorties passent encore en revue manuelle au mois 3, le design d'autonomie est faux.
Calibre donc l'autonomie par niveau de risque: les cas verts partent automatiquement, les cas orange attendent en file de validation, et les cas rouges restent interdits à l'agent. Mesure ensuite le temps médian de revue et le pourcentage de corrections.
Sans owner métier, tu as juste un bot qui crée du bruit. Le budget doit inclure ce rôle, même à raison de 2 heures par semaine.
Pièges de devis
Certains signaux doivent te faire ralentir avant de signer:
- Un prix sans KPI associé
- Un « agent intelligent » sans flux borné
- Aucun plafond de tokens
- Aucun plan d'escalade vers un humain
- Une livraison sans handover
- Une comparaison entre prestataires sur le seul setup
À l'inverse, un bon devis liste le process visé, les outils, le HITL, le run estimé et les exclusions.
Méfie-toi enfin des screenshots de leaderboard, des promesses de remplacer un poste entier dès la première semaine, et des offres qui ne mentionnent jamais la revue humaine.
FAQ
- Quel budget minimum pour un agent IA en PME ?
- Chez kengdev, un agent ou une automatisation démarre souvent autour de 4 000 € HT de setup, hors run. Un audit plus léger peut suffire avant de lancer le build.
- Le run tokens est-il prévisible ?
- Oui, dans une fourchette, après une à deux semaines de mesure. Sans plafond ni logs, il ne l'est pas.
- Faut-il un abonnement mensuel ?
- Il n'est pas obligatoire. Beaucoup de PME tiennent avec un setup puis des tickets. Un forfait TMA aide surtout si le process évolue souvent.
- Agent ou simple automatisation n8n ?
- Si le flux est déterministe, un workflow suffit et coûte moins cher. L'agent devient utile quand il faut juger du langage ou d'un contexte variable.
- Combien de temps avant un premier résultat ?
- Un POC utile sort souvent en 3-10 jours sur un flux borné. Il faut ensuite compter 2-6 semaines pour une mise en production propre.
- Lien avec Hermès ?
- Hermès est une offre packagée (setup dès 3 500 €) pour un co-pilote ops. Un agent 100% sur-mesure peut coûter plus cher si le process est large.
Sources et repères
- Pricing
Les tarifs par million de tokens, entrée et sortie comptées séparément. À rouvrir avant chaque estimation, ça bouge.
- API pricing
Le même exercice côté OpenAI. Les écarts entre modèles d'une même famille sont assez larges pour changer ton arbitrage.
- Prompt caching
Le levier le plus direct sur la facture quand un agent renvoie le même contexte à chaque tour de boucle.
Cadrez votre premier agent IA
20 minutes pour vérifier vos outils, vos données et le premier cas utile. Sans jargon, sans engagement.
Comment décider en 20-40 minutes
Une décision propre tient en six points, dans cet ordre:
Si le POC ne tient pas le KPI, on arrête ou on réduit le scope. C'est toujours mieux qu'un tunnel de six mois.
Pour le build détaillé, va voir le guide comment créer un agent IA et l'article human-in-the-loop. Pour l'exploitation, le guide LLMOps prend le relais.
Si vous voulez cadrer un agent sur un process réel, on peut le faire en 20-40 minutes.