Combien coûte un agent IA (SaaS vs open source)
Sièges, jetons, machine, temps : ce que coûtent un agent SaaS et un runtime open source, avec des tarifs lus chez les éditeurs le 4 septembre 2026.

Dans cet article
- En une phrase
- 1. Quatre postes, pas un tarif
- 2. Le siège : vous payez une personne, pas un agent
- 3. Les jetons : l’agent les brûle à chaque outil
- 4. n8n : le workflow a son propre tarif
- 5. Open source : licence à zéro, facture ailleurs
- 6. Comparer sans se mentir
- Limites de cet article
- Les mots techniques, en clair
- Sources
On vous demande un chiffre. Comme pour une imprimante.
« Un agent IA, ça coûte combien ? » La phrase mélange trois objets : un chat payant par siège, un logiciel qu’on installe, et un modèle facturé au jeton. Aucun n’est l’agent. C’est le mélange qui fait la facture.
Ici : des postes de coût, avec des montants lus sur des pages d’éditeurs le 4 septembre 2026. Pas un devis Kervia. Pas de francs suisses. Les fournisseurs parlent en USD ou en euros ; on les laisse dans leur monnaie.
Si vous hésitez encore entre chat, agent et workflow, lisez d’abord agent, chatbot ou n8n. Ce billet ne refait pas la définition. Il parle d’argent.
En une phrase
Le coût d’un agent IA, pour une PME, c’est la somme de quatre postes : le siège (abonnement), les jetons (API), l’infra (machine où ça tourne), et le temps (installer, relier, relire). L’open source met souvent la licence du runtime à zéro. Il ne paie pas le reste.
1. Quatre postes, pas un tarif
| Poste | SaaS typique | Open source typique | Ce que la page tarif ne dit pas |
|---|---|---|---|
| Siège | Abonnement par personne | Souvent 0 € de licence (MIT) | Qui a le droit de s’en servir, et pour quoi |
| Jetons | Inclus jusqu’à un plafond, puis l’API | API cloud ou modèle local | Une boucle d’outils brûle plus qu’un chat |
| Infra | Chez l’éditeur | Chez vous, ou un GPU loué | Lieu des textes, pannes, mises à jour |
| Temps | Moins d’installation, plus de cadrage | Installation + outillage + relecture | Personne ne le met sur la grille tarifaire |
Le piège habituel : comparer le siège d’un chat au runtime d’un agent. Ce n’est pas la même unité.
Un premier agent utile se juge à un job borné, pas à une ligne « IA » dans la comptabilité.
2. Le siège : vous payez une personne, pas un agent
Les pages « pricing » grand public vendent d’abord un chat. Des connecteurs, du code, un peu d’agent, selon le plan. Ce n’est pas un runtime que vous pilotez.
Claude, page claude.com/pricing, relu ce run :
| Plan | Prix affiché | Unité |
|---|---|---|
| Free | 0 USD | Tout le monde |
| Pro | 17 USD/mois en annuel (200 USD d’avance) ; 20 USD si mensuel | Un compte |
| Max | À partir de 100 USD/mois | Un compte |
| Team, siège standard | 20 USD/siège/mois en annuel ; 25 USD si mensuel | Siège |
| Team, siège premium | 100 USD/siège/mois en annuel ; 125 USD si mensuel | Siège (5× l’usage du standard, selon la page) |
| Enterprise (self-serve) | 20 USD/siège, plus un coût d’usage selon le modèle | Siège + usage |
Mistral, page mistral.ai/pricing, relu ce run (USD, hors taxes sur Pro et Team) :
| Plan | Prix affiché | Crédits API mentionnés |
|---|---|---|
| Free | 0 | 10 USD/mois de crédits API |
| Pro | 14,99 USD/mois | 30 USD/mois de crédits API |
| Team | 24,99 USD/utilisateur/mois | Non détaillé comme le Pro dans l’extrait |
| Enterprise | Sur devis | Déploiements privés |
La page ChatGPT grand public (openai.com/chatgpt/pricing) a renvoyé un 403 Cloudflare pendant cette collecte. Donc pas de tarif ChatGPT Plus / Team écrit ici. On ne le devine pas.
Un siège sert à écrire, coller, parfois brancher Slack. Dès que le logiciel appelle des outils en boucle, vous quittez le forfait mental « 20 dollars » et vous entrez dans les jetons. Coller un mail client dans ce siège, c’est encore autre chose : voir données clients et IA.
3. Les jetons : l’agent les brûle à chaque outil
Les API facturent l’entrée (votre prompt, l’historique, le résultat d’un outil qu’on renvoie) et la sortie (la réponse), en général par million de jetons. Un agent qui cherche, lit, écrit, relance, paie plusieurs allers-retours. Un chat d’une phrase, un seul.
Ordres de grandeur standard, pages officielles, 4 septembre 2026. Pas du batch, pas du « fast mode ».
OpenAI, developers.openai.com/api/docs/pricing (prix pour 1 million de jetons, contexte court) :
| Modèle | Entrée | Sortie |
|---|---|---|
| gpt-6-astra | 10,00 USD | 50,00 USD |
| gpt-5.4 | 2,50 USD | 15,00 USD |
| gpt-5 | 1,25 USD | 10,00 USD |
| gpt-4o | 2,50 USD | 10,00 USD |
La même page note un surcoût de 10 % sur les endpoints de résidence des données pour les modèles sortis à partir du 5 mars 2026. Utile à lire si vous croyez que « rester dans une région » est gratuit. Cadre d’usage (ordinateur, Copilot, Critical cyber) : GPT-6 Astra.
Anthropic, docs Claude / pricing :
| Modèle | Entrée | Sortie |
|---|---|---|
| Claude Sonnet 5 | 2 USD / MTok | 10 USD / MTok |
| Claude Opus 5 | 5 USD / MTok | 25 USD / MTok |
| Claude Haiku 4.5 | 1 USD / MTok | 5 USD / MTok |
Anthropic écrit aussi que le tarif d’introduction Sonnet 5 (2 / 10) est devenu le tarif standard, et que la hausse prévue au 1er septembre 2026 (3 / 15) n’a pas lieu. Autre phrase, même page : les modèles Claude 4.7 et suivants utilisent un tokenizer qui produit environ 30 % de jetons en plus pour le même texte. Même prix au million, plus de millions. La page liste aussi Claude Fable 5.1 à 10 / 50 USD le million (entrée / sortie) : ce n’est pas un siège de chat. Voir Claude Fable 5.1, cache et données.
Mistral, mistral.ai/pricing/api :
| Modèle | Entrée | Sortie |
|---|---|---|
| Mistral Large 3 | 0,50 USD / M | 1,50 USD / M |
Vous pouvez self-hoster un poids ouvert et ne plus payer ce compteur. Vous payez alors la machine. Voir plus bas, et le billet self-host LLM.
Pas de conversion en « coût par e-mail traité ». Ça dépend du prompt, des outils, des relectures. Quiconque vous vend un centime exact sans mesure sur votre volume invente.
4. n8n : le workflow a son propre tarif
n8n n’est pas un agent MIT. C’est un outil d’automatisation qui peut contenir un nœud agent. La page n8n.io/pricing, relue ce run, facture des exécutions de workflow (pas chaque étape), utilisateurs illimités :
| Offre | Prix affiché | Volume | Où ça tourne |
|---|---|---|---|
| Starter | 20 €/mois, facturé à l’année | 2 500 exécutions | Hébergé par n8n |
| Pro | 50 €/mois, facturé à l’année | 10 000 exécutions | Hébergé par n8n |
| Business | 667 €/mois, facturé à l’année | 40 000 exécutions | Self-host |
| Enterprise | Sur devis | Sur mesure | Cloud n8n ou self-host |
| Community Edition | Pas de tarif Cloud | Selon votre machine | Self-host, docs |
Sans clé de licence, n8n self-host tourne en Community. Business et Enterprise s’activent avec une clé.
La Sustainable Use License (fair-code) autorise l’usage interne ou non commercial. Elle refuse, exemples de la doc : white-label payant, ou héberger n8n et faire payer l’accès. Ce n’est pas du MIT. Ce n’est pas « open source OSI ». Pour le voisinage runtime / n8n : panorama agents open source.
Comparer Starter 20 € et Community 0 € sans l’hébergement, c’est comparer une facture à une corvée.
5. Open source : licence à zéro, facture ailleurs
Hermes Agent (Nous Research) : fichier LICENSE relu ce run, MIT, « free of charge ». Vous pouvez l’utiliser, le modifier, le vendre en tant que logiciel. Ça n’offre pas les jetons.
OpenClaw : LICENSE relu ce run, MIT, copyright OpenClaw Foundation 2026. La page openclaw.ai dit « Open source · Runs on your machine ». La machine, l’électricité, le modèle derrière : à vous.
Deux runtimes MIT, deux métiers un peu différents : Hermes plutôt agent autonome multi-surfaces ; OpenClaw plutôt passerelle messagerie. Détail dans Hermes Agent et OpenClaw. Ni l’un ni l’autre n’est « le moins cher 2026 ».
Si le modèle tourne chez vous, le poste devient le GPU. AWS, Capacity Blocks for ML, relu le 4 septembre 2026 :
- instance p5.4xlarge, Europe (Londres), 1× H100 : 4,72 USD de l’heure (AWS écrit 4.720 USD) ;
- ce n’est pas l’On-Demand, pas le Spot ;
- la page dit que ces tarifs de réservation sont prévus pour une prochaine mise à jour en octobre 2026.
Un agent de classement de mails n’a pas besoin d’un H100. Un petit modèle local, parfois une machine de bureau. Les tailles de VRAM sont dans self-host un LLM. Ici on ne recycle pas ces fiches.
Le quatrième poste ne s’achète pas chez Anthropic : quelqu’un pose les outils autorisés, les secrets, la relecture humaine. Sans chiffre d’heures : on n’en a pas mesuré un pour votre dossier. On refuse d’en inventer un.
6. Comparer sans se mentir
Avant de coller deux colonnes « SaaS / OSS » dans un tableur :
- Quel job ? Répondre, relayer, décider avec un outil. Trois prix différents. Voir encore chat vs agent vs n8n.
- Où passent les textes ? Siège américain, API, GPU à Londres, mini PC dans l’atelier. La licence MIT ne déplace pas les données.
- Qui paie les jetons ? Inclus dans un chat, facturés à part, ou absents si le modèle est local.
- Qui maintient ? L’éditeur, ou vous (et la personne qui part en vacances avec le mot de passe).
- Quel volume réel ? Une démo de dix prompts n’est pas un mois de production.
L’open source gagne souvent quand vous voulez tenir le runtime, choisir le modèle, éviter un loyer par siège pour vingt personnes qui n’ouvrent pas le chat. Le SaaS gagne souvent quand vous voulez un outil demain matin, avec une facture lisible et personne pour les drivers.
Les deux peuvent cohabiter : n8n Community en interne, API Mistral ou Claude pour le texte, un humain sur les envois. Ce n’est pas une trahison. C’est une addition.
Limites de cet article
- Sources relues le 4 septembre 2026. Un tarif éditeur peut bouger le lendemain.
- Pas de prix ChatGPT grand public : page officielle inaccessible (403) ce run.
- Pas de francs suisses, pas de TVA romande, pas de kWh, pas de taux de change.
- AWS : Capacity Blocks seulement, région Londres, p5.4xlarge. Pas « le prix du H100 ».
- n8n : montants facturés à l’année tels qu’affichés ; le basculeur mensuel de la page n’a pas été repris comme un second tarif.
- Jetons : tarifs standard, pas Batch, pas Fast mode Anthropic, pas Flex OpenAI.
- Aucune mesure Kervia de consommation réelle d’un agent en production.
- Ce n’est pas un devis, pas un avis d’avocat (licence n8n comprise), pas un classement.
Les mots techniques, en clair
| Terme | En clair |
|---|---|
| Siège | Un abonnement par personne, souvent un chat |
| Jeton (token) | Unité de facturation du texte ; l’entrée et la sortie se paient à part |
| MTok | Un million de jetons |
| Runtime | Le logiciel qui fait tourner l’agent (Hermes, OpenClaw…) |
| Self-host | Vous opérez la machine ; elle peut être dans l’atelier ou chez un cloud |
| Fair-code / SUL | Licence n8n : code visible, usage interne, pas OSI, pas MIT |
| Capacity Blocks | Réservation GPU AWS, tarif distinct de l’On-Demand |
Sources
- Anthropic : Claude pricing (sièges) · API pricing · consultation 4 septembre 2026
- OpenAI : API pricing (markdown officiel) · consultation 4 septembre 2026 · page ChatGPT grand public : 403 ce run
- Mistral : Plans · API · consultation 4 septembre 2026
- n8n : Plans and pricing · Host n8n · Sustainable Use License · consultation 4 septembre 2026
- AWS : EC2 Capacity Blocks for ML pricing · p5.4xlarge Europe (Londres) · consultation 4 septembre 2026
- Nous Research : Hermes Agent LICENSE (MIT)
- OpenClaw Foundation : LICENSE (MIT) · openclaw.ai
- Kervia : agent vs chatbot vs n8n · self-host LLM · agents OSS · Hermes et OpenClaw
QUESTIONS FRÉQUENTES
Pour aller à l’essentiel.
Un agent open source est-il gratuit ?
Le logiciel, souvent oui : Hermes Agent et OpenClaw sont en licence MIT, donc utilisables sans redevance de licence. La facture reste : jetons d’un modèle cloud, éventuellement un GPU, et le temps de celui qui installe, relie les outils et relit. Gratuit n’est pas « zéro ligne sur le compte ».
Un abonnement Claude ou Mistral, c’est le prix de l’agent ?
Non. C’est le prix d’un siège de chat (et, selon le plan, d’un crédit d’API). Un agent qui boucle sur des outils consomme des jetons en plus, parfois beaucoup. Le siège et le compteur d’API sont deux meubles.
n8n Community revient-il moins cher que n8n Cloud ?
La Community n’a pas le tarif Starter / Pro de la page n8n. Vous payez l’hébergement et la maintenance. La licence Sustainable Use autorise l’usage interne, pas de revendre n8n comme produit. Cloud Starter : 20 €/mois facturé à l’année, 2 500 exécutions, relu le 4 septembre 2026.
Faut-il un GPU pour un agent open source ?
Seulement si vous faites tourner le modèle chez vous. Beaucoup d’agents MIT appellent une API. Un H100 loué en Capacity Blocks AWS (p5.4xlarge, Londres) est affiché à 4,72 USD de l’heure le 4 septembre 2026. Ce n’est pas le prix d’un agent de secrétariat.


