Combien coûte un agent IA en 2026 : TJM, forfait et coût par requête

Par Alexandre Rastello, publié le

  • tarifs
  • agents IA
  • budget

En résumé. Un projet d’agent IA se chiffre sur trois postes, pas un seul. Le développement, facturé entre 750 et 1 500 € par jour pour un profil IA en France en 2026 selon les baromètres du marché, soit 15 000 à 33 000 € pour un projet de 15 à 30 jours. L’exploitation, qui court tant que l’agent tourne. Et le coût par requête, entre 0,001 $ et 0,05 $ selon le modèle retenu, soit un écart de 1 à 40 sur exactement la même tâche. Sur 9 000 documents traités par an, ça donne 9 $ avec Mistral Small 4 contre 342 $ avec GPT-5.6 Sol.

La réponse chiffrée

Trois lignes de facture, dans cet ordre.

Le développement. C’est le poste principal. Un développeur ou consultant IA indépendant en France facture entre 750 et 1 500 € par jour selon les baromètres 2026 de Malt, Free-Work et Hays, contre 520 € par jour pour la moyenne des profils IT freelance. Une agence facture le même travail entre 900 et 2 000 € par jour équivalent, avec une couche de gestion de projet en plus.

L’exploitation. Supervision, corrections, montée de version des modèles, hébergement si vous le déléguez. Beaucoup de devis n’en parlent pas, et le sujet revient pourtant chaque année de la vie de l’agent. Il se facture soit par abonnement mensuel, soit à la mission ; sachez lequel des deux vous achetez.

L’usage. Chaque appel au modèle est facturé au token. C’est le poste le plus mal compris, et le seul où un choix technique fait varier la facture d’un facteur 40.

Un projet type de première automatisation représente 15 à 30 jours de développement, mise en production comprise. Multipliez par le TJM de votre prestataire et vous avez le forfait. Personne ne vend un « forfait agent IA » qui ne soit pas cette multiplication déguisée, et savoir la refaire vous-même est le premier réflexe utile face à un devis.

Au TJM médian des profils IA du marché, ce projet type coûte entre 15 000 et 33 000 €. Chez un indépendant qui facture au tarif d’un développeur fullstack confirmé plutôt qu’à celui d’une expertise IA, la même chose tombe à peu près de moitié.

Le TJM en détail

Les fourchettes 2026, par niveau :

Profil TJM constaté
Junior ou profil non technique 300 à 500 €
Développeur IA confirmé 600 à 900 €
Expert IA générative, orchestration d’agents 1 000 à 1 500 €
Moyenne tous profils IT freelance France 520 €

Ce tableau appelle une remarque que le prestataire en face de vous ne fera pas. L’étiquette « expert IA » ne se vérifie nulle part, et l’écart entre les deux dernières lignes se paie sur douze à trente jours de mission. Demandez ce qui est déjà en production, chez qui, depuis combien de temps. Un tarif d’expertise se justifie par des agents qui tournent, pas par un intitulé.

Je vous donne le mien au premier appel, avec le nombre de jours en face. Ce que je peux écrire ici, c’est la contrepartie, et elle compte avant d’appeler : je travaille seul, sur un projet à la fois, sur des périmètres que je sais livrer. Un programme qui demande cinq intervenants coordonnés n’entre pas dans ce modèle, quel que soit le tarif.

Deux écarts pèsent lourd. La localisation d’abord : environ 620 € par jour en Île-de-France, 450 à 540 € en région. Le type de client ensuite, un grand compte payant régulièrement plus cher qu’une PME pour la même prestation.

Le baromètre Malt 2026 mesure une hausse de plus de 200 % de la demande de freelances IA en dix-huit mois, et un écart de 22 % entre le TJM d’un ingénieur IA et celui des autres profils tech. Ça explique la tension sur les prix, et ça explique aussi pourquoi il y a beaucoup de monde qui se déclare « expert IA » depuis un an.

Le coût par requête, poste par poste

C’est la partie que les devis ne détaillent presque jamais, et c’est celle qui décide de la rentabilité d’un agent à trois ans.

Les modèles sont facturés au million de tokens, séparément en entrée et en sortie. Un token vaut à peu près trois quarts de mot en français. Les prix d’août 2026, en dollars, puisque tous ces fournisseurs facturent en dollars :

Modèle Entrée ($/M tokens) Sortie ($/M tokens)
Mistral Small 4 0,15 0,60
GPT-5.6 Luna 0,20 1,20
Mistral Large 3 0,50 1,50
Claude Haiku 4.5 1,00 5,00
GPT-5.6 Terra 2,00 12,00
Claude Sonnet 5 3,00 15,00
Claude Opus 5 5,00 25,00
GPT-5.6 Sol 5,00 30,00

Prenons une tâche réelle. Extraire les lignes d’une facture fournisseur scannée et les préparer pour la comptabilité : environ 4 000 tokens en entrée (les instructions plus le document océrisé) et 600 en sortie. Une PME qui traite 9 000 factures par an paiera, sur l’année :

Modèle Coût par facture Coût annuel (9 000 factures)
Mistral Small 4 0,00096 $ 9 $
GPT-5.6 Luna 0,0015 $ 14 $
Mistral Large 3 0,0029 $ 26 $
Claude Haiku 4.5 0,007 $ 63 $
GPT-5.6 Terra 0,015 $ 137 $
Claude Sonnet 5 0,021 $ 189 $
Claude Opus 5 0,035 $ 315 $
GPT-5.6 Sol 0,038 $ 342 $

Regardez bien la colonne de droite. Sur ce volume, le débat coût par requête ne vaut pas la discussion : 333 $ d’écart annuel entre les deux extrêmes, quand le développement a coûté vingt mille euros. Prenez le modèle qui donne le meilleur taux de réussite et arrêtez d’y penser.

Maintenant changez de cas d’usage. Un assistant qui répond aux demandes clients avec l’historique et la base de connaissance dans le contexte, ça monte à 8 000 tokens en entrée, et 200 conversations par jour ouvré font 50 000 requêtes par an :

Modèle Coût par conversation Coût annuel (50 000 conversations)
Mistral Small 4 0,00144 $ 72 $
Claude Haiku 4.5 0,010 $ 500 $
Claude Sonnet 5 0,030 $ 1 500 $
Claude Opus 5 0,050 $ 2 500 $
GPT-5.6 Sol 0,052 $ 2 600 $

Là, le choix se chiffre en milliers. Et il ne se tranche pas sur le prix, parce qu’un modèle bon marché qui répond correctement 6 fois sur 10 coûte infiniment plus cher en réclamations que 2 000 $ par an.

Le levier que les devis oublient

Sur l’assistant client ci-dessus, les 8 000 tokens d’entrée ne changent pas beaucoup d’une requête à l’autre. Les instructions, la base documentaire, les règles métier, tout ça est identique à chaque appel. Seule la question du client varie.

Les fournisseurs facturent ce contenu répété environ dix fois moins cher quand il est mis en cache. Reprenons le calcul avec 6 500 tokens stables et 1 500 tokens variables, sur Claude Sonnet 5 : 0,0124 $ par conversation au lieu de 0,030 $. Sur 50 000 conversations, 622 $ au lieu de 1 500 $.

58 % d’économie. Zéro changement de modèle, zéro perte de qualité, quelques lignes de code au bon endroit.

Demandez à votre prestataire s’il utilise le cache de prompt. La réponse vous dira très vite s’il a déjà exploité un agent en production ou s’il en a seulement développé un.

Un budget complet, sur trois ans

Reprenons l’automatisation de la saisie des factures, 9 000 documents par an, hébergement en France.

Poste Année 1 Années 2 et 3 (par an)
Audit et cadrage 1 à 3 jours
Développement 15 à 25 jours
Exploitation et supervision à la mission, sans abonnement 1 à 3 jours selon l’usage
Coût des modèles 9 à 342 $ 9 à 342 $
Hébergement France optionnel, si vous me le confiez optionnel

Le travail humain est en jours, à multiplier par le TJM de votre prestataire : c’est la seule façon de comparer deux devis qui n’ont pas le même découpage. Le coût des modèles, lui, est en dollars, parce qu’il ne dépend pas de qui fait le travail.

Deux lignes méritent une explication, parce qu’elles fonctionnent différemment chez moi et chez la plupart des prestataires.

L’exploitation n’est pas un abonnement. Je facture à la mission, au même tarif journalier. Quand un agent doit être corrigé, adapté à un changement de vos process ou migré vers un modèle plus récent, c’est une intervention chiffrée, pas une ligne qui tombe tous les mois que vous en ayez besoin ou non. Comptez un à trois jours par an pour un agent en service, davantage l’année où votre logiciel métier change de version.

L’hébergement est à votre main. Vous hébergez chez vous, chez votre prestataire habituel, ou vous me le confiez. Les trois options fonctionnent et le choix ne conditionne pas le reste du projet.

Le poste qui surprend le plus les dirigeants n’est ni l’un ni l’autre. C’est de découvrir en année 2 qu’aucun budget de suivi n’avait été envisagé, et qu’un agent laissé sans surveillance depuis dix mois répond faux une fois sur trois sans que personne l’ait remarqué. Sans abonnement, cette vigilance vous revient : prévoyez de regarder les résultats une fois par trimestre.

Les aides publiques

Selon la situation de l’entreprise, 30 à 50 % du coût du projet peuvent être couverts par des dispositifs publics : Bpifrance, aides régionales, dispositifs d’accompagnement à la numérisation des PME. Ça ne change pas le prix du projet, ça change ce que vous décaissez.

Le montage du dossier relève d’un conseil spécialisé. Ce qu’un prestataire technique peut fournir, c’est la partie technique du dossier : périmètre, choix d’architecture, calendrier, justification des coûts.

Lire un devis d’agent IA sans se faire avoir

Six questions à poser. Les réponses valent plus que le montant en bas de page.

  1. Le coût par requête est-il chiffré, modèle par modèle ? Si le devis parle de « coûts d’API à définir », le prestataire n’a pas fait le calcul et vous le découvrirez sur votre facture.
  2. Le seuil de qualité est-il écrit ? Un agent qui répond correctement 6 fois sur 10 n’est pas livrable. Le seuil doit figurer au contrat, mesuré avant la mise en production.
  3. Que se passe-t-il si vous arrêtez ? Coût de sortie, propriété du code, documentation, délai de reprise par un autre développeur. Un projet qui vous enferme chez son prestataire est un projet raté, même quand il fonctionne.
  4. Qui écrit le code ? Dans une agence, la personne du premier rendez-vous est rarement celle qui développe. Demandez à parler à celle qui code.
  5. L’exploitation est-elle chiffrée séparément ? Un forfait « tout compris » sur douze mois cache généralement une année 2 non budgétée.
  6. L’audit est-il payant ou offert ? Les deux réponses sont défendables. Un audit gratuit est un acte commercial, un audit payant est une prestation avec un livrable. Ce qui compte, c’est de savoir laquelle vous achetez.

Quand ça ne vaut pas le coup

Trois cas où la réponse honnête est de ne rien automatiser.

La tâche prend moins d’une heure par semaine. À 30 € de l’heure chargée, ça fait 1 500 € par an. Le projet ne sera jamais rentable, même à 8 000 €. Le calculateur de coût d’une tâche répétitive donne l’ordre de grandeur en deux minutes, avec vos propres volumes.

Le processus change tous les trimestres. Un agent se cale sur des règles ; si les règles bougent en permanence, vous payez de la maintenance en continu pour un gain qui ne se stabilise jamais.

Personne en interne n’a le temps de suivre le projet. Comptez deux heures par semaine de disponibilité côté client pendant le développement. En dessous, le projet dérive, et ce n’est pas une question de budget.

Un audit sérieux doit pouvoir aboutir à « n’y allez pas ». S’il aboutit systématiquement à un devis, ce n’était pas un audit.


Tarifs API relevés en août 2026 sur les grilles publiques d’Anthropic, OpenAI et Mistral AI. Fourchettes de TJM issues des baromètres 2026 de Malt, Free-Work et Hays France. Les coûts par requête sont calculés sur les hypothèses de volume indiquées et varient avec la longueur réelle de vos documents.

Questions fréquentes

Quel est le TJM d'un freelance développeur IA en France en 2026 ?
Entre 750 et 1 500 € par jour selon les baromètres Malt, Free-Work et Hays, avec 600 à 900 € pour un profil confirmé et 1 000 à 1 500 € pour un expert en IA générative ou en orchestration d'agents. La moyenne tous profils IT freelance confondus est de 520 € par jour. Deux écarts pèsent lourd dans ces fourchettes : la localisation, environ 620 € en Île-de-France contre 450 à 540 € en région, et le type de client, un grand compte payant plus cher qu'une PME pour la même prestation.
Combien coûte un agent conversationnel chez une agence IA en France ?
Le développement représente 15 à 30 jours pour un premier périmètre, avec un TJM équivalent souvent supérieur de 20 à 40 % à celui d'un indépendant pour couvrir la gestion de projet et la couche commerciale. Au TJM médian des profils IA, le même projet se situe entre 15 000 et 33 000 €. À cela s'ajoute le coût par requête, qui dépend du modèle et du volume, entre quelques dizaines et quelques milliers de dollars par an.
Un budget de 20 000 € pour un projet IA, ça couvre quoi ?
Entre 13 et 36 jours de développement selon le TJM du prestataire : une quinzaine de jours chez un expert IA à 1 300 €, plus du double chez un indépendant qui facture au tarif d'un développeur fullstack confirmé. Dans les deux cas, de quoi mettre une première tâche en production et l'exploiter quelques mois. Ce que ce budget ne couvre pas : plusieurs automatisations en parallèle, une refonte de vos données, ou trois ans d'exploitation. Prévoyez la ligne d'exploitation dès l'année 1, sinon le projet s'arrête en année 2 faute de budget de maintenance.
L'audit avant développement est-il payant ?
Ça dépend des prestataires, et les deux modèles existent sur le marché français. Un audit payant produit un livrable exploitable même si vous ne poursuivez pas : périmètre automatisable, ordre de priorité, gain attendu, coût par requête du modèle retenu. Un audit gratuit est un temps commercial, ce qui n'est pas illégitime, mais son livrable est généralement un devis.
Comment demander un second avis sur un devis d'agence IA ?
Faites relire le devis par un développeur qui ne prendra pas la mission. Six points à vérifier : le coût par requête chiffré, le seuil de qualité écrit au contrat, les conditions de sortie, l'identité de la personne qui code, l'exploitation budgétée séparément, et le statut de l'audit. Un devis qui reste flou sur trois de ces six points est un devis à renégocier.
Quelles aides couvrent un projet d'IA pour une PME en 2026 ?
Selon la situation de l'entreprise, 30 à 50 % du coût peuvent être pris en charge par des dispositifs publics, entre Bpifrance, les aides régionales et les dispositifs d'accompagnement à la numérisation. Le montage relève d'un conseil spécialisé ; le prestataire technique fournit les pièces techniques du dossier.
À qui appartient le code une fois le projet livré ?
Ça se négocie, et ça se vérifie avant de signer. Exigez trois choses par écrit : la propriété du code, une documentation technique suffisante pour qu'un autre développeur reprenne la main, et les accès à l'infrastructure. Sans ces trois éléments, le coût de sortie est illimité, quel que soit le prix affiché sur le devis.
Comment réduire le coût par requête d'un agent existant ?
Trois leviers, du plus rentable au moins rentable. Le cache de prompt sur la partie stable du contexte, qui divise la facture par deux sur un assistant documentaire. Le bon calibrage du modèle par tâche, un modèle rapide pour classer et un modèle puissant pour rédiger. La réduction du contexte envoyé, en filtrant les documents en amont plutôt qu'en envoyant tout au modèle.