L
Lumivi
Coût d’usage de l’IA

Combien coûte vraiment l’IA par mois ?

L’intelligence artificielle n’est pas gratuite : chaque requête consomme des tokens, facturés par les fournisseurs. Cette page explique comment l’IA se facture réellement en entreprise (tokens, abonnements, API), avec les prix publics vérifiés et des relevés de consommation issus de systèmes en production.

Tarifs vérifiés le 20 juillet 2026 Ordres de grandeur issus de la production
Le point de départ

Pourquoi l’IA n’est pas gratuite.

Derrière chaque réponse d’un modèle d’IA, il y a du calcul intensif sur des serveurs spécialisés. Ce calcul, appelé inférence, a un coût réel que les fournisseurs répercutent : c’est lui qui explique les abonnements comme la facturation à la consommation. Une entreprise qui déploie de l’IA doit donc raisonner comme pour l’électricité : un coût d’usage récurrent, proportionnel à ce qui tourne.

Chaque requête consomme du calcul

Lire votre document, raisonner dessus et produire une réponse mobilise des serveurs équipés de processeurs spécialisés, très coûteux à opérer. Le prix que vous payez reflète cette consommation, mesurée en tokens.

La facture suit l’usage

Contrairement à un logiciel classique au prix fixe, le coût de l’IA varie avec le volume traité : plus de documents, des textes plus longs ou des tâches plus complexes font mécaniquement monter la consommation.

Les agents consomment plus qu’un chat

Un assistant conversationnel traite une question à la fois. Un agent autonome enchaîne lectures, vérifications et actions : il peut consommer beaucoup plus de tokens qu’une simple conversation, parfois plusieurs dizaines de fois plus. À anticiper dans le budget.

Comment ça se facture

Les trois modes de facturation de l’IA.

Toutes les offres du marché se ramènent à trois mécanismes. Les connaître suffit à lire n’importe quel devis ou grille tarifaire, et à comprendre ce que vous paierez chaque mois.

L’abonnement par utilisateur

ChatGPT, Claude, Copilot ou Le Chat facturent un montant fixe par siège et par mois, généralement entre 15 et 25 €. Adapté à l’usage humain quotidien : chaque collaborateur dialogue avec l’outil, le prix est prévisible.

La limite : des quotas d’usage existent même en payant, et le prix est dû, que l’outil soit utilisé ou non.

L’API : la facturation à l’usage

Pour les traitements automatisés (trier du courrier, générer des documents, alimenter un outil métier), on paie au token consommé, au tarif public du fournisseur. Pas d’abonnement : la facture reflète exactement ce qui a tourné.

C’est le mode le plus économique pour les tâches de fond, et le plus transparent, à condition d’avoir accès à la facture.

Les crédits intégrés aux logiciels

De plus en plus d’outils métier (CRM, suites bureautiques, logiciels de gestion) vendent des « crédits IA » : une monnaie interne adossée aux tokens, consommée par les fonctions intelligentes de l’outil.

Pratique, mais le taux de conversion crédits/tokens est rarement publié : c’est souvent là que se logent les coûts cachés de l’IA en entreprise.

L’unité de mesure

Le token, l’unité qui sert à facturer l’IA.

Un token est un fragment de mot d’environ quatre caractères : c’est l’unité dans laquelle les modèles lisent et écrivent, et donc l’unité dans laquelle ils sont facturés. Retenez un ordre de grandeur simple : 1 000 tokens représentent environ 750 mots. Deux subtilités comptent pour la facture : le français consomme 10 à 20 % de tokens de plus que l’anglais, et les tokens produits par le modèle (la sortie) coûtent environ 4 à 6 fois plus cher que ceux qu’il lit (l’entrée), car générer du texte demande beaucoup plus de calcul que d’en lire.

Équivalences entre contenus texte et nombre de tokens
ContenuTailleTokens
Un email courtenviron 150 mots≈ 200 à 250 tokens
Une page de texteenviron 500 mots≈ 700 à 800 tokens
Un document de 10 pagesenviron 5 000 mots≈ 8 000 à 10 000 tokens
Une page web moyennecontenu texte≈ 2 500 tokens
Un rapport PDF denseétude, dossier technique100 000 tokens et plus

Ce que ça donne en euros

Faire lire un document de 10 pages (environ 8 000 tokens) à un modèle haut de gamme facturé 5 $ le million de tokens coûte environ 3 à 4 centimes. Le même document sur un modèle économique : moins d’un centime.

C’est la logique à retenir : à l’unité, presque tout est bon marché. Ce sont les volumes mensuels, la longueur des contextes envoyés au modèle et le choix de la gamme qui font la facture finale.

Les tarifs du marché

Les prix publics des fournisseurs, vérifiés.

Voici les tarifs affichés par les principaux fournisseurs sur leurs pages officielles, relevés le 20 juillet 2026. D’abord l’API à la consommation (en dollars par million de tokens), puis les abonnements par utilisateur. Ces prix évoluent régulièrement : cette page est revue à chaque mouvement notable du marché.

API à la consommation (par million de tokens)

Prix API des principaux fournisseurs d’IA en dollars par million de tokens
FournisseurModèleGammeEntréeSortie
AnthropicClaude Haiku 4.5Économique1,00 $5,00 $
AnthropicClaude SonnetÉquilibré3,00 $15,00 $
AnthropicClaude Opus 4.8Haut de gamme5,00 $25,00 $
OpenAIGPT-5.4 miniÉconomique0,75 $4,50 $
OpenAIGPT-5.6 terraÉquilibré2,50 $15,00 $
OpenAIGPT-5.6 solHaut de gamme5,00 $30,00 $
Mistral AIMistral Small 4Économique0,15 $0,60 $
Mistral AIMistral Medium 3.5Équilibré1,50 $7,50 $
GoogleGemini Flash-LiteÉconomique0,25 $1,50 $
GoogleGemini 3.1 ProHaut de gamme2,00 $12,00 $

Sélection représentative par gamme ; chaque fournisseur propose d’autres modèles, dont des versions très haut de gamme plus chères. Prix en dollars hors taxes relevés sur les pages tarifaires officielles (1 $ ≈ 0,87 € au 20 juillet 2026). La plupart des fournisseurs proposent en plus un cache (contexte déjà lu refacturé autour de 10 % du prix) et un traitement par lot à tarif réduit d’environ 50 %.

Prix des abonnements IA par utilisateur

Prix des abonnements IA par utilisateur
OffrePour quiPrix affiché
ChatGPT PlusIndividuel23 €/mois
ChatGPT BusinessÉquipe (min. 2)21 à 26 €/utilisateur/mois
Claude ProIndividuel20 $/mois (17 $ en annuel)
Claude TeamÉquipe (2 à 150)25 $/utilisateur/mois (20 $ en annuel)
Microsoft 365 CopilotComplément de Microsoft 36518 à 21 $/utilisateur/mois
Gemini (Google Workspace)Inclus dans Workspacedès 13,60 €/utilisateur/mois (plan Standard)
Mistral Le Chat ProIndividuel14,99 $/mois
Mistral Le Chat TeamÉquipe24,99 $/utilisateur/mois

Prix publics affichés dans la devise de la page officielle de chaque éditeur (les offres en dollars sont facturées hors taxes). Les offres Enterprise, sur devis, ne figurent pas ici. Pour choisir et déployer ces outils dans une équipe, voir notre service d’intégration d’outils IA.

La preuve par l’usage

Ce que consomment de vrais systèmes en production.

Les fourchettes théoriques ne disent pas grand-chose. Voici donc, anonymisées et arrondies, des estimations de consommation issues de systèmes que l’on opère réellement, chiffrées aux prix publics ci-dessus. Le constat : pour la plupart des automatisations de PME, la consommation se compte en euros ou en dizaines d’euros par mois. Les exceptions existent : un agent autonome complexe ou un assistant utilisé intensivement par toute une équipe peut atteindre plusieurs centaines d’euros mensuels, d’où l’importance des plafonds et alertes décrits plus bas.

Tri et prétraitement du courrier entrant

moins de 10 € de tokens/mois
≈ 1 100 emails/mois modèle économique

Chaque email est classé, résumé et prétraité automatiquement, avec un brouillon de réponse quand c’est pertinent. Environ 1 800 tokens par email, dont une majorité en entrée.

Rédaction automatique d’articles de veille

de l’ordre de 1 € de tokens/mois
8 à 9 articles/mois modèle équilibré

Des sources sont collectées, synthétisées et transformées en article publié. Beaucoup de tokens en entrée (les sources), peu en sortie : le poste le moins cher de tous.

Moteur commercial quotidien

≈ 15 à 20 € de tokens/mois
veille + décisions + relances, chaque jour ouvré modèle haut de gamme

Le système lit le contexte de chaque prospect, décide de la prochaine action et rédige les messages. C’est notre poste de consommation le plus élevé : un raisonnement quotidien sur un modèle haut de gamme.

Compte rendu de réunion structuré

≈ 0,10 à 0,20 € par réunion
par réunion d’une heure modèle haut de gamme

La transcription complète (15 000 à 20 000 tokens) est transformée en compte rendu structuré prêt à envoyer. Même sur le modèle le plus cher, chaque réunion coûte une vingtaine de centimes au plus.

Ces montants couvrent la consommation du modèle uniquement. Le développement de ces systèmes, leur hébergement et leur maintenance relèvent du coût de projet : fourchettes complètes dans notre guide ROI et coût d’un projet IA pour une PME. Un exemple de système comparable est décrit dans notre réalisation moteur commercial IA.

À vous de jouer

Estimez un ordre de grandeur pour votre volume.

Choisissez un type de tâche, une gamme de modèle et un volume mensuel : le simulateur applique les prix publics pour donner un ordre de grandeur de la consommation. Les profils de tâches reprennent des moyennes constatées sur nos systèmes en production.

Consommation estimée≈ 2,61 € de tokens/moissoit moins d’un centime par exécution

Ordre de grandeur calculé aux prix publics des fournisseurs (tarifs vérifiés le 20 juillet 2026, conversion indicative en euros). Hors abonnements, hébergement et maintenance de la solution : le simulateur estime la seule consommation du modèle.

Le critère que personne ne regarde

Qui détient les comptes, qui voit la facture ?

Quand une entreprise fait développer une solution d’IA, la consommation est facturée par les fournisseurs de modèles sur un compte. La vraie question, rarement posée, est : le compte de qui ? Chez Lumivi, les comptes fournisseurs (Anthropic, OpenAI, Mistral ou autres) sont ouverts au nom du client. C’est un choix structurant : la consommation n’est pas une ligne de revenu pour nous, et l’entreprise garde le contrôle de son infrastructure d’IA.

Garder la main

Le coût complet, et comment garder la facture sous contrôle.

La consommation de tokens n’est qu’une partie du coût récurrent : selon l’architecture retenue s’y ajoutent l’hébergement de la solution et sa maintenance. Ces postes, comme l’investissement initial et le retour sur investissement, sont chiffrés dans notre guide ROI et coût d’un projet IA. Côté usage, quatre leviers font la différence entre une facture maîtrisée et ces coûts cachés qui font déraper les budgets IA.

Le bon modèle pour la bonne tâche

L’écart de prix entre un modèle économique et un modèle haut de gamme est d’un facteur 5 à 10, pour un résultat équivalent sur les tâches simples (classer, extraire, résumer). Réserver les modèles chers au raisonnement complexe est le premier levier d’économie, et le plus souvent négligé.

Cache et traitement par lot

Quand un système renvoie souvent le même contexte (les mêmes instructions, la même base documentaire), le cache des fournisseurs refacture cette relecture autour de 10 % du prix. Et tout ce qui n’est pas urgent peut passer en traitement par lot, environ moitié moins cher.

Plafonds et alertes dès le premier jour

Les consoles des fournisseurs permettent de fixer des limites de dépense et des alertes de consommation. Les activer dès la mise en production coûte cinq minutes et supprime le risque de mauvaise surprise, y compris en cas d’emballement technique d’un système.

Suivre le coût par exécution

Le bon indicateur n’est pas la facture globale mais le coût unitaire : combien coûte le traitement d’un email, d’un dossier, d’un document. Un coût unitaire stable avec un volume qui monte est le signe d’une facture saine ; un coût unitaire qui monte signale un système à optimiser.

Questions fréquentes

Vos questions sur le coût d’usage de l’IA.

Combien coûte l’IA par mois pour une PME ?

Pour un usage individuel par abonnement, comptez 15 à 25 € par utilisateur et par mois (ChatGPT, Claude, Copilot, Le Chat). Pour des automatisations qui tournent en tâche de fond via API, la consommation de la plupart des cas d’usage PME se compte en euros ou en dizaines d’euros par mois, pas en milliers : nos systèmes en production coûtent entre moins de 1 € et une vingtaine d’euros de tokens par mois chacun. S’ajoutent l’hébergement et la maintenance de la solution, qui dépendent de l’infrastructure choisie.

Qu’est-ce qu’un token et combien ça coûte ?

Le token est l’unité de facturation des modèles d’IA : un fragment de mot d’environ quatre caractères. 1 000 tokens représentent environ 750 mots en anglais, un peu moins en français. Les fournisseurs facturent au million de tokens : en entrée, de 0,15 $ pour les modèles les plus économiques à 5 $ et plus pour le haut de gamme ; la sortie est facturée environ 4 à 6 fois plus cher. Concrètement, faire lire un document de 10 pages à un modèle haut de gamme coûte environ 4 centimes.

Pourquoi les tokens de sortie coûtent-ils plus cher que les tokens d’entrée ?

Lire du texte (entrée) demande beaucoup moins de calcul que d’en générer (sortie) : chaque mot produit est le résultat d’un calcul complet du modèle. Les fournisseurs facturent donc la sortie environ 4 à 6 fois plus cher que l’entrée. C’est une bonne nouvelle pour beaucoup d’usages d’entreprise : résumer, classer ou extraire de l’information consomme surtout de l’entrée, la partie la moins chère.

Abonnement (ChatGPT, Copilot) ou API : que choisir pour une entreprise ?

Les deux répondent à des besoins différents. L’abonnement par siège (15 à 25 € par utilisateur et par mois) convient à l’usage humain : un collaborateur qui dialogue avec l’outil au quotidien. L’API à la consommation convient aux traitements automatisés qui tournent sans intervention : on ne paie que ce qui est réellement consommé, ce qui revient souvent bien moins cher qu’un siège pour des tâches de fond. La plupart des entreprises finissent par combiner les deux.

Combien coûte une requête à un modèle d’IA ?

Tout dépend de la longueur du texte lu et produit, et du modèle choisi. Un ordre de grandeur : traiter un email (le lire, le classer, préparer une réponse) coûte une fraction de centime sur un modèle économique, et environ un centime sur un modèle haut de gamme. C’est le volume mensuel et la complexité des traitements qui font la facture, pas la requête unitaire.

Pourquoi ma facture d’API peut-elle varier d’un mois à l’autre ?

Parce qu’elle suit la consommation réelle : plus de documents traités, des documents plus longs, un contexte plus riche envoyé au modèle ou des tâches qui demandent plusieurs allers-retours font mécaniquement monter le nombre de tokens. C’est pour cela qu’un système bien conçu prévoit des plafonds de consommation et des alertes, et que la facture du fournisseur doit rester visible par l’entreprise, pas seulement par son prestataire.

Les versions gratuites de ChatGPT ou de Claude suffisent-elles pour une entreprise ?

Pour découvrir, oui. Pour un usage professionnel régulier, rarement : quotas limités, accès réduit aux meilleurs modèles, et surtout des garanties de confidentialité et d’administration (gestion des comptes, données non utilisées pour l’entraînement) réservées aux offres payantes. Un abonnement à une vingtaine d’euros est généralement rentabilisé dès que l’outil fait gagner quelques heures dans le mois.

Comment éviter que la facture d’IA dérape ?

Quatre leviers principaux : choisir le bon modèle pour chaque tâche (l’écart de prix entre un modèle économique et un modèle haut de gamme est d’un facteur 5 à 10 alors que, pour des tâches simples, le résultat est équivalent) ; utiliser le cache des fournisseurs quand on renvoie souvent le même contexte (la relecture coûte environ 10 % du prix) ; traiter en lot ce qui n’est pas urgent (environ 50 % de réduction chez la plupart des fournisseurs) ; et poser des plafonds et alertes de consommation dès la mise en place. Le tout suppose d’avoir accès à sa propre facture fournisseur.

30 min · Gratuit · Sans engagement

Et pour votre entreprise, ça donnerait quoi ?

En 30 minutes avec un cofondateur, on identifie ce qui mérite d’être automatisé chez vous et l’ordre de grandeur du coût d’usage associé. Pour chiffrer un projet complet et son retour sur investissement, notre guide ROI et coût d’un projet IA prend le relais.