Coût4 août 2026

Ce que l'IA coûte vraiment à une équipe de douze: le calcul

En bref

Pour douze personnes qui utilisent un assistant IA à un rythme normal, avec une base de connaissances de 20 Go et trois cents exécutions d'automatisation par mois, la facture tombe autour de 35 euros par mois, soit moins de 3 euros par personne. Charger les documents dans la base coûte 69 euros de plus, une seule fois.

La question du coût de l’IA pour une entreprise reçoit presque toujours une réponse dans la mauvaise monnaie. Le fournisseur annonce un prix par million de jetons. La personne qui demande veut savoir à quoi ressemble le mois prochain pour douze personnes. Entre les deux se trouve une chaîne de conversions que personne n’aime faire en public, parce que la faire oblige à montrer ses hypothèses.

Les voici donc. Chaque donnée d’entrée est indiquée, et si vous n’êtes pas d’accord avec l’une d’elles, remplacez la et refaites le calcul.

D’où vient la facture

Cinq choses sont comptées et rien d’autre: les jetons en entrée, les jetons en sortie, les requêtes de recherche web, les secondes de bac à sable quand du code tourne, et le stockage des documents. Il n’y a pas de frais par siège. Une personne qui n’a pas ouvert l’assistant ce mois ci ne coûte rien.

Cela ressemble à un détail comptable. En pratique, cela change la forme de toute la dépense. Avec une licence par siège vous payez soixante comptes dont vingt servent vraiment. À l’usage vous payez les vingt, et vous cessez d’avoir chaque trimestre la discussion sur la licence à retirer à qui.

Les tarifs derrière les chiffres

Classe de modèleModèleEntrée par 1M de jetonsSortie par 1M de jetons
Économiquegemma-4-26b-a4b-it0,40 EUR0,80 EUR
Équilibréqwen3.5-397b-a17b0,96 EUR5,76 EUR
Le plus puissantglm-5.23,24 EUR9,90 EUR

Ajoutez la recherche web à 0,0012 EUR par requête, le stockage à environ 0,019 EUR par gigaoctet et par mois, et l’indexation à 0,16 EUR par million de jetons quand les documents sont lus.

Regardez le rapport de la sortie à l’entrée sur la classe équilibrée: six pour un. C’est le chiffre le plus important ici et j’y reviendrai.

Les hypothèses d’usage

C’est normalement là que commencent les devinettes. Celles ci viennent de mesures sur une plateforme en service et non du calculateur d’un fournisseur:

OpérationJetons en entréeJetons en sortie
Une réponse fondée dans une conversation1300350
Un appel auxiliaire, par exemple reformuler la question900250
Un passage retrouvé placé dans le contexte4100
Une étape d’automatisation48001100

Pourquoi 1 300 jetons en entrée pour une question de dix mots? Parce que ce qui atteint le modèle, c’est une instruction système, la conversation jusqu’ici et six passages de documents. La question elle même est une erreur d’arrondi. Qui estime le coût de l’IA à partir de la longueur de la question se trompe de deux ordres de grandeur.

Douze personnes, un mois

Le profil: douze personnes, quinze messages chacune par jour ouvré, vingt et un jours ouvrés, le modèle équilibré, soixante pour cent des conversations fondées sur la base de connaissances, deux cents recherches web, trois cents exécutions d’automatisation, vingt gigaoctets de documents.

LignePar mois
Conversationsenviron 27 EUR
Passages retrouvés dans le contexteenviron 5 EUR
Recherche webmoins de 1 EUR
Automatisations, 300 exécutionsenviron 3 EUR
Stockage, 20 Goenviron 0,40 EUR
Totalenviron 35 EUR

Moins de 3 euros par personne et par mois. À titre de comparaison, une licence au siège chez un fournisseur qui facture à l’effectif commence autour de 20 à 30 euros par personne et par mois, utilisée ou non. À douze personnes, cela fait une différence d’environ 250 à 350 euros par mois, disons un facteur dix.

Avant que cela ne paraisse trop beau: une équipe qui s’appuie fortement sur l’IA change la forme du calcul. Quarante messages par jour et par personne au lieu de quinze font passer la ligne des conversations de 27 à environ 72 euros. Toujours moins cher que des licences, mais l’écart cesse d’être d’un facteur dix.

Ce que le chiffre exclut

L’indexation initiale. Vingt gigaoctets de texte représentent environ 430 millions de jetons à traiter lors de l’indexation, à peu près 69 euros, payés une fois. Si la base grossit de deux gigaoctets par mois, ajoutez environ 7 euros par mois.

Il exclut aussi les personnes. Déployer cela, choisir les documents à verser, régler les permissions et apprendre à une équipe à s’en servir coûte plus cher que la plateforme la première année. Ne budgéter que les licences rend la conversation ultérieure désagréable.

Trois leviers qui réduisent vraiment la facture

Des réponses plus courtes. La sortie coûte six fois ce que coûte l’entrée. Une instruction système qui demande de la brièveté peut retirer un pourcentage à deux chiffres de la facture sans perte d’utilité.

Moins de passages dans le contexte. Six passages de 410 jetons font 2 460 jetons en entrée par réponse. Descendre à quatre économise environ un cinquième de la ligne des conversations, et la différence ne se sent que sur des questions réellement larges.

Adapter la classe de modèle au travail. Reformuler une note ou classer un ticket n’exige pas le modèle le plus puissant. À consommation de jetons identique, la classe économique coûte huit fois moins en entrée et douze fois moins en sortie. L’essentiel de l’argent que les entreprises gaspillent ici ne vient pas du prix de l’IA; il vient de ce que tout part vers le modèle le plus cher disponible.

Le vérifier avec vos propres chiffres

L’estimateur de la page des tarifs fait exactement ce calcul et laisse changer chaque variable: les personnes, l’intensité, la classe de modèle, la taille de la base de connaissances, les recherches et les exécutions d’automatisation. Le résultat est une estimation et non une offre commerciale, mais les entrées sont réelles et viennent de la même table que la facturation.

Une question sur un pilote, la sécurité ou une intégration.

Quelqu'un qui connaît le code répond, en général le jour ouvré même.