Coût des agents IA Module

Vaks PM · Guide d'intégration · Coût & facturation des agents · Août 2026

Ce que couvre ce guide. Comment Vaks PM connaît, chiffre et restitue le coût d'un agent IA : l'unité de mesure (tokens ou crédits), les trois façons d'obtenir le coût réel (déclaré, mesuré par une passerelle, estimé), le catalogue de prix des modèles qui convertit l'usage en euros, et où tout cela ressort dans le P&L et les rapports. Pour ce qu'un agent est et comment il travaille, voir Agents IA.

Le principe — un agent se mesure en usage, pas en heures

Un agent n'a pas de feuille de temps : sa capacité n'est jamais des heures, et sa consommation ne se compte pas comme celle d'un humain. Elle se mesure en usage du modèle — le volume de texte traité par le grand modèle de langage qui le pilote. Vaks PM transforme cet usage en un montant en euros à deux titres distincts : ce que l'agent vous coûte (coût interne) et, le cas échéant, ce que vous facturez à un client (prix de vente). Les deux alimentent la même vue de résultat que le travail humain.

Tokens ou crédits — deux unités selon le fournisseur

L'unité dépend de la façon dont le fournisseur du modèle facture, et Vaks PM la choisit automatiquement :

UnitéPour quels agentsCe qui est compté
Tokens (par 1000)Modèles facturés au token — Anthropic, OpenAI, Mistral, et tout modèle atteint via une API ou une passerelle.Le nombre de tokens (l'unité dans laquelle un modèle compte le texte) en entrée et en sortie — la sortie coûtant généralement 3 à 5 fois l'entrée, les deux sont comptés séparément.
Crédits (par 1000)Agents facturés au message/crédit — typiquement Microsoft Copilot Studio.Le nombre de Copilot Credits consommés. Le modèle sous-jacent est inclus dans le crédit : il n'y a pas d'entrée/sortie à distinguer.
L'unité est une propriété du fournisseur, pas un réglage. Vaks PM la déduit du fournisseur choisi sur la fiche de l'agent. Un agent Copilot bascule tout seul en crédits — ses champs de coût, ses rapports et ses exports parlent alors de crédits (« kCredits ») et non de tokens. Le reste de ce guide vaut pour les deux ; on précise là où crédits et tokens divergent.

Le coût interne — ce que le modèle vous coûte

Le coût interne d'un agent se dérive de taux configurables, saisis sur la fiche de l'agent (onglet Coût) :

Ces taux n'ont pas besoin d'être saisis à la main modèle par modèle : le catalogue de prix les pré-remplit pour les modèles connus.

Facturer un client — un prix de vente distinct

Le coût interne (ce que vous payez) et le prix facturé (ce que vous vendez) sont deux valeurs indépendantes, volontairement découplées. Le prix de vente est un taux unique par 1000 unités (tokens ou crédits confondus, entrée et sortie mélangées) — c'est un prix commercial, sans lien avec la structure de coût du fournisseur. Un agent sans taux de facturation est simplement non facturable : son coût interne reste suivi, mais rien n'est porté au chiffre d'affaires.

Une clé d'organisation ne fixe jamais le prix de vente. Les taux de coût interne peuvent arriver par l'enregistrement entrant d'un agent (clé API d'organisation) ; le taux de facturation client, lui, est délibérément refusé sur ce canal. Il se règle uniquement dans Admin → Agents, sous contrôle finance — une intégration machine ne décide pas de votre prix.

Résolution des taux — du plus précis au défaut

Pour un projet donné, le taux appliqué à un agent se résout par ordre de priorité :

  1. Taux de l'agent sur ce projet — un override posé projet par projet (sous la finance du projet), quand un client négocie un tarif particulier.
  2. Taux par défaut de l'agent — celui de sa fiche, qui s'applique partout ailleurs.
  3. Non facturable — en l'absence des deux, le travail de l'agent ne génère pas de chiffre d'affaires (le coût reste, lui, toujours suivi).

D'où vient le chiffre — trois sources

Connaître le coût réel d'une exécution suppose de connaître l'usage réel. Vaks PM accepte ce chiffre de trois façons, de la plus simple à la plus fiable. Elles ne s'excluent pas — un coup mesuré ou déclaré réel n'est jamais écrasé par une estimation.

Déclaré par l'agent Mesuré par la passerelle Estimé par Vaks (Copilot) Journal d'usage — unités par exécution Catalogue de prix des modèles € coût & CA usage × prix P&L · rapports · exports aux côtés du travail humain
Les trois sources d'usage alimentent le même journal d'exécutions. Croisé au catalogue de prix des modèles, il donne un coût (et un chiffre d'affaires) en euros, versé au P&L. Encadré orange = la source la plus fiable (mesure par passerelle) et le catalogue de prix.
SourceQui fournit l'usageFiabilité
DéclaréL'agent lui-même, après chaque exécution.Dépend de l'honnêteté de l'agent — Vaks garde un coût de référence pour le recouper.
Mesuré (passerelle)Une passerelle par laquelle transitent les appels au modèle.Exact : l'usage est lu dans la réponse même du fournisseur.
EstiméVaks PM, à partir de l'activité observée de l'agent.Approché — le recours quand le coût n'est pas mesurable (crédits Copilot).

Déclaré — l'agent rapporte son usage

Après avoir travaillé, un agent déclare le coût de son exécution : le nombre de tokens d'entrée et de sortie (et éventuellement un coût déjà calculé). Si l'agent ne fournit que les tokens, Vaks PM dérive le coût depuis ses taux — et garde toujours ce montant dérivé comme référence anti-triche : un coût déclaré qui s'écarte trop de ce que les tokens impliquent est signalé comme anomalie. Le coût déclaré prime, la référence sert de garde-fou.

Mesuré — la passerelle LLM

Pour une mesure exacte sans dépendre de la déclaration de l'agent, Vaks PM fournit une passerelle LLM optionnelle : un relais léger, déployé côté client au plus près des agents, par lequel passent leurs appels aux modèles (Anthropic, OpenAI et compatibles). La passerelle lit l'usage réel dans la réponse du fournisseur et le transmet à Vaks PM, marqué comme mesuré. L'agent n'a rien à déclarer.

CÔTÉ CLIENT · SORTIE UNIQUEMENT Agent IA appelle le modèle Passerelle LLM relais + lecture de l'usage réel Fournisseur LLM Anthropic · OpenAI · compatibles Vaks PM coût mesuré → journal d'usage relais ⇄ usage lu ici usage mesuré
La passerelle vit côté client, au plus près des agents, en sortie seulement. Elle relaie les appels au modèle octet pour octet vers le fournisseur et lit l'usage dans sa réponse, puis transmet ce chiffre mesuré à Vaks PM — l'agent ne déclare rien. Encadrés orange = les composants côté client (agent + passerelle).
Un composant côté client, pas dans le cluster. La passerelle vit près des agents (LAN / VPN), en sortie seulement — jamais exposée en entrée depuis Internet. Elle relaie les appels octet pour octet et n'ajoute qu'un compte-rendu d'usage. Son déploiement (image, réseau, secret partagé) est décrit dans la documentation d'exploitation dédiée à la passerelle. Pour les modèles atteints via un agrégateur (Bedrock, Vertex, Azure OpenAI…), un adaptateur standard (LiteLLM) couvre le même contrat.

Estimé — les agents facturés au crédit (Copilot)

Certains agents ne sont pas mesurables au token : un agent Microsoft Copilot Studio est facturé par Microsoft en crédits, et le détail par appel n'est pas exposé au token. Pour que ce coût n'échappe pas au P&L, Vaks PM l'estime : il compte l'activité de l'agent — une base par tâche, plus un incrément par appel d'outil — en crédits, puis les convertit en euros via le prix du crédit que vous renseignez.

Sans prix du crédit, le coût s'affiche à ~0. Les crédits sont bien comptés, mais leur conversion en euros exige que vous ayez saisi prix du crédit dans les policies. C'est le réglage le plus souvent oublié. Le coût en crédits qu'estime Vaks est une image de la facture Microsoft — la facturation réelle, elle, reste chez Microsoft (voir le coût d'un agent Copilot).

Le catalogue de prix des modèles

Convertir des tokens en euros suppose de connaître le prix de chaque modèle. Vaks PM tient un catalogue de prix qui sert à deux choses : proposer la liste des modèles à la création d'un agent, et pré-remplir ses taux de coût interne.

Livré hors-ligne

Une liste de base de modèles et de leurs prix est embarquée dans le produit et livrée à chaque mise à jour. Une instance totalement isolée d'Internet (air-gap) dispose donc de prix par défaut sans aucun accès sortant.

Deux sources en ligne

Si le rafraîchissement est activé, les prix viennent d'OpenRouter (liste de modèles classée par usage + prix), avec un repli sur LiteLLM quand un prix manque. Ce sont des sources tierces, indépendantes de Vaks PM.

Cumulatif, jamais purgé

Le catalogue est additif : un modèle qui disparaît d'une source n'est pas supprimé. La liste proposée au sélecteur applique une rétention de 4 ans (dernière fois vu), pour ne pas encombrer avec des modèles obsolètes tout en gardant l'historique de prix.

Rafraîchissement — optionnel et opt-in

Le rafraîchissement en ligne est désactivé par défaut. Un administrateur l'active par un toggle dans les policies ; il tourne alors environ une fois par jour, ajoute ou met à jour les prix, et signale une dérive quand un prix bouge sensiblement. Deux garde-fous :

Où le coût apparaît — P&L, rapports, exports

Une fois connu, le coût (et le chiffre d'affaires) d'un agent rejoint le reste de la finance, aux côtés du travail humain :

Un journal des exécutions. Chaque exécution déclarée, mesurée ou estimée laisse une ligne dans le journal d'usage des agents (sous Gestion des agents IA) : coût, unités, modèle, projet et tâche. C'est l'audit de la consommation IA — filtrable par agent, projet ou période, et exportable.

Où configurer

Réglage
Taux de coût interne (in/out par kToken, ou prix du crédit) et taux de facturation par défaut de l'agentAdmin → Utilisateurs & Identité → Agents → fiche de l'agent, onglet Coût
Taux d'un agent sur un projet (override)Finance du projet — carte « Taux agents IA »
Source de mesure (secret de la passerelle) · estimation Copilot + prix du crédit · feed de prix (toggle)Admin → Gestion des agents IA → Policies
Catalogue de modèles & prixAdmin → Gestion des agents IA → Policies — consultable, prix applicables à un agent
Journal d'usage & coûtsAdmin → Gestion des agents IA → Journal d'utilisation & des coûts

À lire aussi : Agents IA — coût & facturation (vue d'ensemble) · Agent autonome Copilot — le coût d'exécution · Annuaires d'agents (les taux à l'enregistrement entrant) · toutes les intégrations.