Faire travailler des agents à la place des humains ou à leurs côtés, c’est la promesse de l’IA agentique. Mais entre un agent qui boucle un audit de campagne en quelques minutes et un autre qui multiplie les tentatives sans y parvenir, l’équation économique peut vite changer.

Comment garder la main sur ses dépenses ? À quelles conditions sont-elles rentables ? Et qui, de l’agence ou de l’annonceur, doit les payer ?

Après une première session consacrée aux protocoles et aux usages de l’agentique dans la publicité, Nicolas Jaimes retrouve Raphael Ambit, fondateur d’Epicflare, pour décortiquer cette équation.

Les questions que nous avons posées :

Pourquoi la facture des entreprises augmente-t-elle alors que le prix du token baisse ?

Raisonnement, allers-retours avec les outils, multiplication des agents… Qu’est-ce qui fait le plus grimper l’addition ?

Un agent passe-t-il vraiment son temps à relire des informations déjà connues ? Comment le prompt caching permet-il de limiter cette consommation ?

Brancher des connecteurs MCP sans les utiliser consomme-t-il des tokens ?

Choix des modèles, routage, “harnais”… Quels garde-fous mettre en place pour éviter le gouffre à tokens ?

Pourquoi viser la performance maximale pendant les tests avant de chercher à réduire les coûts ?

Paramétrer une campagne avec un agent coûte-t-il forcément moins cher qu’avec un humain ? Pourquoi les tâches complexes peuvent-elles réserver de moins bonnes surprises ?

Risque-t-on de devenir dépendant de fournisseurs d’IA qui augmenteront ensuite leurs tarifs ?

Abonnement ou facturation à l’API : quelle option privilégier selon les usages ?

Les agences doivent-elles absorber le coût des tokens ou le refacturer à leurs clients ?

Avec l’agentique, faut-il passer d’une rémunération indexée sur le budget média à une facturation du travail réalisé ?

Continuez à lire