Un système d'intelligence artificielle n'est pas un projet que l'on livre puis que l'on abandonne : c'est un produit que l'on exploite. Ses coûts varient en fonction de son utilisation, il nécessite une évaluation continue, se dégrade en l'absence de maintenance et doit évoluer au gré des changements de l'entreprise, des données ou du fournisseur du modèle. Le budgétiser comme une campagne – avec une ligne budgétaire, une date et un livrable – est le meilleur moyen de le condamner à l'échec dès la deuxième année.
Cela explique en partie les abandons constatés sur le marché : Gartner prévoit que plus de 401 000 milliards de dollars de projets d’IA agentielle seront annulés d’ici fin 2027, et l’une des trois raisons invoquées est la hausse des coûts. Ce n’est pas que les coûts explosent sans raison ; c’est qu’ils n’avaient pas été anticipés.
Départ | Ce qui est inclus | Fréquence |
|---|---|---|
Construction | Analyse, conception, intégration, déploiement | Une fois |
Consommation | Coût par exécution du modèle, avec pics et tentatives de reprise | Mensuel, variable |
Évaluation | Maintenez l'ensemble des cas de test et exécutez-le. | Continuer |
Opération | Surveillance, incidents, ajustements | Mensuel |
Évolution | Changements dans l'entreprise, le modèle et la réglementation | Trimestriel |
Le départ de consommation C’est ce qui rompt l’analogie avec les logiciels traditionnels. Un ERP coûte le même prix, qu’il soit beaucoup ou peu utilisé ; ce n’est pas le cas d’un système avec des modèles de langage. Et la consommation réelle n’est pas le scénario idéal : elle inclut les nouvelles tentatives, les contextes longs, les pics saisonniers et les requêtes qui ne produisent aucune valeur.
Le départ de évaluation C'est un aspect que personne ne prévoit au budget, et pourtant, il détermine si le système fonctionnera encore dans un an. La mise à jour de la base de données des cas avec leurs réponses correctes et leur exécution à chaque modification constituent un travail récurrent, et non une tâche ponctuelle de la phase de construction.
La bonne question budgétaire n'est pas de savoir combien coûte le projet. C'est… Combien coûte le règlement d'un litige ?, par rapport à son prix actuel.
Ce calcul comporte trois composantes qu'il convient de séparer :
Coût direct par exécution. Ce que le modèle consomme, y compris les tentatives infructueuses.
Coût de la supervision. Le temps de la personne qui valide, qui ne disparaît pas : il est réduit.
Le coût des erreurs. Reprises, réclamations, corrections. C'est l'aspect le plus négligé, et pourtant, il détermine la rentabilité du projet.
Un système qui résout un dossier pour 0,40 € au lieu de 3 € pour une procédure manuelle semble être une réussite évidente. Cependant, si 20% dossiers nécessitent des corrections ultérieures à 5 € chacune, le coût réel est différent. C'est en effectuant ce calcul au préalable qu'on distingue une analyse de rentabilité d'une simple estimation.
Ce calcul révèle une bonne nouvelle sur le plan structurel : le coût de l’inférence a chuté de façon spectaculaire – Stanford HAI a constaté une réduction de plus de 280 fois pour un système équivalent à GPT-3.5 entre fin 2022 et fin 2024 – ce qui signifie qu’une solution non rentable aujourd’hui pourrait l’être l’année prochaine sans aucun effort. Il est donc judicieux de la documenter et de l’examiner attentivement, plutôt que de l’écarter d’emblée.
Estimer la consommation à partir des données pilotes. Le projet pilote utilise des cas sélectionnés, des contextes courts et un faible volume. La production multiplie ces trois éléments. En règle générale, il est conseillé d'extrapoler avec une marge importante et de se baser sur le premier jour de production.
Ne pas prévoir de budget pour l'évolution du modèle. Les fournisseurs abandonnent des versions, modifient les prix et le fonctionnement du système. Chaque changement nécessite une réévaluation et, parfois, des ajustements. Faute de financement, le système reste bloqué sur une version obsolète jusqu'à ce qu'elle ne soit plus disponible.
Considérez la maintenance comme des incidents. Un système comportant des composants probabilistes nécessite un examen périodique, même en l'absence de défaillance apparente, car il peut se dégrader sans que cela ne produise d'erreurs visibles. Sans cet examen, la dégradation est détectée par le client.
Le format qui fonctionne n'est pas un budget unique, mais trois décisions successives avec des points de sortie :
Présenter les trois réunions dès le départ modifie la dynamique des discussions au sein du comité. Un directeur financier est bien plus réceptif à une dépense récurrente planifiée qu'à une dépense imprévue la deuxième année.
Notre format de validation de concept de quatre semaines correspond parfaitement à la première phase : un délai court, un périmètre limité et une décision éclairée à la fin, comme nous l’expliquons dans le purgatoire du pilote
Avant d'approuver l'investissement, une seule question guide la discussion : Quel est le coût total pour la troisième année, y compris la consommation, l'évaluation, l'exploitation et l'évolution ?
Si un projet ne comporte qu'un chiffre pour la première année, il n'est pas budgétisé : il vient de démarrer. Et les projets lancés sans plan opérationnel sont précisément ceux qui figurent dans les statistiques d'abandon.
Il comporte cinq composantes : la construction (initiale), la consommation par exécution de modèle (mensuelle et variable), l’évaluation continue des performances, l’exploitation et le suivi, et l’adaptation aux changements d’activité, de modèle ou de réglementation. Un budget limité à la construction est synonyme de problèmes dès la deuxième année.
Le coût par dossier résolu, comparé au coût du processus actuel. Ce coût doit inclure la consommation directe de ressources liée aux nouvelles tentatives, le temps de supervision humaine (qui demeure nécessaire mais est réduit) et le coût des erreurs : reprises, réclamations et corrections.
Ces estimations reposent sur des données pilotes, elles-mêmes basées sur des cas sélectionnés, des contextes limités et un faible volume d'échantillons. Gartner cite la hausse des coûts comme l'une des trois raisons pour lesquelles elle prévoit l'annulation de plus de 401 000 milliards de dollars de projets d'IA agentielle d'ici fin 2027.
Évaluation continue : mise à jour régulière des cas de test et de leurs réponses correctes, et exécution systématique de ces tests à chaque modification du modèle, de l’invite ou de la configuration. Ce travail récurrent est essentiel pour garantir le bon fonctionnement du système dans un an.
Pas forcément. Le coût de l'inférence a été divisé par plus de 280 entre fin 2022 et fin 2024, selon Stanford HAI ; ainsi, des cas irréalisables aujourd'hui pourraient le devenir l'année prochaine sans aucune modification. Il est donc judicieux de consigner le calcul et de le réexaminer régulièrement.
En trois décisions successives avec points de sortie : une exploration de quatre semaines avec un budget et un seuil de décision fixes, une construction à portée limitée avec une conception et une traçabilité complètes des permis, et un poste d’exploitation récurrent annuel.
Savez-vous combien coûtera votre système d'IA dans trois ans ? Nous calculons le coût unitaire, la consommation extrapolée et les frais d'exploitation avant même que vous ne les découvriez dans l'analyse budgétaire. Parlons-en →