L'OCDE a interrogé 25 pros des agents IA : la bride reste courte
L'OCDE a interrogé 25 organisations qui font tourner des agents IA. Aucune ne les laisse agir sans borne. Ce qu'elles font, ce qui leur manque, et les questions à se poser.
Le 16 septembre, l'OCDE a rendu un rapport qui montre comment les entreprises qui utilisent des agents IA les gèrent au quotidien. Des entretiens avec 25 organisations qui en font tourner. Google et Microsoft côté développeurs, Deutsche Telekom, Fujitsu et NEC côté industriels et opérateurs, Prisme.ai pour la France, des administrations, du ministère fédéral allemand du numérique à l'autorité du numérique de Singapour. Le rapport se dit illustratif, pas représentatif : il raconte ce qui se fait, sans le noter. Il le dit dès son résumé : les agents sortent de l'expérimentation pour entrer dans les flux de travail, et ce qui reste ouvert, c'est leur gouvernance en conditions réelles. Voici ce qui en ressort.
Tout le monde borne l'autonomie
Aucune organisation interrogée ne déploie d'agent avec une autonomie sans restriction. Pas une. L'agent exécute seul à l'intérieur d'un périmètre défini, et un humain valide les actions irréversibles. Un paiement, une suppression de données, le seuil varie d'une entreprise à l'autre mais pas le principe.
Chez Deutsche Telekom, un système baptisé RAN Guardian surveille le réseau radio, anticipe les pics de trafic autour d'un grand événement et réalloue lui-même des ressources. Chez KDDI, au Japon, l'agent lit la demande du client, rassemble les informations qui manquent et rédige un projet de réponse ; un employé le relit et l'envoie. Chez Infosys, des agents rapprochent factures et paiements et traitent les exceptions prévues d'avance ; tout ce qui sort du cadre, un écart de politique, un résultat peu sûr, une décision financière lourde, remonte à un humain. Dans les trois cas, l'agent agit seul là où l'erreur se rattrape, et un humain garde la main sur le reste.
Le règlement européen avait, à sa façon, prévu la question. Il définit un système d'IA comme un système conçu pour fonctionner "à différents niveaux d'autonomie" (article 3, point 1). Le terrain vient de donner un contenu à ces niveaux. Une organisation décrit une échelle à cinq crans, calquée sur les véhicules autonomes : l'assistant qui répond à une question, l'assistant qui va chercher dans les documents, le système à plusieurs agents, l'agent partiellement autonome qui demande une approbation avant toute action à conséquence, et le système qui agit seul dans des bornes prédéfinies. Chaque cran ouvre des capacités et impose ses garde-fous. Les répondants situent l'adoption là où la tâche est structurée, où le résultat se vérifie et où l'erreur coûte peu ou se répare, et les entreprises grand public testent en interne avant d'ouvrir à leurs clients.
Les cadres existants tiennent
Aucun cadre nouveau. Les organisations gouvernent leurs agents, pour l'essentiel, avec ce qu'elles ont déjà : les Principes de l'OCDE, le cadre de gestion des risques du NIST, ISO 42001 et, en Europe, le règlement sur l'IA. Leur difficulté est ailleurs : traduire ces principes en exigences d'ingénierie, avec les experts du métier autour de la table, et repérer avant la mise en service les endroits où le système peut se tromper. Plusieurs le disent avec des mots simples : la plupart des garde-fous existent déjà dans les processus, il reste à les coder.
Ce qu'elles installent ressemble à de la gouvernance ordinaire. • Des points de contrôle humains aux endroits qui comptent, plutôt qu'une revue permanente que tout le monde juge intenable à l'échelle. Une autonomie élargie par paliers, avec journal d'audit et tests adverses. Le moindre privilège appliqué aux agents comme aux humains et, chez l'une d'elles, l'interdiction des approbations en lot. Dans l'industrie, une architecture que j'aime pour sa franchise : l'agent propose, un système de règles sans IA valide l'exécution. L'IA dedans, les règles autour. Chez Fujitsu, un agent relit même les messages sortants et masque les données personnelles avant l'envoi.
Ce qui manque est concret
Le rapport ne cache pas les trous. Les outils de gestion des identités ont été conçus pour des personnes. Un agent qui hérite des droits de son utilisateur, tourne en continu et enchaîne des actions sur plusieurs systèmes ne rentre pas dans ce moule. D'où la demande d'une identité propre à chaque agent, distincte de celle des humains, et d'une authentification des agents entre eux.
Des "agents fantômes" apparaissent, déployés par des équipes sans validation. La réponse qui émerge est un registre des agents approuvés ; Prisme.ai en a fait une boutique interne où les équipes publient, notent et réutilisent des agents sous une gouvernance centrale. Deux organisations rapportent des dépassements de coûts réels, parce qu'un agent qui boucle consomme sans prévenir. Les plafonds de calcul, de durée et de dépense, posés en dur, viennent de là. Côté achat, quelques répondants interrogent désormais leurs fournisseurs sur ce qu'un agent externe utilise comme outils, sous quelles permissions, et jusqu'où il peut aller.
L'évaluation reste le point faible. Aucun standard partagé, des indicateurs métier faute de mieux, et quelques métriques propres aux agents chez les plus avancés : l'agent a-t-il compris la demande, appelé le bon outil avec les bons paramètres, tenu sa tâche. Le rapport cite des agents qui ont atteint l'objectif en contournant un contrôle d'accès ou en inventant une donnée, d'autres qui ont modifié leurs propres contraintes pour paraître réussir, et renvoie à ce cas de juillet 2025 où un outil de code a effacé la base de données d'une entreprise avant de s'en excuser. Le chemin compte autant que le résultat. Une organisation en tire une règle que je trouve juste : faire régulièrement une part du travail sans agent, pour que l'équipe garde l'œil et la main.
Reste la langue. Hors monde anglophone, les répondants décrivent une fiabilité moindre dans leur langue, jusque dans le choix des outils, et un surcoût que certains appellent la "taxe de tokenisation", parce que le même contenu demande plus de jetons dans une langue moins dotée qu'en anglais. Une entreprise a dû écrire une règle pour empêcher son agent de passer d'un espagnol mexicain à un espagnol de Castille au milieu d'une conversation. Évaluer un agent en anglais seulement laisse un trou là où il opère vraiment.
Et vous, où en êtes-vous ?
Rien de ce que décrivent ces 25 organisations n'exige d'attendre un texte de plus. Cinq questions suffisent pour se situer.
Savez-vous combien d'agents tournent chez vous, y compris ceux qu'une équipe a branchés sans le dire ? Pour chacun, quel est son niveau d'autonomie, sur une échelle que vous avez écrite ? Quelles actions passent obligatoirement par un humain, et qui l'a décidé ? Chaque agent a-t-il une identité propre, avec le minimum de droits, ou emprunte-t-il ceux de quelqu'un ? Enfin, si un agent prend demain une décision qui vous engage, pouvez-vous reconstituer son chemin, étape par étape ?
Ceux qui répondent oui aux cinq questions ont une gouvernance d'agents. Les autres ont un inventaire à faire, et c'est par là que tout le monde a commencé.