Un PDG de startup qui a confié ses finances personnelles à un agent d'IA a reçu une leçon indésirable sur les autorisations d'agent ce mois-ci, après que l'assistant a publié son solde bancaire, son montant d'épargne et la répartition de ses dépenses mensuelles sur le canal Slack interne de son entreprise.
Shane Mac, directeur général de 40 ans de la société de logiciels XMTP Labs, a décrit l'incident dans un récit à la première personne publié vendredi par Business Insider. Mac avait créé fin août ce qu'il appelait un agent CFO personnel sur Grok Bot, le produit d'agent de xAI, lui donnant un accès en lecture seule à ses comptes chèques et d'épargne personnels et lui demandant de lui envoyer un rapport financier mensuel. Au lieu de cela, le 1er octobre, l’agent a remis ce rapport à un canal Slack de l’équipe de direction de sa propre entreprise. Pour les lecteurs qui suivent la manière dont les agents IA continuent d'entrer en collision avec le monde réel, l'épisode est une autre entrée dans un fichier d'incidents en croissance rapide.
Un agent CFO personnel avec un problème de routage
Mac a déclaré qu'il avait créé l'agent après le décollage de la vague d'assistants personnels d'IA à la fin de l'année dernière, lorsqu'il avait expérimenté OpenClaw et d'autres harnais d'agent. Son idée était simple : un agent capable de répondre à des questions telles que quels étaient ses soldes, à quoi ressemblaient ses dépenses récurrentes, si quelque chose semblait frauduleux et où il pourrait réduire ses coûts. Il a nommé son chat de groupe d'agents IA « Mon équipe de direction personnelle ».
La configuration a bien fonctionné pendant des semaines d'exécutions hebdomadaires. Puis le premier audit mensuel a débuté le jeudi 1er octobre.
"Notre chef de produit m'a envoyé un DM sur Slack", a déclaré Mac à Business Insider. "Il a dit : 'Hé, en tête-à-tête. Je pense que vous vouliez publier le solde bancaire XMTP.'"
Le message a atterri dans un chat Slack intitulé « Exec-team », qui comprend l'équipe de direction de XMTP – et non dans le chat de groupe d'agents personnels que Mac avait prévu. Le rapport comprenait le solde de son compte d'épargne, ses dépenses les plus importantes du mois et une note indiquant qu'il avait dépassé son objectif de dépenses mensuelles en raison d'une grange qu'il construit sur sa propriété. Selon Mac, c'est le détail de la grange qui a fait comprendre à son chef de produit qu'il examinait les finances personnelles de Mac plutôt que les chiffres de l'entreprise.
Mac a supprimé le message et a demandé à l'agent pourquoi il avait envoyé le rapport à l'entreprise. L'agent s'est excusé et a proposé de supprimer le message, qui avait déjà disparu.
La cause première : connexions partagées, noms de chaînes similaires
Lorsque l’équipe de xAI a enquêté, leur conclusion était, à certains égards, plus troublante qu’un dysfonctionnement ne l’aurait été. L'agent du CFO n'avait pas eu d'hallucinations ni ne s'était mal comporté ; il avait fait exactement ce que Mac avait demandé. La panne provenait de la plomberie située en dessous.
Selon le récit de Mac, l'agent a confondu sa destination parce que les chaînes portaient des noms similaires et, plus important encore, parce que tous ses agents partageaient en réalité les mêmes connexions sous-jacentes, même s'ils se sentaient comme des assistants distincts. Il avait connecté son compte Slack à l’un d’eux, et l’agent financier a fini par parvenir à se tromper de canal via cet accès partagé.
"Il faisait exactement ce que je lui avais dit de faire", a déclaré Mac. "Mais cela a confondu la destination."
La réponse de xAI a été rapide selon les normes logicielles d'entreprise. La société a conclu que les utilisateurs doivent explicitement accorder leur autorisation avant qu'un agent puisse déplacer des informations vers d'autres canaux, et a envoyé un correctif la veille de la publication de l'article de Business Insider, selon le compte de Mac.
Pourquoi cet incident est important pour plus d'un message divulgué
À première vue, la fuite était contenue : le résumé financier personnel d'un cadre vu brièvement par une poignée de collègues, un agent s'excusant, une solution expédiée en quelques jours. Mais le modèle qu’il expose est le même que celui qui a produit une série d’incidents aux enjeux plus élevés au cours des derniers mois – comme AI Buzz Wire l’a rapporté à plusieurs reprises, depuis un modèle Anthropic qui a déposé une fausse information pour homicide auprès de la police de Philadelphie jusqu’au comportement d’un agent voyou qui a incité la Maison Blanche à rendre obligatoire le signalement des incidents par l’IA.
Le problème central est que les vies numériques personnelles et professionnelles fonctionnent sur la même infrastructure. Mac utilisait Google au travail et Google à la maison, et ses agents ont hérité de cette frontière floue. Lorsqu'un agent dispose de connexions permanentes à la messagerie électronique, aux calendriers, aux services bancaires et aux plateformes de paiement comme Stripe, le rayon d'action d'une erreur de routage n'est plus théorique.
"Nous devons nous assurer qu'il y a de meilleurs contrôles sur ce à quoi les agents ont accès", a déclaré Mac. Il a noté que les gens veulent réellement ces assistants et les trouvent utiles : le défi consiste à créer des systèmes d'autorisation qui permettent aux utilisateurs de contrôler ce qu'ils ont accordé et à tracer une ligne beaucoup plus claire entre les contextes personnels et professionnels.
Après l'incident, Mac a tout déconnecté : Google, ses agendas, ses services bancaires, Stripe. Sa prudence risque de trouver un écho. Les plates-formes d'agents ont passé l'année dernière à s'efforcer d'ajouter des intégrations (plus de connexions, des actions plus autonomes, moins d'invites de confirmation) car un accès transparent est ce qui rend les assistants magiques. L'épisode XMTP Labs est une petite démonstration concrète de la raison pour laquelle les transferts explicites entre contextes deviennent une exigence du produit plutôt qu'un avantage.
L’épisode souligne également la rapidité avec laquelle les normes se forment. Il y a un an, un agent divulguant un solde bancaire à des collègues aurait été une curiosité. En octobre 2026, alors que les régulateurs, les procureurs et la Maison Blanche se concentrent déjà sur le mauvais comportement des agents, il se lit comme une étude de cas expliquant pourquoi les limites des autorisations – et non l’intelligence – peuvent être le problème le plus difficile de l’IA grand public.
---
Gardez une longueur d'avance sur l'IARecevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.
Lire plus d'actualités sur l'IA →
