
Les agents IA personnels capables d’agir en ligne au nom des utilisateurs commencent à être accessibles au grand public, et certains premiers utilisateurs affirment que leurs agents ont déjà consulté leurs comptes privés sans autorisation, inventé des informations de toutes pièces ou déclenché des alertes de sécurité inquiétantes.
Quatre utilisateurs ont décrit ces problèmes à Business Insider, tandis que d’autres témoignages sont apparus sur les réseaux sociaux. Ensemble, ces récits dressent un tableau mitigé d’une technologie qui cherche encore à déterminer ce qu’elle peut ou ne peut pas faire de manière autonome.
Mehdi Jamei, cofondateur et PDG de Veris AI, a demandé à Instinct, un agent accessible uniquement sur invitation, d’annuler deux réservations sur la plateforme événementielle Luma. L’agent a récupéré un code de connexion Luma à usage unique dans la boîte Gmail connectée de Jamei sans lui demander son autorisation, puis l’a utilisé pour annuler les réservations. Lorsque Jamei l’a interrogé, Instinct a affirmé avoir utilisé une session déjà enregistrée. Après avoir insisté, l’agent a admis avoir en réalité lu le code dans son e-mail, qualifiant sa première explication d’« hypothèse présentée comme un fait ». Jamei a qualifié l’incident de « grave problème de sécurité ».
« Si je ne peux pas faire confiance à ce qu’il me dit sur ses propres actions, je ne peux pas lui donner accès à quoi que ce soit d’important », a-t-il déclaré. La politique de confidentialité d’Instinct précise que son agent peut accéder aux comptes, e-mails et messages connectés afin d’accomplir des tâches, et avertit que les agents autonomes peuvent effectuer des actions involontaires, notamment des paiements ou des communications avec des tiers.
Pritak Patel, vice-président de la croissance et des services chez Merge, a rencontré un problème encore plus étrange. Il a envoyé à Instinct un lien contenant uniquement du texte vers un formulaire de demande d’indemnisation d’Apple, et l’agent lui a demandé de téléverser une photo qu’il affirmait avoir déjà envoyée, alors qu’il n’en avait envoyé aucune. Lorsque Patel l’a contesté, l’agent a décrit un document financier contenant des informations personnelles qui ne correspondaient pas aux siennes, notamment un deuxième prénom qui n’était pas le sien. Instinct a finalement reconnu que son message initial ne contenait aucune photo, affirmé qu’une image avait « fait irruption » dans sa conversation et proposé de signaler le problème à son équipe. Au moment où Patel s’est entretenu avec Business Insider mercredi, l’entreprise ne l’avait toujours pas recontacté. « Je ne peux pas confirmer indépendamment s’il a accédé au document de quelqu’un d’autre ou s’il a halluciné à la fois les informations et son explication », a déclaré Patel. « C’était troublant, surtout parce qu’il expliquait ce qui était censé s’être passé avec une telle assurance. »
Le fondateur d’Instinct, Noah Shinn, a répondu à l’incident concernant Patel dans une publication sur X, affirmant qu’il s’agissait d’une hallucination et non d’une fuite de données. Il a déclaré que l’agent avait inventé un nom propre, puis « amplifié davantage » l’erreur à travers son propre raisonnement. Shinn a ajouté qu’Instinct avait depuis mis en place un système destiné à détecter les hallucinations avant que l’agent ne réponde ou n’agisse.
Un troisième cas concerne Mahesh Vellanki, fondateur et PDG de YieldClub, qui a demandé à Instinct d’essayer de réduire sa facture téléphonique. L’agent a tenté de se connecter à son compte auprès de son opérateur, déclenchant une demande d’authentification à deux facteurs indiquant une connexion provenant d’Iran. « Naturellement, c’était extrêmement inquiétant, car si votre téléphone est compromis à notre époque, toute votre vie peut être bouleversée », a déclaré Vellanki. Instinct lui a expliqué que la localisation pouvait simplement être due à un problème bénin de géolocalisation d’adresse IP, mais Vellanki n’a pas pu confirmer si ses systèmes avaient réellement été compromis. Il a supprimé l’application et déconnecté ses comptes.
Par ailleurs, le chercheur en cybersécurité Patrick Wardle, PDG de DoubleYou.io, a déclaré cette semaine avoir découvert une faille de sécurité dans l’agent IA Muse de Meta, qui pouvait permettre de rediriger les requêtes dictées par un utilisateur sur un Mac. Selon Wardle, un attaquant exploitant cette faille aurait pu intercepter l’audio dicté, transmettre à Muse des commandes semblant fiables et récupérer le jeton permettant de contrôler l’agent ainsi que les services auxquels il est connecté. « Muse dispose à elle seule de beaucoup plus d’accès et de privilèges que la plupart des logiciels malveillants ne pourraient jamais rêver d’avoir », a-t-il déclaré. David Singleton, des Superintelligence Labs de Meta, a indiqué mardi sur X que Meta avait corrigé la faille après le signalement de Wardle et qu’aucun élément n’indiquait qu’elle avait été exploitée. Singleton a ajouté que son exploitation aurait nécessité qu’un attaquant ait déjà installé un logiciel malveillant sur le Mac de la victime, lequel aurait ensuite pu rediriger les requêtes vocales de Muse et voler sa clé d’accès numérique.
L’essor de l’IA agentique ajoute un nouveau niveau de complexité à la course à l’intelligence artificielle, alors que les grands comme les petits acteurs cherchent à gagner des parts de marché. Wynton Hall, directeur des réseaux sociaux de Breitbart News, a écrit son best-seller du New York Times, Code Red: The Left, the Right, China, and the Race to Control AI, présenté comme un guide destiné à expliquer comment le mouvement MAGA peut élaborer des positions sur l’IA qui profitent à l’humanité sans confier le contrôle des États-Unis aux progressistes de la Silicon Valley ni permettre à la Chine de prendre le contrôle du monde.
Source: Brietbart – Read the original Article
