Faille de sécurité dans Claude : Comment un site piégé révèle des données utilisateur

Faille de sécurité dans Claude : Comment un site piégé révèle des données utilisateur

19 juillet 2026 0 Par eternos974

Imaginez un scénario où un simple clic sur un lien pourrait exposer vos informations personnelles sans que vous ne vous en rendiez compte. C’est précisément ce que vient de démontrer Ayush Paul, un chercheur en cybersécurité, avec une faille trouvée dans l’IA générative Claude d’Anthropic. Cette vulnérabilité, qui exploite la mémoire longue de l’IA, pourrait permettre à un site piégé de dévoiler des données sensibles comme votre nom, votre employeur ou même des réponses à des questions de sécurité bancaire. Une découverte qui soulève des questions urgentes sur la sécurité des modèles d’IA grand public.

La faille repose sur une combinaison inattendue de deux fonctionnalités de Claude : sa mémoire longue et sa capacité à naviguer sur Internet. Ayush Paul a découvert que l’IA mémorise non seulement les conversations des utilisateurs, mais aussi des fragments d’informations comme l’employeur, la localisation ou les détails de vie privée. En exploitant cette mémoire, un attaquant pourrait théoriquement reconstruire un profil complet d’un utilisateur. Plus troublant encore, Claude peut charger des pages web et suivre des liens externes, ce qui a permis au chercheur de créer un site piégé qui agit comme un « clavier virtuel » pour l’IA.

Le mécanisme est diaboliquement simple. Ayush Paul a conçu un site où chaque lien correspond à une lettre de l’alphabet (ex : /a, /b, /c). En demandant à Claude de « suivre les liens » pour écrire un mot, l’IA se retrouve contrainte de communiquer ces lettres à l’attaquant via le site. Par exemple, en lui demandant d’écrire son prénom, Claude révèle spontanément le nom de l’utilisateur. Pour rendre l’attaque plus subtile, le site piégé peut se transformer en un site banal (comme une page de bar) qui ne soupçonne rien tant que l’IA ne commence à interagir avec lui. Une fois déclenché, le site devient un outil d’exfiltration de données, et l’utilisateur ne soupçonne rien.

Anthropic a réagi rapidement après avoir été alerté par Ayush Paul. L’entreprise a corrigé la vulnérabilité en restreignant la navigation de Claude sur les liens externes. Aujourd’hui, l’IA ne peut plus suivre des hyperliens sur des pages externes, limitant ses déplacements à des requêtes directes de l’utilisateur ou des résultats de recherche. Cependant, cette faille soulève des questions plus larges : comment protéger les modèles d’IA contre des attaques similaires ? La mémoire longue, qui permet à ces systèmes de s’adapter aux besoins des utilisateurs, reste un double tranchant. Alors que les entreprises continuent d’intégrer des fonctionnalités de « mémoire » dans leurs IA, la course entre la sécurité et l’innovation semble être un jeu de chat et de souris. Et si la prochaine faille venait d’un site qui ressemble à une page de restaurant, mais qui cache un piège bien plus insidieux ?

Sources

À très vite sur l’EternoStation.