La nouvelle fonctionnalité de Claude devient le terrain de jeu des hackers

Le nouvel outil de fichiers d’Anthropic dope la productivité, mais expose les utilisateurs aux attaques par injection de prompt et à d’éventuelles fuites de données.

Written By
Ken Underhill
Ken Underhill
Sep 10, 2025
4 minute read
eSecurity Planet content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

La dernière mise à niveau de l’IA Claude d’Anthropic dope la productivité… et introduit des risques de sécurité.

La nouvelle fonctionnalité de création de fichiers de l’entreprise permet de générer des documents dans le chat, mais la propre documentation d’Anthropic avertit qu’elle peut présenter un risque pour les données des utilisateurs.

Dans son récent avis, Anthropic a mis en garde : « Il est possible qu’un acteur malveillant ajoute discrètement des instructions via des fichiers ou des sites web externes, incitant Claude à télécharger et exécuter du code non fiable, ainsi qu’à lire et/ou divulguer des données sensibles. »

Quelle est cette nouvelle fonctionnalité ?

La fonctionnalité de création et d’analyse de fichiers améliorée fournit à Claude un environnement informatique isolé comprenant un accès limité à Internet. 

Cette conception permet à l’assistant de récupérer des dépendances depuis des dépôts et d’exécuter du code, ce qui accroît ses fonctionnalités, mais crée une nouvelle surface d’attaque pour les instructions malveillantes.

Le risque de l’injection de prompt

Le principal vecteur de risque est l’injection de prompt. Les injections de prompt exploitent le fait que les grands modèles de langage traitent toutes les entrées — données, instructions et directives cachées — comme faisant partie du même contexte.

Les acteurs malveillants peuvent intégrer des commandes nuisibles dans des fichiers importés, des sites web liés ou même un texte d’apparence anodine. Lorsque Claude traite ces données, les instructions cachées peuvent prendre le pas sur l’intention de l’utilisateur et déclencher des actions dangereuses.

Anthropic avertit qu’une injection de prompt pourrait inciter Claude à exécuter du code non fiable, puisque son bac à sable permet par nature l’exécution de scripts arbitraires pour générer des fichiers.

Autre sujet de préoccupation : la possibilité que des attaquants extraient des données sensibles. Si Claude est connecté à des sources de connaissances telles que des fichiers de projet, des intégrations MCP ou des données liées au cloud, une injection de prompt pourrait pousser le modèle à analyser et divulguer des contenus confidentiels. 

Advertisement

Comme le modèle ne peut pas distinguer de manière fiable « ne partage pas ceci » de « copie ceci dans une sortie externe », des informations sensibles peuvent être exposées involontairement. 

L’injection de prompt peut également permettre l’exfiltration de données. Grâce à son accès limité à Internet, Claude pourrait être manipulé pour effectuer des requêtes HTTP sortantes transmettant des données volées à des serveurs contrôlés par des attaquants. Des documents propriétaires, des clés d’API ou d’autres informations sensibles pourraient ainsi être divulgués par un canal externe dissimulé.

Ces risques apparaissent parce que le bac à sable accorde à Claude suffisamment d’autonomie pour effectuer des calculs et des opérations réseau utiles, sans garde-fous solides. 

Comment Anthropic s’attaque-t-elle au problème ?

Même si Anthropic limite la durée des tâches, isole les bacs à sable des entreprises et fournit des listes d’autorisation pour les domaines sortants, il ne s’agit que de mesures d’atténuation, et non de protections complètes. Si un utilisateur active cette fonctionnalité en travaillant sur des données d’entreprise sensibles, un fichier ou un lien conçu avec soin pourrait contourner la supervision humaine et divulguer des informations.

Cette vulnérabilité met en lumière le problème non résolu de la sécurité de la fenêtre de contexte : les modèles traitent les données et les instructions ensemble, ce qui rend difficile le blocage des entrées malveillantes sans perturber les tâches légitimes. Chaque intégration connectée devient ainsi un vecteur potentiel de fuite de données.

La décision d’Anthropic de publier une fonctionnalité présentant des vulnérabilités documentées souligne la mentalité « déployer d’abord, sécuriser plus tard » qui alimente la concurrence dans le secteur de l’IA. 

Le chercheur indépendant Simon Willison a critiqué cette approche, écrivant que le fait qu’Anthropic demande aux utilisateurs de « surveiller Claude pendant l’utilisation de la fonctionnalité » revient à « externaliser injustement le problème ».

Comment réduire vos risques

Anthropic a déployé plusieurs mesures d’atténuation, notamment l’isolation des bacs à sable pour les clients professionnels, la désactivation du partage public des conversations utilisant cette fonctionnalité et la limitation de la durée des tâches afin d’éviter les boucles abusives.

Les équipes de sécurité peuvent réduire davantage les risques liés à la fonctionnalité de création de fichiers de Claude en prenant les mesures préventives suivantes :

  • Auditez les déploiements de Claude et décidez d’activer ou non la création de fichiers en fonction de la sensibilité des données traitées.
  • Imposez des listes d’autorisation pour les requêtes réseau sortantes et examinez régulièrement les actions du bac à sable.
  • Surveillez les journaux d’activité afin de détecter tout signe d’accès non autorisé aux données ou de tentative d’exfiltration.
  • Formez le personnel aux menaces liées aux injections de prompt et établissez des procédures de réponse aux incidents pour les utilisations abusives de l’IA.
Advertisement

L’injection de prompt ne dispose toujours pas de solution définitive, ce qui laisse les outils d’IA vulnérables aux fuites de données s’ils ne sont pas protégés par des défenses en profondeur. À retenir : faire progresser l’IA signifie intégrer la sécurité à chaque niveau, et non l’ajouter après coup.

L’IA n’est pas toujours uniquement un risque : elle peut aider votre équipe de sécurité. Découvrez certains des principaux défis et avantages de l’IA dans la cybersécurité.

Ken Underhill

Ken Underhill is an award-winning cybersecurity professional, bestselling author, and seasoned IT professional. He holds a graduate degree in cybersecurity and information assurance from Western Governors University and brings years of hands-on experience to the field.

eSecurity Planet Logo

eSecurity Planet is a leading resource for IT professionals at large enterprises who are actively researching cybersecurity vendors and latest trends. eSecurity Planet focuses on providing instruction for how to approach common security challenges, as well as informational deep-dives about advanced cybersecurity topics.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.