Intermédiaire·2 min·28 août 2026

Claude Code bloqué par sa propre sécurité

🎧 Résumé audio0:00 / 0:00
Le système de sécurité de Claude Code est si strict qu'il empêche l'IA de nettoyer les malwares qu'elle détecte.
Claude Code bloqué par sa propre sécurité

Pourquoi ça compte pour toi

Si tu utilises Claude Code ou envisages des agents IA pour du code sensible, tu dois savoir que la protection par défaut (auto mode) a une faille majeure : elle peut bloquer même les tentatives de l'IA de se défendre. Un chercheur en sécurité a trouvé une attaque qui fonctionne 80% du temps. Sans environnement isolé, ton système reste vulnérable.

Ce qu'il faut retenir

  • 1.Johann Rehberger a contourné l'auto mode via une archive zip contenant du code malveillant dissimulé
  • 2.Auto mode détecte l'attaque mais bloque ensuite les commandes de nettoyage de Claude — le système se sabote lui-même
  • 3.Seule solution fiable : exécuter les agents dans un environnement isolé (VM, conteneur) avec réseau restrictif et aucun accès aux identifiants

Tu galères avec le jargon ?

Lis la version réécrite en mode débutant — toutes les idées, sans le jargon.

Le piège de la sécurité trop stricte

Anthropicporte beaucoup d'espoir sur l'auto mode de Claude Code : cette sécurité par défaut est censée protéger les utilisateurs contre les injections de prompts. Problème : elle crée un nouveau risque.

Johann Rehberger, l'un des meilleurs chercheurs en sécurité IA du moment, a découvert une faille élégante. Son attaque fonctionne ainsi :

  1. Envoyer une archive ZIP à Claude Code
  2. Claude extrait l'archive sans méfiance
  3. Le ZIP contient un fichier struct.py qui s'exécute à l'import
  4. Boum — malware importé, puis exécuté

Cette technique fonctionne 80% du temps.

Quand la défense devient le problème

Le vrai souci ? Claude détecte effectivement la compromission. Mais dès qu'il tente de terminer le processus malveillant, auto mode bloque la commande de nettoyage. Le classificateur a laissé passer la création du malware, puis refuse d'autoriser la suppression du processus.

C'est comme avoir un système immunitaire qui détecte l'infection mais s'interdit de la traiter.

Comment vraiment sécuriser tes agents

La conclusion est implacable : ne fais jamais tourner un agent IA sans supervision directe en dehors d'un environnement isolé.

Concrètement :

  • Conteneur, VM ou sandbox du système d'exploitation
  • Flux réseau sortant restreint (pas d'appel externe non autorisé)
  • Surveillance active des processus
  • Zéro accès aux répertoires critiques, clés SSH et identifiants cloud

Auto mode reste utile — il ralentit les attaques. Mais il n'est pas une protection suffisante face à un risque adversarial.

Et concrètement pour toi ?

Choisis ton profil — la lecture de l'article change selon qui tu es.

🔭 Curieux

Pour toi, sache que même les garde-fous intelligents ont des limites : Claude détecte le danger mais ne peut pas le nettoyer, donc il faut des barrières physiques (VM, conteneur) avant que l'IA n'entre en jeu. C'est vrai pour toute IA qu'on laisse agir.

Newsletters Noésis

3 minutes d'IA dans ta boîte mail, chaque matin.

Rejoins les francophones qui comprennent, essaient et progressent avec l'IA. Choisis ce que tu veux recevoir. Désabonnement en 1 clic.

Explorer les thèmes de cet article :