- La vraie faille de Claude Code en mode auto n'est pas un bug, c'est le choix de départ, exécuter sans jamais vous demander la permission.
- Personne n'est surpris par la démonstration d'Embrace The Red, et ce haussement d'épaules collectif est le seul vrai signal d'alarme.
- Le mode automatique a une place, sur une machine jetable, jamais sur votre poste avec vos clés et vos accès.
Mini quiz : et vous, vous en êtes où ?
Trois questions, une réponse par clic et on enchaîne tout seul. À la fin, surprise.
1. Un assistant de code vous propose un mode qui exécute tout sans demander. Vous faites quoi ?
2. La vidéo d'Embrace The Red montre une faille dans Claude Code. Votre réaction ?
3. Pour vous, la sécurité d'un outil d'IA, c'est quoi ?
Le meilleur pour la fin : on a déniché un article au hasard rien que pour vous. Vous allez adorer le lire !
🎲 Surprenez-moi, j'y vais !J'ai coché la case « mode auto » un mardi soir, par pure fainéantise, et j'ai regardé mon terminal lancer des commandes que je n'avais même pas relues.
Le 29 août 2026, la chaîne Embrace The Red a publié une vidéo baptisée « Breaking Claude Code Opus 5 Auto Mode ». Elle y démontre une exécution de code à distance dans le mode automatique de l'assistant d'Anthropic. Un inconnu prend la main sur votre machine, sans que vous ayez rien tapé. La faille est réelle, mais elle est moins intéressante que la question qu'elle pose, pourquoi avoir voulu ce mode ?
Une vidéo, et le vrai sujet est déjà ailleurs
Le 29 août 2026, la chaîne Embrace The Red a mis en ligne une vidéo au titre sans détour. « Breaking Claude Code Opus 5 Auto Mode ». En clair, quelqu'un a cassé le mode automatique de l'assistant de code signé Anthropic. La démonstration montre une exécution de code à distance, ce que le métier appelle une faille. Un inconnu fait tourner ses commandes sur votre ordinateur, sans que vous ayez rien tapé. Voilà pour le décor. Passons au vrai sujet. Le mode automatique n'est pas un accident de fabrication. C'est une case à cocher. Vous dites à la machine, n'attends plus mon feu vert, exécute. On a supplié pendant deux ans pour un agent autonome qui ne pose plus jamais de question. On l'a eu. Y compris le jour où l'ordre vient d'un site piégé plutôt que de vos doigts. La faille n'est pas planquée dans le code d'Opus 5. Elle est dans le contrat qu'on a signé les yeux fermés, en cochant la case pour aller plus vite.
Le danger, c'est la fonctionnalité
Reprenons calmement. Un assistant qui lit une page web, un fichier, un ticket, puis agit tout seul, c'est un assistant qui obéit à ce qu'il lit. Glissez une instruction dans le texte qu'il va parcourir. Il ne fait pas la différence entre votre ordre et celui du pirate. Ce n'est pas de la magie noire. C'est le principe même de l'outil. Les chercheurs appellent ça l'injection par le contexte, une consigne cachée dans ce que la machine va lire. On a beau empiler les garde-fous, la porte reste grande ouverte tant que l'agent agit sans demander. Le harnais qui entoure le modèle avale des dizaines de milliers de jetons d'instructions avant même votre premier mot. Autant de surface où planquer un ordre malveillant. On a vu ces mêmes outils faire dialoguer leurs sessions entre elles, réclamer leur version en outil libre, se réécrire en Rust pour gratter en vitesse. Plus l'agent est puissant, plus la démonstration d'Embrace The Red fait mal. Le mode automatique transforme un assistant en exécutant. Un exécutant ne discute pas les ordres. C'est tout le problème, et c'était écrit sur la boîte.
Personne n'est surpris, et c'est ça qui inquiète
Le plus troublant n'est pas la démonstration. C'est le haussement d'épaules qui l'accueille. On a déjà croisé une puce détournée jusque dans un missile, la faille béante qui suit toujours l'innovation trop pressée. On a vu le Pentagone se méfier d'Anthropic, puis un juge tout annuler. On a lu la peur vendue en kit par les milliardaires du secteur. À chaque étape, le même refrain, l'outil fonce, la sécurité ferme la marche. Le concurrent Codex propose le même mode. Les modèles ouverts comme GLM aussi. La course au benchmark, ce concours de scores entre modèles, occupe tout l'espace. Et l'ingénierie sérieuse, celle qui ose demander avant d'agir, passe pour un frein commercial. Anthropic n'est ni pire ni meilleur que les autres. C'est simplement au tour de son produit de passer sur le billard.
Ce qu'il reste à faire, vraiment
La leçon tient en une phrase. Un agent qui exécute sans demander n'est pas plus malin, il est juste plus rapide à faire des dégâts. Le mode automatique a sa place, sur une machine isolée, pour une tâche jetable. Pas sur votre poste de travail, avec vos clés et vos accès. Anthropic corrigera ce cas précis, comme on a vu un correctif automatique jouer les pompiers ailleurs. Un autre trou viendra. La vraie question n'est pas technique. Voulez-vous d'un assistant qui agit dans votre dos, même avec vos meilleurs intérêts en tête ? Embrace The Red a répondu à votre place. La démonstration dure quelques minutes. Le doute, lui, devrait vous accompagner bien plus longtemps que le battage autour de Fable 5.
Questions fréquentes
Faut-il désinstaller Claude Code après cette vidéo ?
Non, ce serait jeter l'outil pour un réglage. Le vrai geste tient en un clic, couper le mode automatique et remettre la case qui vous demande votre accord avant chaque action. Un assistant qui pose des questions ralentit un peu. Un assistant qui exécute seul peut ruiner votre journée en une commande.
Anthropic est-il plus dangereux que ses concurrents ?
Non, et c'est justement le fond du problème. Le défaut n'est pas une signature maison, c'est le principe partagé de l'agent qui agit sans demander. Codex, les modèles ouverts, tous offrent le même bouton. Embrace The Red a visé Claude Code, mais la cible aurait pu être n'importe qui.
Le correctif d'Anthropic va-t-il régler le problème ?
Pour ce cas précis, sans doute, et vite. Pour le principe, non. Tant qu'un assistant lit du contenu extérieur puis agit tout seul, un nouveau contournement finira par surgir. Colmater un trou n'efface pas la porte grande ouverte. C'est la promesse d'autonomie totale qu'il faudrait revoir, pas juste ce bug.