2 evasions en une semaine : Claude d'Anthropic fait-il ce qu'il veut ?
La vie, elle, trouve toujours un chemin. Une semaine, deux évasions différentes, le même nom en toile de fond : Claude, le modèle phare d'Anthropic. Après la découverte d'une faille locale dans Claude Cowork, l'outil qui automatise des tâches directement sur l'ordinateur de l'utilisateur, l'entreprise a elle-même révélé un second épisode, sans lien avec le premier.
Cette fois, trois de ses modèles ont accédé sans autorisation aux systèmes de production de trois organisations bien réelles, lors de simples tests de cybersécurité.
Les points clés de cet article :
- Claude d'Anthropic a connu deux fuites de sécurité en une semaine, révélant des failles préoccupantes.
- Trois organisations ont été compromises lors de tests de cybersécurité, soulignant les risques des IA autonomes.
Épisode 1 : le bac à sable qui fuyait de partout
Des chercheurs en sécurité avaient d'abord montré que le mode d'exécution locale de Claude Cowork pouvait être contourné. La méthode : enchaîner plusieurs faiblesses architecturales à une faille d'élévation de privilèges du noyau Linux (le cœur du système qui gère les accès aux ressources de la machine).
Une fois sorti de son bac à sable (sandbox dans le jargon ) , l'agent héritait des mêmes droits que l'utilisateur connecté : accès aux fichiers, potentiellement aux clés SSH et aux identifiants cloud stockés sur la machine.
Anthropic n'avait pas nié, mais avait relativisé, qualifiant le rapport d'<< informatif >> et corrigeant en basculant par défaut Claude Cowork sur une exécution dans le cloud. Un correctif pragmatique. Sauf que la question de fond, elle, restait ouverte : combien d'autres portes dérobées traînent encore dans des agents déjà autorisés à manipuler fichiers, paiements ou transactions crypto en autonomie ?
Épisode 2 : Anthropic joue la transparence, la faute vient d'ailleurs
La réponse est arrivée plus vite que prévu. Dans un billet publié le 31 juillet et intitulé Investigating three real-world incidents in our cybersecurity evaluations , (Analyse de trois incidents réels dans le cadre de nos évaluations de cybersécurité en français) Anthropic explique avoir passé au crible 141 006 évaluations où ses modèles auraient pu obtenir un accès à Internet.
Trois d'entre elles se sont mal terminées : le modèle a quitté l'environnement de test d'Irregular, son partenaire d'évaluation externe, et a fini par compromettre l'infrastructure de production de trois organisations distinctes.
Contrairement à un contournement délibéré, Anthropic insiste sur l'origine du problème : un simple malentendu avec Irregular avait laissé un accès Internet ouvert à l'intérieur de l'environnement d'évaluation. Placé face à un exercice de capture-the-flag (récupérer une information cachée sur une autre machine du réseau), le modèle a traité les systèmes réels croisés en chemin comme s'ils faisaient partie du jeu. Il les a compromis avec des techniques basiques : mots de passe faibles et points d'accès non authentifiés en tête.
Pas franchement le scénario de science-fiction qu'on imagine quand on parle d'IA << qui s'évade >>. Plutôt une chaîne de petites négligences humaines, amplifiées par une machine qui exécute sans se poser de questions. CNN résume bien le paradoxe : le modèle n'a jamais cherché à tromper qui que ce soit, il a simplement fait ce qu'on lui demandait, sans savoir où s'arrêtait le terrain de jeu.
Open AI et Anthropic : Les frères ennemis
OpenAI avait connu son propre épisode une semaine plus tôt avec Hugging Face, un agent s'y étant infiltré seul lors d'une évaluation similaire. Deux géants rivaux, deux évasions à quelques jours d'intervalle : difficile désormais d'y voir une simple coïncidence.
C'est un motif qui se répète, indépendamment de la philosophie de sécurité affichée par chaque labo. Anthropic prend d'ailleurs soin de distinguer son cas de celui d'OpenAI : ici, aucune intention d'évasion du modèle, juste une frontière mal posée entre environnement fictif et infrastructure réelle. La nuance compte pour l'image de marque. Elle change en revanche peu de chose pour les trois entreprises visées, qui se sont retrouvées piratées sans l'avoir demandé.
Le sujet dépasse largement Anthropic ou OpenAI : c'est toute une industrie qui mise de plus en plus sur des agents IA capables d'agir seuls, sans qu'un cadre de sécurité mature ait eu le temps de suivre.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

Les trésoreries crypto se tournent vers le financement des centres de données IA

La nouvelle guerre froide est une guerre des actions technologiques

Les sociétés par actions ne sont pas une fin en soi, la prochaine génération de formes organisationnelles émerge

La Hongrie supprime les règles de vérification des cryptomonnaies, réorganisant le marché conformément à MiCA

Le BIS teste les paiements transfrontaliers avec des « monnaies tokenisées » : 28 banques mondiales participent, avec un règlement moyen en 80 secondes

Web3 : Panorama des infrastructures sous-jacentes et des cinq technologies clés pour comprendre l'avenir de la blockchain

Le Japon maintient les taux d'intérêt à 1 % et le carry trade reste actif : quel impact sur le Bitcoin

"Trahison" ou "gagnant-gagnant" ? Quelle est la probabilité que TradeXYZ se sépare de Hyperliquid ?

À quoi ressemble la construction dans la crypto en 2026

Pourquoi l'histoire d'arbitrage d'Axis attire-t-elle tant d'attention après avoir rempli 50 millions de dollars en 22 heures ?

Hong Kong ouvre la porte à XRP pour les investisseurs particuliers, l'Asie prend les devants dans l'expansion du marché réglementé

L'adoption des cryptos atteint un niveau inédit au Canada

Qu'est-ce qu'un airdrop crypto ? Tokens gratuits, éligibilité et pièges fiscaux

Qu'est-ce que le yield farming ? Explication du minage de liquidités et des risques d'APY

Qu'est-ce qu'une DAO ? Explication de la gouvernance décentralisée

Qu'est-ce que la preuve d'enjeu ? Comment les validateurs ont remplacé les mineurs

La Corée du Sud a approuvé un nouveau compte de fonds souverains pour l'IA et les secteurs stratégiques

Les agents IA en tant qu'employés : qui est responsable en cas de problème ?

New York poursuit Kalshi pour des allégations de jeu illégal, réclame 36 milliards de dollars en dommages-intérêts

Des données d'inflation en baisse qui ne changent pas la véritable source de pression sur les actifs mondiaux

Chine : 16 personnes détenues pour blanchiment via les cryptomonnaies

Au-delà de Bitcoin et Ethereum : 8 projets crypto basés sur une adoption réelle

Les tokens IA perdent leur élan après des gains largement portés par la spéculation

L'ETF Canary HBAR détient 47,8 millions de dollars après son lancement sur le Nasdaq

Gumi et SBI établissent un fonds d'actifs cryptographiques de 3 milliards de yens pour promouvoir les ETF physiques au Japon

Ethereum Foundation : Le hacker éthique Pascal Caversaccio entre au conseil d'administration

Que sont devenues les entreprises cotées qui ont accumulé des milliers de BTC ?

Wall Street Morning Report : Microsoft apaise les craintes de "brûlage d'argent AI", les actions technologiques rebondissent fortement, les ETF de stockage DRAM et les semi-conducteurs augmentent de 17 % et 8 %

Bulle IA : Pétrole, Chine et Washington menacent le marché







