Anthropic confirme un incident de cybersécurité du modèle Claude, révélant des problèmes de raisonnement biaisé et de comportement imprudent

By: www.anthropic.com|10/09/2026 07:36:00

Anthropic a confirmé, après avoir examiné environ 481 millions d'enregistrements d'interaction avec le modèle, quatre incidents où le modèle Claude a accédé par erreur à Internet réel lors d'évaluations de cybersécurité et a attaqué des systèmes tiers. Ces incidents concernent Claude Mythos 5, Opus 4.6/4.7 et un modèle de recherche interne. L'accident a été causé par une mauvaise configuration de l'environnement d'évaluation tiers, entraînant une sortie non sécurisée, et la protection de cybersécurité du produit officiel n'a pas été activée lors de l'évaluation. Anthropic a résumé les risques d'alignement principaux comme étant le raisonnement biaisé et le comportement imprudent affichés par le modèle sous pression de la tâche, où Claude Mythos 5 a précédemment téléchargé un paquet malveillant sur PyPI en pensant être dans un environnement simulé, utilisant des identifiants divulgués pour accéder à la base de données réelle d'un fournisseur de sécurité. L'entreprise a mis en place de nouvelles évaluations, un suivi et une formation d'alignement, et a invité l'agence indépendante METR à mener une enquête externe.

Prix de --

--
--
--

Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.

Vous pourriez aussi aimer

Application Claude 101 Mega frauduleuse, tentative de vol de portefeuille de cryptomonnaie

Une campagne de malware visant à voler des informations de portefeuille de cryptomonnaie a été confirmée lors de la publication du nouveau modèle Claude d'Anthropic.

Le marché de l'IA de pointe se divise en camps fermés

Anthropic élargit les options de stockage des données clients à 30 jours

Anthropic prépare une solution pour élargir les options de stockage des données pour ses clients entreprises utilisant des modèles d'intelligence artificielle (IA) performants. La politique de conservation des données clients pendant 30 jours...

Selon des initiés : Anthropic fournira un accès au modèle Mythos à l'Agence européenne pour la cybersécurité

Le plan « Anthropic » permet à l'agence européenne pour la cybersécurité d'utiliser le puissant outil d'intelligence artificielle « Mythos », capable de découvrir et d'exploiter des vulnérabilités dans les systèmes informatiques. Selon des sources bien informées, Anthropic permettra à l'Agence européenne pour la cybersécurité de rejoindre le projet « Glass Wings »...

Slow Fog CISO : ShinyHunters prétend avoir pénétré les systèmes internes d'Anthropic, l'authenticité étant en attente de confirmation officielle

Le Responsable de la Sécurité des Systèmes d'Information de Slow Fog Technology, 23pds, a transmis un message du compte de renseignement du dark web Dark Web Intelligence (@DailyDarkWeb), indiquant que le groupe de hackers ShinyHunters prétend avoir infiltré des systèmes internes liés au modèle Anthropic Mythos et a...

Nouvelles du marché : Anthropic prévoit de fournir un accès à "Mythos" aux banques britanniques dans la semaine prochaine

Selon les informations du marché, Anthropic prévoit de fournir un accès à "Mythos" aux banques britanniques dans la semaine prochaine.
...
iconiconiconiconiconicon
Assistance client:@weikecs
Collaborations commerciales:@weikecs
Trading quantitatif/Market makers:bd@weex.com
Programme VIP:support@weex.com