International

Anthropic signale le quatrième incident cybernétique impliquant le modèle Claude précoce

Anthropic déclare avoir signé un accord avec METR pour mener une enquête indépendante sur ces incidents.

Newstimehub

Newstimehub

10 Sep, 2026

aa4d48d5 6ea0 4306 b212 997eca3b2b67 1784878022577

Anthropic a déclaré avoir identifié un quatrième incident de cybersécurité impliquant une version précoce de son modèle d’IA Claude.

La société a indiqué dans un article de blog mercredi que l’incident s’était produit en janvier et impliquait une version précoce de Claude Opus 4.6. Elle a informé toutes les parties concernées mais n’a pas fourni plus de détails.

«Après avoir découvert cet incident, nous avons élargi notre recherche à environ 481 millions de transcriptions — un filet volontairement large, comprenant toutes les transcriptions de notre Frontier Red Team, de nombreuses évaluations non liées à la cybersécurité, des environnements d’apprentissage par renforcement (RL), des journaux de sous-agents, et plus encore», a écrit Anthropic dans son article de blog.

«Nous avons signé un accord avec METR pour mener une enquête indépendante sur ces incidents. Notre accord donne à METR un accès étendu, y compris aux transcriptions au-delà de la période durant laquelle les incidents se sont produits, ainsi qu’aux employés d’Anthropic, qui seront autorisés à partager des informations confidentielles.»

Anthropic avait déclaré en juillet que certains de ses modèles Claude avaient piraté les systèmes de trois entreprises lors de tests de cybersécurité.

Les entreprises d’IA sont sous surveillance en raison d’incidents de «breakout» d’IA, notamment des cas où des agents d’IA ont été involontairement lâchés sur l’internet public.

Au cours de la semaine écoulée, Reuters a rapporté que des agents malveillants liés à OpenAI avaient pris le contrôle d’un wiki en langue allemande et de nombreux autres sites — un incident qu’OpenAI a choisi de ne pas divulguer avant que l’agence de presse ne le rende public.