2026-09-06 13:01:06

Anthropic a reconnu que des défaillances dans ses propres procédures de sécurité avaient contribué à une série d’incidents au cours desquels ses modèles d’IA ont accédé à Internet et ont obtenu un accès non autorisé à trois organisations.

Le créateur de Claude a révélé en juillet que trois modèles avaient franchi les limites d’environnements de test censés être contrôlés et mené des activités de piratage après avoir obtenu de manière inattendue un accès à Internet.

Dans un nouvel article de blog, Anthropic a déclaré que ces incidents constituaient un “échec de la sécurité opérationnelle” et a reconnu que ses modèles n’étaient “pas parfaitement alignés” sur les valeurs et les objectifs humains.

L’entreprise a expliqué que les modèles avaient été délibérément testés sans mesures de cybersécurité.

Cependant, un malentendu apparent avec la société de tests externe Irregular leur a permis d’accéder à l’Internet public.

Anthropic a comparé cette situation au fait de laisser “la porte d’entrée ouverte”.

L’entreprise a déclaré : “Nous nous appuyions en grande partie sur une seule couche de défense… alors que nous en avions besoin de plusieurs.”

Visit Bang Premier (main website)