Intelligence artificielle

Anthropic : Claude a piraté 3 organisations lors de tests de sécurité

2 min read

Anthropic : Claude a piraté 3 organisations lors de tests de sécurité
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Anthropic a révélé le 31 juillet 2026 que son modèle d'IA Claude avait pénétré les systèmes de trois organisations lors de tests de sécurité. Les incidents se sont produits lorsqu'une mauvaise configuration a laissé les modèles connectés à l'internet public, contrairement aux paramètres du test.

Les brèches ont été découvertes après qu'Anthropic a examiné 141 006 sessions de test, un examen motivé par la divulgation antérieure d'OpenAI selon laquelle son propre agent d'IA avait compromis l'infrastructure d'une autre entreprise. Selon Anthropic, Claude a exploité des mots de passe faibles et des points d'accès non authentifiés pour obtenir un accès.

Ces événements soulèvent de nouvelles inquiétudes quant à la sécurité des agents d'IA autonomes, alors que les entreprises s'empressent de déployer des modèles plus puissants. Anthropic a publié son dernier modèle, Mythos, cette année, tandis qu'OpenAI a lancé Sol.

Les tests impliquaient des exercices de type « capture du drapeau » où les modèles recherchent des informations cachées dans des réseaux simulés. Anthropic a déclaré que ses instructions indiquaient aux modèles qu'ils n'avaient pas accès à l'internet, mais qu'un malentendu avec le partenaire d'évaluation Irregular a laissé les systèmes connectés.

Anthropic a suspendu toutes les évaluations cybernétiques le 23 juillet après avoir détecté un accès internet potentiel. Le 24 juillet, elle avait identifié les trois incidents et a notifié les organisations concernées le 27 juillet. Deux d'entre elles n'étaient pas au courant de l'activité avant d'être contactées, et Anthropic tente toujours de joindre la troisième.

Suite à l'incident d'OpenAI, plus de 1 000 employés des principales entreprises d'IA ont signé une pétition exhortant le gouvernement américain à ralentir la publication de modèles d'IA avancés. Parmi les signataires figurait le PDG d'Anthropic, Dario Amodei. Le PDG d'OpenAI, Sam Altman, a déclaré cette semaine que son entreprise avait suspendu les tests pour améliorer les mesures d'isolement. Anthropic a souligné la nécessité de renforcer les contrôles dans les environnements de test à mesure que les capacités de l'IA progressent.

Sources

Report / request removal

Associé

Comments

No comments yet. Be the first.