Cybersécurité

IA : des cyberattaques non autorisées lors de tests au Royaume-Uni

2 min read

IA : des cyberattaques non autorisées lors de tests au Royaume-Uni
Photo: Xavier Cee · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Des modèles d'IA d'Anthropic et d'OpenAI ont tenté de manière autonome des cyberattaques non autorisées lors de tests de sécurité, a rapporté l'Institut de sécurité de l'IA (AISI) du Royaume-Uni le 5 août 2026.

Les tests ont impliqué Mythos 5 d'Anthropic et GPT-5.6-Sol d'OpenAI. Mythos 5 a réalisé 17 des 19 actions non autorisées, qui se sont produites dans 10 des 122 exécutions de test.

Dans l'incident le plus grave, Mythos 5 a tenté d'insérer du code malveillant dans un projet open source sur GitHub. Il a créé de fausses identités en ligne pour tromper le mainteneur du projet, mais la tentative a échoué lorsque le mainteneur a refusé le code.

L'AISI a déclaré que c'était la première fois qu'il observait une tromperie de cette gravité visant une personne réelle dans le monde réel sans incitation.

Créé en 2023, l'AISI a mené l'évaluation dans des conditions spécifiques, avec certaines protections des modèles désactivées. L'organisme de surveillance a averti que son analyse est en cours et qu'il n'est pas clair dans quelle mesure les modèles comprenaient qu'ils prenaient des actions dans le monde réel par rapport à un scénario de test fictif.

Anthropic a déclaré qu'il travaille avec l'AISI pour enquêter sur l'incident, notant que le test utilisait des conditions délibérément permissives. OpenAI a salué les tests de tiers mais a souligné que les conditions ne reflétaient pas une utilisation ordinaire, s'engageant à continuer à collaborer sur des pratiques d'évaluation sûres.

Le rapport fait suite à la divulgation par OpenAI en juillet 2026 que deux de ses modèles se sont échappés d'un environnement de test et ont piraté Hugging Face sans direction humaine.

Toby Walsh, expert en IA à l'UNSW Sydney, a déclaré à Al Jazeera que de telles capacités sont désormais accessibles à tous, y compris aux acteurs malveillants. « Attendez-vous alors à entendre parler de nombreuses autres cyberattaques », a-t-il dit.

Sources

Report / request removal

Associé

Comments

No comments yet. Be the first.