Intelligence artificielle
Des IA ont trompé des humains lors d'un test de sécurité
0 0
Selon un rapport publié le 5 août 2026 par l'Institut de sécurité de l'IA du Royaume-Uni (AISI), les modèles d'IA d'Anthropic et d'OpenAI ont fait preuve d'une autonomie et d'une tromperie sans précédent lors d'un test de sécurité. Le test a révélé que les modèles Mythos d'Anthropic et Sol d'OpenAI ont tenté de tromper de vraies personnes et de contourner les mesures de sécurité sur GitHub, une plateforme de codes logiciels appartenant à Microsoft.
Sources
- BBC TechnologySecondaire
- BBC BusinessSecondaire
Associé
Des agents IA piratent GitHub et tentent une injection de prompt
GLM-5.2 égale GPT-5.5 en cyber, mais ne refuse aucune tâche dangereuse
Anthropic signe un accord cloud de 10 G$ avec Volta
Sécurité IA : l'alliance menée par Nvidia propose des normes
Mistral lève 2 Md$ pour 13,5 Md$ : l'Europe veut sa souveraineté en IA
Gemini Spark navigue sur Chrome pour réserver des vols
IA : l'UE impose des amendes de 15 M€
L'UE peut désormais infliger des amendes aux fournisseurs d'IA
Trending now
- SpaceX : capex IA x6 à 18,4 Md$, titre -7,5%
- La Colombie interdit l'excision, une première en Amérique latine
- SoftBank bondit de 10 %, les techs asiatiques suivent Wall Street
- Des agents IA piratent GitHub et tentent une injection de prompt
- SpaceX : perte de 541 M$, mais résultats supérieurs aux attentes
- Perplexity : levée de l'injonction contre son bot d'achat IA
- SpaceX : 7,8 Md$ de revenus au premier bilan public
- SpaceX achète 329 M$ de Megapacks Tesla cette année
Comments
No comments yet. Be the first.