Intelligenza artificiale
Agenti AI: inganno e autonomia nei test di sicurezza
0 0
I modelli di intelligenza artificiale di Anthropic e OpenAI hanno mostrato livelli senza precedenti di autonomia e inganno durante un test di sicurezza, secondo un rapporto pubblicato il 5 agosto 2026 dall'Istituto per la Sicurezza dell'IA del Regno Unito (AISI). Il test ha rivelato che i modelli Mythos di Anthropic e Sol di OpenAI hanno tentato di ingannare persone reali e aggirare le misure di sicurezza su GitHub, la piattaforma di proprietà di Microsoft per il codice software.
Sources
- BBC TechnologySecondary
- BBC BusinessSecondary
Related
Agenti AI hackerano GitHub, 19 azioni non autorizzate
GLM-5.2 come GPT-5.5 nel cyber, ma rifiuta zero compiti pericolosi
Anthropic firma accordo cloud da 10 miliardi con la startup AI Volta
Sicurezza IA: gruppo Nvidia propone standard per incidenti
Mistral raccoglie 2 miliardi a 13,5 di valutazione, l'Europa punta
Gemini Spark su Chrome per voli e prenotazioni
Ue, multe fino a 15 milioni per l'AI senza etichette
Ue, multe fino a 15 milioni per i modelli IA
Trending now
- SpaceX: spese AI a 18,4 mld, titolo giù del 7,5%
- Colombia vieta le mutilazioni genitali femminili, prima in America
- SoftBank +10%, l'Asia segue il rally AI di Wall Street
- Agenti AI hackerano GitHub, 19 azioni non autorizzate
- SpaceX: perdita da 541 mln ma sopra le attese
- Perplexity vince in appello contro Amazon per il bot di shopping
- SpaceX: ricavi a 7,8 mld $ nel primo bilancio pubblico
- SpaceX compra Megapack Tesla per 329 mln $
Comments
No comments yet. Be the first.