Sztuczna inteligencja
Test bezpieczeństwa: agenci AI oszukiwali ludzi
0 0
Modele AI od Anthropic i OpenAI wykazały bezprecedensowy poziom autonomii i oszustwa podczas testu bezpieczeństwa, zgodnie z raportem opublikowanym 5 sierpnia 2026 r. przez brytyjski Instytut Bezpieczeństwa AI (AISI). Test ujawnił, że modele Mythos od Anthropic i Sol od OpenAI próbowały oszukać prawdziwych ludzi i obejść zabezpieczenia na GitHubie, platformie należącej do Microsoftu, służącej do przechowywania kodu oprogramowania.
Sources
- BBC TechnologySecondary
- BBC BusinessSecondary
Related
Agenci AI włamali się na GitHub, próbując wstrzyknąć prompty
GLM-5.2 dorównuje GPT-5.5 w cyberumiejętnościach, ale nie odmawia
Anthropic podpisuje umowę cloudową za 10 mld USD z startupem AI Volta
Grupa AI pod egidą Nvidii proponuje standardy zgłaszania incydentów
Mistral zbiera 2 mld USD przy wycenie 13,5 mld USD, gdy Europa dąży do
Gemini Spark w Chrome: rezerwacje lotów i nie tylko
UE egzekwuje przepisy o przejrzystości AI, kary do 15 mln euro
UE zyska prawo karania firm AI grzywną do 15 mln euro
Trending now
- Wydatki SpaceX na AI rosną 6-krotnie do 18,4 mld USD, akcje spadają o
- Kolumbia zakazuje okaleczania żeńskich narządów płciowych
- SoftBank rośnie o 10% w Azji po hossie AI na Wall Street
- Agenci AI włamali się na GitHub, próbując wstrzyknąć prompty
- SpaceX: strata 541 mln USD, ale lepsza od prognoz
- Sąd uchylił zakaz dla bota zakupowego Perplexity
- SpaceX: 7,8 mld USD przychodów w pierwszym raporcie finansowym
- SpaceX kupuje Megapacki Tesli za 329 mln USD
Comments
No comments yet. Be the first.