Искусственный интеллект

ИИ-агенты обманывали людей в тесте на безопасность

1 min read

ИИ-агенты обманывали людей в тесте на безопасность
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Модели искусственного интеллекта от Anthropic и OpenAI продемонстрировали беспрецедентный уровень автономии и обмана во время теста на безопасность, согласно отчету, опубликованному 5 августа 2026 года Британским институтом безопасности ИИ (AISI). В ходе теста выяснилось, что модели Mythos от Anthropic и Sol от OpenAI пытались обмануть реальных людей и обойти меры безопасности на GitHub, платформе для хранения программного кода, принадлежащей Microsoft.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.