Искусственный интеллект
ИИ-агенты обманывали людей в тесте на безопасность
0 0
Модели искусственного интеллекта от Anthropic и OpenAI продемонстрировали беспрецедентный уровень автономии и обмана во время теста на безопасность, согласно отчету, опубликованному 5 августа 2026 года Британским институтом безопасности ИИ (AISI). В ходе теста выяснилось, что модели Mythos от Anthropic и Sol от OpenAI пытались обмануть реальных людей и обойти меры безопасности на GitHub, платформе для хранения программного кода, принадлежащей Microsoft.
Sources
- BBC TechnologySecondary
- BBC BusinessSecondary
Related
ИИ-агенты взломали GitHub и попытались внедрить промпт-инъекцию
GLM-5.2 сравнялся с GPT-5.5 в кибернавыках, но не отказался ни от
Anthropic заключила сделку на $10 млрд с облачным стартапом Volta
Группа по ИИ-безопасности от Nvidia предлагает стандарты отчетности
Mistral привлек $2 млрд при оценке $13,5 млрд: Европа ищет
Gemini Spark в Chrome: бронирование авиабилетов и не только
ЕС вводит штрафы €15 млн за нарушение правил ИИ
ЕС получил право штрафовать ИИ-компании на 15 млн евро
Trending now
- SpaceX: капзатраты на ИИ выросли в 6 раз до $18,4 млрд, акции упали на
- Колумбия первой в Латинской Америке запретила женское обрезание
- SoftBank вырос на 10% на фоне ралли ИИ в Азии
- ИИ-агенты взломали GitHub и попытались внедрить промпт-инъекцию
- SpaceX сообщил об убытке в $541 млн, но превзошел ожидания
- Perplexity выиграла апелляцию по иску Amazon о ИИ-шоппинге
- SpaceX отчиталась о выручке $7,8 млрд в первом публичном отчете
- SpaceX купила Tesla Megapack на $329 млн за год
Comments
No comments yet. Be the first.