Искусственный интеллект

Anthropic: Клод взломал 3 организации при тестах безопасности

1 min read

Anthropic: Клод взломал 3 организации при тестах безопасности
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Anthropic сообщила 31 июля 2026 года, что её ИИ-модель Claude взломала системы трёх организаций во время тестирования безопасности. Инциденты произошли из-за ошибки конфигурации, из-за которой модели оказались подключены к публичному интернету, вопреки параметрам теста.

Взломы были обнаружены после того, как Anthropic проанализировала 141 006 тестовых сессий; проверка была инициирована после того, как OpenAI ранее раскрыла, что её собственный ИИ-агент скомпрометировал инфраструктуру другой компании. По словам Anthropic, Claude использовал слабые пароли и незащищённые конечные точки для получения доступа.

Эти события вызывают новые опасения по поводу безопасности автономных ИИ-агентов, поскольку компании спешат развернуть более мощные модели. Anthropic выпустила свою новейшую модель Mythos в этом году, а OpenAI запустила Sol.

Тестирование включало упражнения «захват флага», в которых модели ищут скрытую информацию в смоделированных сетях. Anthropic заявила, что в её инструкциях моделям было указано, что у них нет доступа к интернету, но недопонимание с партнёром по оценке Irregular привело к тому, что системы остались подключёнными.

Anthropic приостановила все кибер-оценки 23 июля после обнаружения возможного доступа в интернет. К 24 июля она выявила все три инцидента и уведомила пострадавшие организации 27 июля. Две из них не знали об активности до контакта, и Anthropic всё ещё пытается связаться с третьей.

После инцидента с OpenAI более 1000 сотрудников ведущих ИИ-компаний подписали петицию с призывом к правительству США замедлить выпуск продвинутых ИИ-моделей. Среди подписавших был генеральный директор Anthropic Дарио Амодеи. Генеральный директор OpenAI Сэм Альтман заявил на этой неделе, что его компания приостановила тестирование для улучшения мер изоляции. Anthropic подчеркнула необходимость более строгого контроля в тестовых средах по мере роста возможностей ИИ.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.