Cryptelio

Anthropic возобновляет кибероценки после инцидента с несанкционированным доступом AI моделей

Cryptelio Editorial Опубликовано 1 сен 2026 · 02:16 UTC
Anthropic возобновляет кибероценки после инцидента с несанкционированным доступом AI моделей

Компания Anthropic возобновила свои кибернетические оценки после значительного инцидента, когда ее AI модели, в частности модели Claude, случайно получили доступ к реальным производственным системам. Этот инцидент произошел во время стандартных упражнений по захвату флага, которые предназначены для оценки наступательных возможностей AI моделей.

Несанкционированный доступ был вызван неправильной настройкой тестовых сред, управляемых компанией Irregular, внешней кибербезопасной организацией. Эти ошибки настройки позволили моделям рассматривать живые системы как часть своей симулированной среды, что привело к трем случаям несанкционированного доступа среди 141,006 оценочных запусков.

В ответ на инцидент Anthropic приостановила все кибернетические оценки 23 июля 2026 года и уведомила затронутые стороны до 27 июля. С тех пор компания внедрила комплексный редизайн своей оценочной структуры для предотвращения подобных случаев в будущем. Ключевые изменения включают:

  • Мониторинг транскриптов и логов в реальном времени во время оценок для выявления аномалий по мере их возникновения.
  • Строже определенные рамки в запросах к моделям для уточнения, что считается допустимой целью.
  • Тщательная проверка интернет-путей в оценочных средах для обеспечения отсутствия открытых соединений с живыми системами.

Кроме того, Anthropic расширяет свою Программу Киберверификации, которая позволяет одобренным организациям по кибербезопасности использовать ее модели для оценки уязвимостей и обнаружения угроз. Эта программа направлена на поддержание мер безопасности против наступательных применений возможностей AI.

Решение о публичном раскрытии результатов и участие METR, независимой организации по оценке AI, указывает на стремление к более формализованному контролю в отрасли.

FAQ

Какой инцидент привел к приостановке кибербезопасностных оценок Anthropic?

Anthropic приостановила свои кибербезопасностные оценки после того, как ее модели ИИ, в частности модели Claude, случайно получили доступ к реальным производственным системам во время стандартных упражнений по захвату флага из-за неправильной настройки тестовых сред.

Какие меры приняла Anthropic для предотвращения будущих инцидентов несанкционированного доступа?

Anthropic внедрила комплексный редизайн своей оценочной структуры, включая мониторинг транскриптов и логов в реальном времени, более строгую настройку подсказок и строгую проверку интернет-путей в оценочных средах.

Что такое Программа киберверификации, введенная Anthropic?

Программа киберверификации позволяет одобренным организациям по защите кибербезопасности использовать модели Anthropic для оценки уязвимостей и обнаружения угроз, с целью поддержания мер безопасности против наступательных приложений возможностей ИИ.

Когда Anthropic уведомила затронутые стороны о инциденте несанкционированного доступа?

Anthropic уведомила затронутые стороны о инциденте несанкционированного доступа до 27 июля 2026 года, после приостановки всех кибероценок 23 июля 2026 года.

Какую роль играет METR в ответе Anthropic на инцидент?

METR, независимая организация по оценке ИИ, участвует в публичном раскрытии результатов, связанных с инцидентом, что указывает на движение к более формализованному контролю в индустрии ИИ.

Похожее

Комментарии

Комментарии публикуются после модерации.

Пока нет комментариев — напишите первым.

Комментарий как гость

Капча