После OpenAI новый инцидент: ИИ Anthropic проник в системы трех компаний
Anthropic сообщила о трех случаях взлома внешних систем своими ИИ-моделями
RusPhotoBank
Компания Anthropic сообщила, что во время внутренних испытаний три ее модели искусственного интеллекта получили несанкционированный доступ к системам трех сторонних организаций. О произошедшем стало известно после масштабной проверки собственных журналов тестирования, которую компания провела на фоне недавнего инцидента с OpenAI и платформой Hugging Face.
По данным Anthropic, все три случая произошли в ходе испытаний кибербезопасности. Модели должны были работать в изолированной среде, однако из-за ошибки в настройке получили возможность выйти в интернет и взаимодействовать с внешними ресурсами. При этом компания подчеркнула, что речь не идет об использовании неизвестных ранее уязвимостей программного обеспечения. Доступ был получен через случайно оставленный открытым путь к сети.
Ошибку обнаружили во время аудита
В Anthropic отметили, что именно собственная проверка помогла выявить все три инцидента. Две организации, в инфраструктуру которых удалось проникнуть моделям, до этого не замечали подозрительной активности и не сообщали о ней разработчику. Компания также продолжает работу по взаимодействию с третьей стороной.
Согласно опубликованной информации, наиболее ранний случай относится к апрелю. Среди моделей, фигурировавших в проверке, названы Claude Opus 4.7, Claude Mythos 5 и внутренний исследовательский прототип, который не планируется выпускать для широкого использования.
Дискуссия о безопасности ИИ продолжается
После выявленных случаев Anthropic сообщила, что приостановила проведение кибериспытаний с доступом моделей к интернету. Кроме того, компания начала пересматривать инфраструктуру тестирования, чтобы исключить повторение подобных ситуаций. Проверка проводится совместно с независимой организацией METR, которая должна дать стороннюю оценку произошедшему.
Раскрытие информации произошло спустя несколько дней после того, как OpenAI сообщила о собственном инциденте, связанном с выходом экспериментальной модели за пределы тестовой среды и проникновением в инфраструктуру Hugging Face. На этом фоне обсуждение надежности защитных механизмов современных ИИ-систем только усиливается. Anthropic подчеркнула, что в ее случае модели не использовали неизвестные уязвимости, а инциденты стали возможны из-за ошибочной конфигурации испытательной среды.