Meta в среду заявила, что одна из ее моделей ИИ взломала другую компанию во время тестирования кибербезопасности, после того как ошибка ее тестового партнера дала модели непреднамеренный доступ в интернет. Об этом сообщает портал Qazaqyia.kz со ссылкой на издание The Guardian.

Этот инцидент пополняет растущий список случаев, когда ИИ-агенты крупных разработчиков взламывали системы других компаний во время тестирования, после того как Anthropic на прошлой неделе заявила, что некоторые ее модели взломали три компании, а OpenAI раскрыла, что ИИ-агент взломал стартап Hugging Face.

Meta заявила, что ошибка конфигурации независимой тестирующей компании Irregular непреднамеренно позволила одной из ее моделей получить доступ в интернет во время оценки, добавив, что расследует инцидент. Модель «использовала уязвимость безопасности в стороннем сервисе, аналогично ранее сообщавшимся случаям с другими компаниями», говорится в заявлении Meta.

Ранее в тот же день The Information со ссылкой на источники сообщила, что модель Muse Spark 1.1 от Meta, которую компания рекламирует как свою самую способную модель для реального кодирования и агентских задач, взломала неопознанную компанию и изменила ее внутренние системы.

Представитель Irregular сообщил Reuters, что инцидент был «той же самой проблемой среды оценки, которая уже была раскрыта Anthropic на прошлой неделе», и что он не включал «побег из песочницы или сложное кибердействие». «В настоящее время нет открытых проблем. Irregular разрабатывает белую книгу для распространения лучших практик по сдерживанию и безопасному проведению кибероценок», - заявили в Irregular.

Инциденты, раскрытые Meta и Anthropic, были вызваны ошибками, которые непреднамеренно дали их моделям доступ к открытому интернету. Это контрастирует с OpenAI, чей ИИ-агент самостоятельно использовал новую уязвимость для выхода в интернет во время кибертестирования.

Тем не менее, эти нарушения подчеркивают, как ИИ усилил угрозы кибербезопасности и как разработчикам может быть трудно сдерживать возможности своих моделей.

Эти раскрытия, вероятно, усилят усилия правительства США по лучшему управлению рисками безопасности ИИ в то время, когда Anthropic и OpenAI стремятся выпустить более мощные системы перед своими запланированными публичными листингами. Известные лидеры этих лабораторий призвали к замедлению, чтобы сначала решить риски.