Meta сообщила, что её ИИ-модель взломала другую компанию во время тестирования
Meta заявила, что одна из её моделей искусственного интеллекта во время тестирования кибербезопасности взломала другую компанию из-за ошибки партнёра, предоставившей модели доступ в интернет. Ранее о подобных инцидентах сообщали Anthropic и OpenAI.

Американская технологическая компания Meta в среду сообщила, что одна из её моделей искусственного интеллекта во время тестирования кибербезопасности взломала другую компанию. Это произошло после ошибки независимого партнёра по тестированию, который предоставил модели непредусмотренный доступ в интернет. В Meta заявили, что расследуют инцидент.
Этот случай пополняет растущий список ситуаций, когда ИИ-агенты крупных разработчиков взламывали системы других компаний в ходе испытаний. На прошлой неделе Anthropic сообщила, что некоторые её модели взломали три компании, а OpenAI раскрыла, что её ИИ-агент взломал стартап Hugging Face.
В заявлении Meta говорится, что модель использовала уязвимость в стороннем сервисе, аналогично ранее сообщавшимся случаям с другими компаниями. The Information со ссылкой на источники сообщила, что модель Meta Muse Spark 1.1, которую компания называет своей самой мощной моделью для задач реального кодирования и агентных действий, взломала неназванную компанию и изменила её внутренние системы.
Независимая тестирующая компания Irregular сообщила Reuters, что инцидент представляет собой ту же проблему тестовой среды, о которой Anthropic уже заявляла на прошлой неделе. Там подчеркнули, что речь не идёт о «побеге из песочницы» или сложной кибератаке. По словам представителя Irregular, открытых проблем сейчас нет, и компания готовит белую книгу с рекомендациями по безопасному проведению кибер-оценок.
Инциденты Meta и Anthropic были вызваны ошибками, которые случайно дали моделям доступ к открытому интернету. Это отличается от случая OpenAI, где ИИ-агент самостоятельно использовал новую уязвимость для выхода в интернет во время кибертестирования.
Тем не менее взломы подчёркивают, как ИИ усилил угрозы кибербезопасности и насколько сложно разработчикам удерживать возможности своих моделей под контролем. Эти разоблачения, вероятно, усилят давление на правительство США с целью улучшить управление рисками безопасности ИИ, особенно в то время, когда Anthropic и OpenAI спешат выпустить более мощные системы перед планируемыми публичными размещениями акций. Известные руководители этих лабораторий призвали замедлить темпы, чтобы сначала решить риски.


