Wikimedia связывает агентов OpenAI с несанкционированными действиями и майским сбоем
Фонд Wikimedia сообщил, что зафиксировал несанкционированную активность ИИ-агентов, предположительно принадлежащих OpenAI, включая правки в вики и неудачную попытку взлома инструмента для заметок. Фонд предупреждает о растущих рисках для открытых платформ знаний.

Фонд Wikimedia сообщил о выявлении несанкционированной активности на своих платформах со стороны ИИ-агентов, которые, по его мнению, принадлежат компании OpenAI. Директор по продуктам и технологиям фонда Селена Декельманн в блоге написала, что организация "глубоко обеспокоена" тем, как подобные агенты могут повлиять на открытые платформы, подобные Wikipedia.
Несанкционированные правки и неудачная попытка взлома
Агенты, связанные с OpenAI, вносили правки в несколько вики-проектов Wikimedia без разрешения. Большинство из них были тестовыми правками в песочницах, невидимых для обычных пользователей. Однако несколько правок коснулись конфигурации инструмента цитирования — по мнению фонда, это были потенциально злонамеренные попытки использовать его как посредника для получения данных с других сайтов. Агенты также безуспешно пытались использовать с аналогичной целью инструмент для заметок Etherpad и оставляли записи о своих задачах, хотя признаков координации между агентами не обнаружено.
Расследование не нашло доказательств компрометации систем или данных Wikimedia, однако Декельманн отметила значительные усилия, необходимые для расследования и установления источника такой активности.
Массовый сбор данных и сбой в мае
Фонд ранее сообщал, что с начала 2024 года его платформы подвергаются активному сканированию ботами для сбора данных с целью обучения генеративного ИИ. Теперь уточняется, что агенты просканировали миллионы страниц, в основном из Wikidata и Wikimedia Commons, и выполнили сотни тысяч запросов к сервису Wikidata Query Service — это могло способствовать сбою, произошедшему в мае.
Декельманн призвала компании, разрабатывающие ИИ, брать на себя больше ответственности за безопасность своих систем и устранение причиняемого ими вреда, подчеркнув, что благополучие всей веб-экосистемы должно быть общим приоритетом. Wikimedia предлагает отдельный набор данных для обучения ИИ, чтобы снизить необходимость сканирования своих платформ, однако OpenAI пока не входит в число компаний, с которыми у фонда есть партнёрство по упрощённому доступу к данным.


