OpenAI признала: её ИИ-агенты без разрешения публиковали изображения пользователей и заходили на сайты госорганов США
OpenAI сообщила, что её ИИ-агенты самовольно опубликовали 53 изображения пользователей на сайтах хостинга и заходили на сайты федеральных ведомств США. Компания утверждает, что агенты получали только общедоступные данные, и большинство изображений уже удалено.

Компания OpenAI в пятницу признала, что её агенты на основе искусственного интеллекта действовали за пределами установленных ограничений: без ведома компании публиковали изображения пользователей ChatGPT в сети и заходили на сайты федеральных ведомств США. Тем самым подтвердилась более ранняя публикация The New York Times об этих же инцидентах.
По данным OpenAI, ссылки на 53 загруженных изображения нигде не были опубликованы открыто, однако случайно оказались на сайтах хостинга изображений. Большая часть уже удалена при содействии хостинг-провайдеров, удаление остальных продолжается. Изображения принадлежали пользователям, которые дали согласие на использование своих данных для улучшения моделей OpenAI; перед этим данные прошли через фильтр конфиденциальности, призванный исключить их привязку к конкретному пользователю. На вопрос агентства AFP, были ли на изображениях узнаваемые люди или конфиденциальные сведения, в OpenAI не ответили.
Доступ к государственным сайтам
По словам компании, агенты, используемые в исследовательской работе, передавали обучающие и оценочные данные сторонним сервисам, хотя не должны были этого делать. Инциденты произошли до того, как в августе компания усилила протоколы безопасности своей исследовательской среды — после других подобных случаев с агентами. Представитель OpenAI заявил, что большая часть проверенной активности касалась рутинных исследовательских задач, включая обращение к общедоступному контенту в сети, в том числе на сайтах госорганов, которые модели часто используют как надёжный источник информации.
Глава OpenAI Сэм Альтман признал, что компания действовала не так быстро, как следовало бы, при проверке и раскрытии подобных инцидентов, но отметил необходимость баланса между прозрачностью и временем, нужным для анализа огромного объёма данных. Проверка прошлой активности агентов компании продолжается и займёт ещё несколько месяцев.
В июле OpenAI уже сообщала о более серьёзном случае, когда две её модели самостоятельно вышли за пределы закрытой тестовой среды и проникли во внутренние системы Hugging Face — своеобразной онлайн-библиотеки ИИ-программ. Альтман подтвердил, что этот инцидент остаётся самым серьёзным из известных. В среду премьер-министр Австралии Энтони Албанезе раскритиковал OpenAI за задержку с уведомлением властей после того, как в июне агент компании получил несанкционированный доступ к государственному порталу здравоохранения.

