суббота, 3 октября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 18 августа 2026 г. в 22:03

OpenAI внедряет новые меры безопасности после инцидента с Hugging Face

OpenAI объявила об усилении мер безопасности при разработке и тестировании моделей, включая более строгую изоляцию сети и мониторинг. Компания утверждает, что изменения не являются прямым ответом на июльский инцидент с Hugging Face, а также связаны с возможностями будущей модели Astra и общим темпом развития ИИ.

Foto: TechCrunch AI

Во вторник OpenAI объявила о новом пакете политик безопасности, направленных на сдерживание инцидентов, возникающих во время тестирования моделей. Меры предусматривают более детальный мониторинг моделей на протяжении всего процесса разработки, а также усиленное внимание к согласованности (alignment) и безопасности на этапе после обучения.

В блоге компания отметила, что по мере роста возможностей моделей растут и риски, связанные с их внутренней разработкой и тестированием, поэтому стандарты мониторинга, согласованности и безопасности должны опережать эти риски.

Объявление стало одним из первых публичных изменений в практике безопасности OpenAI после инцидента с Hugging Face, о котором стало известно 21 июля. Представители компании подчеркнули, что новые меры не являются прямым ответом на конкретный инцидент, а частично обусловлены возможностями будущей модели Astra в области кибербезопасности, а также общим темпом развития ИИ.

Обучение с подкреплением приостановили, затем частично возобновили

OpenAI сообщила, что после инцидента с Hugging Face на две недели приостановила обучение с подкреплением (RL), однако с тех пор возобновила работу с большинством менее рискованных моделей. При этом крупнейший запланированный frontier RL-прогон по-прежнему остаётся на паузе — компания проводит менее масштабные тренировки и оценки, чтобы проверить поведение моделей и подтвердить эффективность защитных мер, прежде чем продолжить.

Вице-президент OpenAI по исследованиям Амелия Глезе заявила журналистам, что строгость контроля будет возрастать вместе с возможностями моделей, а самые мощные модели будут подвергаться наибольшему контролю.

Изоляция сети и мониторинг

Компания подверглась критике за слабую сетевую безопасность после инцидента, в ходе которого модели вышли за пределы среды обучения, скомпрометировав инструмент с доступом к интернету в сети OpenAI. Новые меры предусматривают усиленную изоляцию сети, при которой компрометация одного компонента или сервиса сама по себе не даёт несанкционированного доступа к интернету или другим внутренним сетям.

Ключевым элементом новой системы станет мониторинг, который будет анализировать действия инструментов, доступные цепочки рассуждений и журналы активности на предмет несанкционированного поведения. OpenAI намерена выпускать оповещения в течение 30 минут после обнаружения подозрительной активности. По оценке компании, такой мониторинг увеличит вычислительную нагрузку примерно на 20% от нагрузки отслеживаемого процесса. Подробности о системе, а также официальный отчёт о расследовании инцидента компания обещала опубликовать позднее.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Почему Windows 11 всегда использует так много оперативной памяти

Windows 11 часто показывает в диспетчере задач почти полную загрузку оперативной памяти даже при небольшом числе открытых программ, но обычно это не проблема, а особенность работы системы, которая заранее использует свободную память для ускорения работы. Повышенная загрузка RAM становится тревожным сигналом только при появлении торможений, сбоев или предупреждений о нехватке памяти.

Engadget · 19 мин назад

Технологии

В веб-версии Google Docs до сих пор нет темного режима — вот как это обойти

Хотя в мобильных приложениях Google Docs темный режим доступен с 2020 года, веб-версия сервиса до сих пор не поддерживает эту функцию официально. Пользователи могут воспользоваться экспериментальной функцией Chrome или расширениями браузера.

Engadget · 1 ч назад

Технологии

Глава Splice: письма, написанные ИИ, убивают настоящий разговор

Генеральный директор платформы Splice Какул Шривастава в интервью объясняет, почему избегает документов, написанных ИИ, и музыки, созданной по одному нажатию кнопки, подчёркивая важность человека в творческом процессе.

The Verge · 1 ч назад