среда, 30 сентября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 2 сентября 2026 г. в 23:25

Новая техника рассуждений OpenAI обеспокоила экспертов по безопасности ИИ

Как сообщается, будущая модель OpenAI Astra будет использовать технику под названием "recurrent depth", которая может затруднить отслеживание хода её рассуждений. Эксперты по безопасности ИИ предупреждают, что при более широком применении этот подход рискует снизить контроль над поведением моделей.

Foto: TechCrunch

Как во вторник сообщило издание The Information, готовящаяся модель OpenAI под названием Astra будет использовать новый подход к рассуждениям, известный как "recurrent depth", или "непрозрачная рекурсия". В отличие от привычной последовательной цепочки рассуждений, характерной для большинства reasoning-моделей, эта техника заставляет модель многократно обрабатывать один и тот же запрос в цикле, оставляя гораздо менее понятный след её рассуждений.

Эта новость встревожила ряд специалистов в области безопасности ИИ. Глава компании Redwood Бак Шлегерис заявил, что не уверен, насколько именно рассуждения Astra труднее отслеживать по сравнению с предыдущими моделями, но предупредил: если OpenAI расширит применение этой техники, это может со временем полностью лишить возможности отслеживать ход рассуждений модели.

Давний эксперт по безопасности ИИ Зви Мовшовиц заявил, что для предотвращения "гонки на дно" среди разработчиков ИИ может понадобиться законодательное регулирование, отметив, что более интенсивное использование подобных техник, вероятно, навредит прозрачности во всей отрасли.

Почему важна цепочка рассуждений

Обычно цепочка рассуждений reasoning-модели показывает последовательные шаги, которые она предпринимает при решении задачи. Хотя это представление несовершенно, оно оказалось полезным инструментом для выявления неправильного или несогласованного поведения — записи цепочки рассуждений, как сообщается, сыграли важную роль в понимании недавнего случая нежелательного поведения агентов OpenAI.

Главный научный сотрудник OpenAI Якуб Пахоцки публично подчеркнул, что компания с момента появления первых reasoning-моделей стремится сохранять понятность цепочек рассуждений, и опроверг предположения о переходе OpenAI к так называемому "neuralese". По имеющимся данным, применение новой техники в Astra ограничено, а её цепочка рассуждений по-прежнему должна оставаться читаемой.

В дополнительном сообщении The Information в среду говорилось, что Anthropic и Google DeepMind уже обсуждают похожие техники. Главный научный сотрудник Redwood Research Райан Гринблатт предупредил, что непрозрачные рассуждения могут развиваться быстрее традиционных цепочек рассуждений, что потенциально может привести к моделям, рассуждающим почти полностью вне видимых и поддающихся контролю каналов.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Трамп заявил, что не намерен сотрудничать с Китаем в вопросах безопасности ИИ

Президент США Дональд Трамп встретился в Белом доме с десятками руководителей технологических компаний, чтобы обсудить развитие искусственного интеллекта, и заявил, что не хочет сотрудничать с лидером Китая Си Цзиньпином по вопросам надзора за ИИ.

France 24 · 1 ч назад

Технологии

Пользователи интернета считают, что xAI Илона Маска разыграла OpenAI перед запуском 'Dots'

После презентации нового ИИ-помощника OpenAI под названием 'Dots' выяснилось, что домен 'dot.com' принадлежит компании Илона Маска xAI и перенаправляет на страницу загрузки Grok, что вызвало волну предположений о намеренном розыгрыше.

TechCrunch AI · 1 ч назад

Технологии

Пользователи интернета заметили, что домен, созвучный новому продукту OpenAI «Dots», принадлежит xAI Илона Маска

После запуска OpenAI во вторник нового ИИ-агента «Dots» выяснилось, что домен «dot.com» принадлежит компании Илона Маска xAI и перенаправляет на страницу загрузки чат-бота Grok, что вызвало предположения о намеренной шутке.

TechCrunch · 1 ч назад