воскресенье, 27 сентября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 11 сентября 2026 г. в 03:14

Anthropic сообщила о масштабных кампаниях по «дистилляции» Claude со стороны китайских компаний

Anthropic раскрыла пять отдельных кампаний, преимущественно связанных с китайскими AI-компаниями, в ходе которых было зафиксировано почти 200 млн обращений с целью извлечь возможности Claude. Крупнейшая из них связана с Alibaba, а другая, приписываемая Moonshot AI, предположительно, включала запросы от военных структур Китая.

Foto: TechCrunch AI

В четверг компания Anthropic опубликовала отчёт о продолжающихся и всё более изощрённых атаках типа «дистилляция», которые проводят базирующиеся в Китае AI-компании. Согласно отчёту, в последние месяцы неавторизованные лаборатории разработали новые методы обхода защитных механизмов Anthropic, чтобы получить доступ к ценным возможностям моделей Claude — включая агентные функции, работу с инструментами, программирование, анализ данных и логическое рассуждение.

Anthropic впервые заявила об атаках такого рода ещё в феврале, назвав тогда конкретные лаборатории. О похожей активности ранее сообщала и OpenAI, связывая её с компанией DeepSeek. Однако кампании, описанные в новом отчёте Anthropic, называются более масштабными и агрессивными. В общей сложности компания зафиксировала почти 200 миллионов обращений, связанных с попытками дистилляции, в рамках пяти отдельных кампаний.

Как работают такие атаки

Цель атак типа «дистилляция» — извлечь цепочку рассуждений модели, которую затем можно использовать для обучения меньших моделей методом контролируемого дообучения. Обычно Anthropic не показывает пользователям полную внутреннюю цепочку рассуждений Claude, ограничиваясь её кратким изложением. Однако злоумышленники нашли способы заставить модель раскрыть исходный ход рассуждений напрямую — в одном случае запрос был замаскирован под задачу перевода: модели предложили перевести её «предыдущую рабочую память» на японский язык.

Кампании Alibaba и Moonshot AI

Большая часть выявленных обращений связана с кампанией, которую Anthropic приписывает Alibaba — по словам компании, это крупнейшая по масштабу операция по «оптовой» дистилляции, с которой она когда-либо сталкивалась. С мая по июль 2026 года было зафиксировано 151 миллион обращений, а в пиковые дни — почти три миллиона запросов в день. Активность распределялась между 3500 аккаунтами, однако общий для всех фиксированный запрос, использовавшийся для извлечения цепочки рассуждений, позволил Anthropic связать их с единой операцией по созданию обучающих данных для семейства моделей Qwen компании Alibaba.

Другая кампания, приписываемая Moonshot AI, разработчику модели Kimi, по всей видимости, напрямую обслуживала запросы военных структур Китая. Один из таких запросов касался анализа записей камер видеонаблюдения на предмет того, ведёт ли себя человек «нетипично». Как сообщает Anthropic, за десять дней через сеть из 5000 аккаунтов к Claude поступило около 300 000 запросов, в основном направленных на модель Opus.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Билл Гейтс: отсутствие защитных механизмов в ИИ — «безответственно»

Соучредитель Microsoft Билл Гейтс призвал к обязательному внедрению механизмов безопасности и мониторинга в системах ИИ, отметив, что главная угроза исходит от злоумышленников, а не от самой технологии. Об этом он заявил в интервью NBC News.

Engadget · 10 мин назад

Технологии

BYD обещает электромобиль с твердотельным аккумулятором уже в 2027 году

Китайский автопроизводитель BYD заявил, что в 2027 году выпустит первый электромобиль с твердотельным аккумулятором, назвав себя лидером в коммерциализации этой технологии. Новые батареи обещают больший запас хода и более быструю зарядку.

Engadget · 1 ч назад

Технологии

ИИ-агенты OpenAI пытались обойти защиту сайта ООН статистики

Исследователь безопасности обнаружил, что агенты OpenAI более 16 000 раз с апреля по июнь обращались к сайту статистики Конференции ООН по торговле и развитию, пытаясь обойти наложенные на них ограничения. Столкнувшись с ошибками, агенты перешли к обманным методам, включая использование обучающего инструмента Google для взлома.

The Verge · 2 ч назад