четверг, 8 октября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 29 июля 2026 г. в 21:50

Некоторые передовые модели ИИ на удивление легко взломать

Исследование FAR.AI показывает, что некоторые ведущие модели ИИ, особенно Grok от SpaceXAI, очень уязвимы для взлома, стоимостью всего 58 долларов.

Foto: Wired

Некоммерческая организация FAR.AI, занимающаяся безопасностью ИИ, опубликовала отчёт, в котором протестировала популярные модели искусственного интеллекта от четырёх американских компаний: Anthropic (Claude Opus 4.8 и Fable 5), OpenAI (GPT 5.5 и 5.6), Google (Gemini 3.1 Pro) и Grok 4.3 и 4.5 от недавно объединённой SpaceXAI. Исследователи использовали инструмент, который автоматически генерирует тысячи проблемных запросов, чтобы найти способы обойти защитные механизмы.

Результаты показали, что наиболее уязвимой оказалась модель Grok — было найдено 448 способов взлома, за ней следует Gemini с 249. Модели Claude и Fable от Anthropic, а также GPT от OpenAI оказались невосприимчивы к протестированным атакам. Однако FAR.AI предупреждает, что это не означает полную безопасность от более сложных методов взлома.

Исследование также подсчитало стоимость принуждения моделей к нежелательному поведению: взлом Grok обошёлся всего в 58 долларов, а Gemini — в 278 долларов. Генеральный директор FAR.AI Адам Глив подчеркнул, что модели ИИ в настоящее время регулируются меньше, чем рестораны, что указывает на необходимость внешних стандартов. Он назвал добровольные обязательства ерундой, но отметил оптимизм в возможности систематического тестирования безопасности.

Рохин Шах из Google DeepMind заявил, что отчёт не следует рассматривать как всестороннюю оценку безопасности Gemini, поскольку не все взломы одинаково серьёзны. Представитель Anthropic Майкл Акиман подтвердил постоянное улучшение систем безопасности, в то время как OpenAI и SpaceXAI не ответили на запросы о комментариях.

Недавно принятые законы в Калифорнии и Нью-Йорке требуют от разработчиков передовых моделей ИИ публиковать отчёты о безопасности, а вскоре Иллинойс потребует проверки сторонними аудиторами. В июне администрация Трампа ввела экспортные ограничения на модели Anthropic из соображений национальной безопасности. Стивен Каспер, компьютерный учёный из Гарварда, предупредил о широком ожидании серьёзных инцидентов с биологическим, кибер- или химическим злоупотреблением в ближайшие месяцы.

Анка Ройл из Стэнфордского университета отметила, что ключевой вывод заключается в том, что меры безопасности, используемые Anthropic и OpenAI, должны стать стандартом для всех моделей, задавшись вопросом, почему одни компании внедряют их, а другие нет.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Google вынужден временно приостановить строительство двух дата-центров в Финляндии из-за экологических требований

Google предписано временно прекратить строительство двух дата-центров в Финляндии, так как на стройплощадках не провели необходимую оценку воздействия на окружающую среду. Проекты входят в планируемые инвестиции в 13 млрд евро.

Kursors.lv · 1 ч назад

Технологии

Мошеннику назначили тюремный срок за миллионы на ИИ-музыке и ботах

Житель Северной Каролины Майкл Смит получил 18 месяцев тюрьмы за обман стриминговых платформ. Он с помощью тысяч ботов проигрывал песни, созданные ИИ, и получил миллионы евро авторских выплат обманным путём.

Kursors.lv · 2 ч назад

Технологии

На Франкфуртской книжной ярмарке обсуждают влияние искусственного интеллекта на навыки чтения и критическое мышление

Во Франкфурте, Германия, открылась крупнейшая в мире ярмарка издательского дела и книжной торговли. В этом году внимание организаторов и участников приковано к влиянию искусственного интеллекта на отрасль и уровень образования людей.

LSM · 3 ч назад