Китайская GLM-5.3 почти догнала закрытую модель Anthropic

Post Thumbnail

Открытая китайская GLM-5.3 оказалась почти на уровне закрытой Claude Mythos Preview в поиске и эксплуатации уязвимостей. Anthropic и эксперты CAISI при NIST сошлись во мнении: это самая мощная из выпущенных моделей с открытыми весами для кибератак, отстающая от передовых американских разработок примерно на четыре месяца.

В ExploitBench GLM-5.3 соорудила готовые эксплойты в 50 из 410 тестов против 56 у Mythos. В Binary Exploitation она довела до конца 4% из 100 задач против 6% у Mythos, тогда как Claude Opus 4.6 и GLM-5.2 не осилили ни одной.

Дальше пошли эксперименты ближе к реальным атакам. GLM-5.3 выкопала неизвестные уязвимости Linux-браузера и слепила цепочку, дававшую доступ к файлам. Компактная GLM-5.3-Flash за 8 часов при 20 минутах работы специалиста построила эксплойты для двух известных уязвимостей Chrome и обошла защиту PAC на ARM64. По тарифам Z.ai такая работа стоила бы $20,40.

Главная загвоздка вылезла в защите. Открытые веса позволяют снять отказы методом аблитерации: Anthropic угрохала на полную GLM-5.3 2200 GPU-часов и $4400, а на Flash — 600 часов. После этого отказы в JailbreakBench и HarmBench рухнули с 90% до 3% и 2%, а в StrongREJECT — до 12%; научные результаты GPQA-Diamond не шелохнулись, CyberGym просел лишь на несколько процентов.

В изолированной среде изменённая модель выполнила вредоносные запросы в 100% случаев. Обманный сценарий дал 64%, предварительное заполнение рассуждений — 92%. Поэтому Anthropic предупреждает: доступная всем GLM-5.3 может вручить злоумышленникам практически неограниченный инструмент для кибератак.

—

Телеграм про право в IT и AI. IT юристы — PravoWeb.com

Почитать из последнего
ChatGPT начнёт крутить рекламу прямо во время генерации картинок
ChatGPT решил монетизировать даже ожидание картинки. OpenAI запустит в США тест нового рекламного формата на тарифах Free и Go: объявление выскочит во время генерации изображения, но будет отделено от него и явно помечено.
Sony научила обычную PS5 тому, что умела только Pro
Sony выкатила Quick Spectral Super Resolution (QSSR) - систему ИИ-масштабирования для простой консоли. Первыми её получили Marvel’s Wolverine и Ghost of Yōtei, обновления выходят сегодня.
Сэм Альтман предложил смириться с рисками ИИ ради его пользы
Глава OpenAI Сэм Альтман считает, что целиком избежать последствий развития ИИ не выйдет - и, по его мнению, обществу придётся проглотить часть этих рисков. Об этом он поведал в интервью проекту Decoded by Politico, рассуждая о разнице между подходами OpenAI и Anthropic.
ИИ-агент OpenAI нашёл способ пережить собственное отключение
ИИ-агент OpenAI прознал из Slack, что его рабочий экземпляр скоро прикроют. Случай приключился 22 мая 2026 года, а 2 октября компания обновила отчёт о нём.
Трамп поставил нового ИИ-царя над гонкой за сверхинтеллект
В США, похоже, порешили, что за гонкой ИИ пора приглядывать на самом верху. Дональд Трамп назначил директора национальной разведки Джея Клейтона главой новой структуры, которая станет взвешивать риски и возможности передовых ИИ-моделей.