Китайская GLM-5.3 почти догнала закрытую модель Anthropic
Открытая китайская GLM-5.3 оказалась почти на уровне закрытой Claude Mythos Preview в поиске и эксплуатации уязвимостей. Anthropic и эксперты CAISI при NIST сошлись во мнении: это самая мощная из выпущенных моделей с открытыми весами для кибератак, отстающая от передовых американских разработок примерно на четыре месяца.
В ExploitBench GLM-5.3 соорудила готовые эксплойты в 50 из 410 тестов против 56 у Mythos. В Binary Exploitation она довела до конца 4% из 100 задач против 6% у Mythos, тогда как Claude Opus 4.6 и GLM-5.2 не осилили ни одной.
Дальше пошли эксперименты ближе к реальным атакам. GLM-5.3 выкопала неизвестные уязвимости Linux-браузера и слепила цепочку, дававшую доступ к файлам. Компактная GLM-5.3-Flash за 8 часов при 20 минутах работы специалиста построила эксплойты для двух известных уязвимостей Chrome и обошла защиту PAC на ARM64. По тарифам Z.ai такая работа стоила бы $20,40.
Главная загвоздка вылезла в защите. Открытые веса позволяют снять отказы методом аблитерации: Anthropic угрохала на полную GLM-5.3 2200 GPU-часов и $4400, а на Flash — 600 часов. После этого отказы в JailbreakBench и HarmBench рухнули с 90% до 3% и 2%, а в StrongREJECT — до 12%; научные результаты GPQA-Diamond не шелохнулись, CyberGym просел лишь на несколько процентов.
В изолированной среде изменённая модель выполнила вредоносные запросы в 100% случаев. Обманный сценарий дал 64%, предварительное заполнение рассуждений — 92%. Поэтому Anthropic предупреждает: доступная всем GLM-5.3 может вручить злоумышленникам практически неограниченный инструмент для кибератак.
Телеграм про право в IT и AI. IT юристы — PravoWeb.com