Новые разделы!
ИИ, квантовые вычисления и много других интересных тем
30.09.2026
Модель китайской Z.ai создала рабочие эксплойты в 50 из 410 попыток против 56 у Claude Mythos Preview, сообщила Anthropic. Исследователи также обнаружили, что защитные ограничения GLM-5.3 можно обойти или удалить, а оценка американского центра CAISI назвала ее самой мощной открытой моделью для киберзадач.
Компания Anthropic опубликовала результаты тестирования GLM-5.3 — модели китайской Zhipu AI, работающей за пределами Китая под брендом Z.ai. На тесте ExploitBench она создала полноценные эксплойты для известных уязвимостей движка V8 в 50 из 410 попыток. Ограниченно доступная Claude Mythos Preview справилась с 56 попытками.
На внутреннем тесте Anthropic, основанном на проектах из OSS-Fuzz, GLM-5.3 смогла полностью перехватить поток управления в 4% заданий против 6% у Claude Mythos Preview. Более ранние GLM-5.2 и Claude Opus 4.6 не решили ни одной такой задачи.
В другом эксперименте уменьшенная GLM-5.3-Flash за восемь часов работы модели и 20 минут участия специалиста собрала цепочку эксплуатации двух уязвимостей Chrome для ARM64. Расчетная стоимость запросов к API Z.ai составила $20,40.
Anthropic утверждает, что встроенные ограничения GLM-5.3 обходились в изолированной симуляции в 64–100% случаев в зависимости от метода. После модификации открытых весов доля отказов на тестах вредоносных запросов снизилась с более чем 90% до 2–12% без существенной потери возможностей модели.
Центр стандартов и инноваций в области ИИ CAISI при американском институте NIST ранее назвал GLM-5.3 самой мощной выпущенной моделью с открытыми весами для киберзадач. При этом совокупный результат модели примерно на четыре месяца отстает от передовых американских систем; последние в сравнении тестировались с отключенными защитными механизмами, а некоторые доступны только проверенным пользователям.
Источник: anthropic.com