На 29 септември червеният екип на Anthropic публикува анализ на GLM-5.3 на Zhipu AI (Z.ai), модел с отворени тегла. По техни данни той изгражда цялостни експлойти с честота, близка до Claude Mythos Preview, а предпазителите му се заобикалят в 64 до 100 на сто от случаите в симулирани тестове. Оценката е на конкурент и така трябва да се чете.
- На ExploitBench GLM-5.3 стига до цялостен експлойт в 50 от 410 опита, Mythos Preview в 56 от 410.
- Абликацията, която маха отказите от теглата, им е струвала около 4400 долара и почти не е отнела способности.
- Anthropic се позовава и на NIST CAISI: най-способният в киберсигурността модел с отворени тегла досега.
20,40 долара.
Толкова по цените на API-то на Zhipu би струвала работата на по-малкия GLM-5.3-Flash по верига от експлойти за две известни дупки в Chrome. Двайсет минути човешко внимание и осем часа машинна работа. Тестът е на Anthropic, в изолирана среда, срещу мишени, които самите те са поставили.
Първо очевидното. Anthropic оценява конкурент и има интерес от извода. Mythos е затворен, GLM-5.3 се тегли свободно, и текстът стига до призива повече защитници да получат достъп до най-силните модели. Четеш го, като помниш това.
Само че числата не висят единствено на тяхната дума. По думите на Anthropic находките им за способностите съвпадат в общи линии с тези на CAISI. Спорът е по-малко дали моделът може и повече кой още може да го ползва.
За защитниците това значи едно: способност, която досега стоеше зад програми с проверка на хората, вече е на диска на всеки, който си я свали. Anthropic признава и другата страна, че същият модел може да помага на защитниците. Колко от двете ще се случи, ще се види в отчетите за злоупотреби, не в бенчмарковете.
Заглавията ще кажат „китайски модел хаква“. По-точното е друго: способност, която през пролетта имаше само в една затворена лаборатория, вече е свободна. Отворени тегла не се прибират обратно.