we_are_coded.by CODE · Светът, декодиран
EN
Anthropic

Anthropic: китайският GLM-5.3 строи работещи експлойти почти като Mythos, а предпазителите му падат с прости трикове

Anthropic · събитието: 29 септември 2026Контрол

На 29 септември червеният екип на Anthropic публикува анализ на GLM-5.3 на Zhipu AI (Z.ai), модел с отворени тегла. По техни данни той изгражда цялостни експлойти с честота, близка до Claude Mythos Preview, а предпазителите му се заобикалят в 64 до 100 на сто от случаите в симулирани тестове. Оценката е на конкурент и така трябва да се чете.

Накратко
  • На ExploitBench GLM-5.3 стига до цялостен експлойт в 50 от 410 опита, Mythos Preview в 56 от 410.
  • Абликацията, която маха отказите от теглата, им е струвала около 4400 долара и почти не е отнела способности.
  • Anthropic се позовава и на NIST CAISI: най-способният в киберсигурността модел с отворени тегла досега.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

20,40 долара.

Толкова по цените на API-то на Zhipu би струвала работата на по-малкия GLM-5.3-Flash по верига от експлойти за две известни дупки в Chrome. Двайсет минути човешко внимание и осем часа машинна работа. Тестът е на Anthropic, в изолирана среда, срещу мишени, които самите те са поставили.

Фактите: на 29 септември 2026 г. Frontier Red Team на Anthropic публикува анализ на GLM-5.3, модел на Zhipu AI, известна извън Китай като Z.ai. По данни на Anthropic на ExploitBench, който мери експлойти за известни дупки в двигателя V8 на Chrome, GLM-5.3 стига до цялостен експлойт в 50 от 410 опита, срещу 56 от 410 за Claude Mythos Preview; на вътрешния им тест Binary Exploitation пълно превземане на хода на изпълнение постига в 4 на сто от опитите срещу 6 на сто за Mythos Preview. В сесия с изследовател моделът е намерил няколко непознати дупки в JavaScript двигателя на популярен браузър и ги е навързал в работещ експлойт; Anthropic пише, че ги е съобщила на поддържащите. Вградените откази на модела се заобикалят с измамен промпт в 64 на сто от случаите, с предварително попълнено мислене в 92 на сто и с абликация (премахване на отказите от теглата) в 100 на сто, в симулирана среда без реално изпълнение на код. Абликацията им е струвала около 2200 GPU часа и около 4400 долара. Anthropic се позовава и на оценката на центъра CAISI към NIST от 17 септември, според която GLM-5.3 е най-способният в киберсигурността модел с отворени тегла досега и изостава от американския фронтир с около четири месеца. CVE номер няма: това е оценка на модел, не уязвимост в софтуер.

Първо очевидното. Anthropic оценява конкурент и има интерес от извода. Mythos е затворен, GLM-5.3 се тегли свободно, и текстът стига до призива повече защитници да получат достъп до най-силните модели. Четеш го, като помниш това.

Само че числата не висят единствено на тяхната дума. По думите на Anthropic находките им за способностите съвпадат в общи линии с тези на CAISI. Спорът е по-малко дали моделът може и повече кой още може да го ползва.

Предпазител, който се маха за 4400 долара, пази само от честните.

За защитниците това значи едно: способност, която досега стоеше зад програми с проверка на хората, вече е на диска на всеки, който си я свали. Anthropic признава и другата страна, че същият модел може да помага на защитниците. Колко от двете ще се случи, ще се види в отчетите за злоупотреби, не в бенчмарковете.

Заглавията ще кажат „китайски модел хаква“. По-точното е друго: способност, която през пролетта имаше само в една затворена лаборатория, вече е свободна. Отворени тегла не се прибират обратно.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→Anthropic - GLM-5.3 and the spread of advanced cyber capabilities, 29.09.2026→NIST - CAISI's Assessment of Z.ai's GLM-5.3 Cyber Capabilities, 17.09.2026
Оригинал: https://wearecoded.com/articles/glm-53-kiber-bez-predpaziteli.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини