Společnost Semgrep, která se specializuje na nástroje pro analýzu bezpečnosti kódu, zveřejnila výsledky benchmarků, v nichž GLM 5.2 od čínského Zhipu AI překonalo Claude Code i Claude Opus 4.8 v detekci bezpečnostních zranitelností typu IDOR. Model dosáhl skóre 39 % F1, zatímco Claude Code získal 32 %. Ještě důležitější je, že GLM 5.2 to dokázal bez specializované infrastruktury, pouze s jednoduchým promptem, a náklady na jeden nalezený problém činily zhruba 0,17 dolaru, což je zlomek ceny srovnatelných uzavřených modelů. Jde o model typu Mixture-of-Experts s přibližně 750 miliardami parametrů, z nichž je aktivních jen 40 miliard na token, a je uvolněný pod MIT licencí. Výsledek ukazuje, že open-weight modely v některých specifických úlohách začínají překonávat přední uzavřené systémy, byť zatím jen v úzké doméně. Semgrep upozorňuje, že jde o jednu úlohu a jeden dataset, ale trend je zřejmý.