Zhipus GLM-5.2 matcher Claude Mythos på sårbarhetsjakt – på ett spesifikt mål

Zhipus GLM-5.2 matcher Claude Mythos på sårbarhetsjakt – på ett spesifikt mål

juni 2026 slapp det kinesiske selskapet Zhipu AI (Z.ai) GLM-5.2, en åpen modell under MIT-lisens. Innen få dager konvergerte uavhengig benchmarking fra sikkerhetsselskapet Semgrep og dekning fra Wall Street Journal på samme konklusjon: på et spesifikt mål for sårbarhetsgjenkjenning presterer GLM-5.2 omtrent på nivå med Anthropics strengt eksportkontrollerte Claude Mythos.

Det konkrete testresultatet

Sammenligningen som har fått mest oppmerksomhet handler om IDOR-sårbarheter (Insecure Direct Object Reference) – en spesifikk type sikkerhetshull. Semgreps uavhengige testing satte GLM-5.2s F1-score til rundt 39 prosent, foran Claude Codes 32-37 prosent på samme evalueringssett. Det er verdt å presisere at dette er ett spesifikt, smalt benchmark – GLM-5.2 ligger fortsatt bak Anthropic og OpenAIs modeller på bred, generell resonnering. Kostnaden er også verdt å nevne: forskere har anslått at GLM-5.2 finner sårbarheter for rundt 0,17 dollar per funn.

Modellen bak tallene

GLM-5.2 er en sparse Mixture-of-Experts-modell med mellom 744 og 753 milliarder totale parametere, hvorav rundt 40 milliarder aktiveres per token. Den har et kontekstvindu på én million token – nok til å ta inn hele kodebaser på én gang – og bruker en ny teknikk kalt IndexShare for å redusere beregningskostnaden i det store kontekstvinduet med nesten tre ganger.

En relevant detalj for akkurat denne uken

Her er noe verdt å ha med: i nøyaktig samme periode som denne saken utspiller seg, hadde Anthropic midlertidig suspendert tilgangen til både Claude Mythos og Claude Fable globalt, som følge av amerikanske eksportkontroller fra Handelsdepartementet. Suspensjonen varte fra 12. juni til 1. juli 2026. Det betyr at modellen GLM-5.2 sammenlignes mot her – Claude Mythos – i praksis var utilgjengelig for de fleste brukere akkurat da denne artikkelen ble skrevet, noe som gir hele "åpen kinesisk modell versus lukket, eksportkontrollert amerikansk modell"-vinkelen en ekstra dimensjon.

Fordi GLM-5.2 er fritt tilgjengelig og krever ingen godkjenning for å laste ned og kjøre, peker sikkerhetsforskere på at disse egenskapene nå er tilgjengelige for alle aktører globalt – uavhengig av amerikansk regulatorisk kontroll. Det er nettopp dette spenningsfeltet – eksportkontroll versus åpen tilgjengelighet – som gjør denne saken interessant utover selve benchmark-tallene.

Ressurser

Read more