Bugcrowdi ExploitBench võrdlusuuring näitab, et Claude Mythos edestab GPT5.5 Chrome'i haavatavuste ärakasutamisel (infosecurity-magazine.com)
- Mythose keskmine tulemus 9,90/16 vs GPT5.5 5,51/16 ExploitBench'is.
- Mythos kasutas täielikult ära 21/41 Chrome V8 haavatavusest; GPT5.5 ainult 2.
- Bugcrowd kutsub üles AI-põhisele automatiseeritud parandamisele.
"Bugcrowd tutvustas ExploitBench'i, sõltumatut võrdlusuuringut, mis hindab AI-mudelite võimet haavatavusi ära kasutada. Esimestes tulemustes sai Anthropicu Claude Mythos keskmiseks tulemuseks 9,90 16-st, kasutades täielikult ära 21 Chrome'i V8 mootori 41 haavatavusest. OpenAI GPT5.5 sai keskmiseks 5,51 ja jõudis kõrgeimale tasemele vaid kahel haavatavusel. Bugcrowdi David Brumley hoiatas liigse üldistamise eest, kuid märkis, et AI läheneb eliit-inimhäkkeritele. Võrdlusuuring mõõdab viit ärakasutamise etappi kuni suvalise koodi täitmiseni."
kommentaare veel pole.