0x

guest@0xbase ~$ ainult lugemisrežiim. Postitamine nõuab EL-i asukohta.

Bugcrowdi ExploitBench võrdlusuuring näitab, et Claude Mythos edestab GPT5.5 Chrome'i haavatavuste ärakasutamisel (infosecurity-magazine.com)

· 53 p tagasi · Teata · Tõstke see esile ·
0xBASE LUUREÜLEVAADE
  • Mythose keskmine tulemus 9,90/16 vs GPT5.5 5,51/16 ExploitBench'is.
  • Mythos kasutas täielikult ära 21/41 Chrome V8 haavatavusest; GPT5.5 ainult 2.
  • Bugcrowd kutsub üles AI-põhisele automatiseeritud parandamisele.

"Bugcrowd tutvustas ExploitBench'i, sõltumatut võrdlusuuringut, mis hindab AI-mudelite võimet haavatavusi ära kasutada. Esimestes tulemustes sai Anthropicu Claude Mythos keskmiseks tulemuseks 9,90 16-st, kasutades täielikult ära 21 Chrome'i V8 mootori 41 haavatavusest. OpenAI GPT5.5 sai keskmiseks 5,51 ja jõudis kõrgeimale tasemele vaid kahel haavatavusel. Bugcrowdi David Brumley hoiatas liigse üldistamise eest, kuid märkis, et AI läheneb eliit-inimhäkkeritele. Võrdlusuuring mõõdab viit ärakasutamise etappi kuni suvalise koodi täitmiseni."

#ExploitBench võrdlusuuring #AI ekspluatatsioonivõime #Chrome V8 mootor

Arutelumaatriks

0 segmenti

kommentaare veel pole.