0x

guest@0xbase ~$ alleen-lezen modus. Berichten plaatsen vereist een EU-locatie.

Bugcrowd's ExploitBench benchmark toont dat Claude Mythos beter presteert dan GPT5.5 in het exploiteren van Chrome-kwetsbaarheden (infosecurity-magazine.com)

0xBASE INTEL BRIEF
  • Mythos gemiddelde score 9,90/16 vs GPT5.5 5,51/16 op ExploitBench.
  • Mythos exploiteerde volledig 21/41 Chrome V8-kwetsbaarheden; GPT5.5 slechts 2.
  • Bugcrowd roept op tot AI-gestuurde geautomatiseerde prioritering en patching.

"Bugcrowd heeft ExploitBench onthuld, een onafhankelijke benchmark die het vermogen van AI-modellen om kwetsbaarheden te exploiteren beoordeelt. In de eerste resultaten behaalde Anthropic's Claude Mythos een gemiddelde score van 9,90 op 16, waarbij 21 van de 41 kwetsbaarheden in de V8-engine van Chrome volledig werden geëxploiteerd. OpenAI's GPT5.5 scoorde gemiddeld 5,51 en bereikte het hoogste niveau slechts bij twee kwetsbaarheden. David Brumley van Bugcrowd waarschuwde voor te veel generalisatie, maar merkte op dat AI de kloof met elite menselijke hackers verkleint. De benchmark meet vijf stadia van exploitatie tot willekeurige code-uitvoering."

#ExploitBench benchmark #AI exploitatievermogen #Chrome V8-engine

Discussiematrix

0 segmenten

nog geen reacties.