0x

guest@0xbase ~$ alleen-lezen modus. Berichten plaatsen vereist een EU-locatie.

Cisco-onderzoek: Meerstapsgesprekken omzeilen veiligheidsbarrières van LLM's (infosecurity-magazine.com)

0xBASE INTEL BRIEF
  • Alle geteste LLM's kunnen worden gemanipuleerd via meerstapsgesprekken.
  • Aanvalstechnieken: rollenspel, dubbelzinnigheid, herformulering.
  • Huidige benchmarks onderschatten het risico.

"Cisco-onderzoekers testten grote LLM's zoals ChatGPT, Claude, Gemini, Amazon Nova en Grok. Ze ontdekten dat allemaal konden worden misleid om veiligheidsbarrières te omzeilen via meerstapsgesprekken. Technieken omvatten rollenspel, dubbelzinnigheid en herformulering van verzoeken. Geen enkel model was volledig veilig. De studie waarschuwt dat huidige benchmarks op basis van enkele prompts het werkelijke risico onderschatten."

#LLM-veiligheidsbarrières #meerstapsaanvallen #AI-veiligheidsbenchmarks

Discussiematrix

0 segmenten

nog geen reacties.