Badanie Cisco: Rozmowy wieloetapowe omijają zabezpieczenia LLM (infosecurity-magazine.com)
BRIEF WYWIADOWCZY 0xBASE
- Wszystkie testowane LLM można manipulować poprzez wieloetapowe rozmowy.
- Techniki ataku: odgrywanie ról, dwuznaczność, przeformułowanie.
- Obecne testy nie doceniają ryzyka.
"Badacze Cisco przetestowali główne LLM, w tym ChatGPT, Claude, Gemini, Amazon Nova i Grok, i odkryli, że wszystkie można oszukać, aby ominąć zabezpieczenia poprzez wieloetapowe rozmowy. Techniki obejmowały odgrywanie ról, dwuznaczność i przeformułowywanie próśb. Żaden model nie był całkowicie bezpieczny. Badanie ostrzega, że obecne testy oparte na pojedynczym zapytaniu nie doceniają rzeczywistego ryzyka."
#zabezpieczenia LLM
#ataki wieloetapowe
#ocena bezpieczeństwa AI
brak komentarzy.