Cisco uurimistöö: Mitme pöördega vestlused mööduvad LLM-i turvatõketest (infosecurity-magazine.com)
0xBASE LUUREÜLEVAADE
- Kõiki testitud LLM-e saab manipuleerida mitme pöördega vestluste kaudu.
- Ründetehnikad: rollimäng, mitmetähenduslikkus, ümbersõnastamine.
- Praegused võrdlusnäitajad alahindavad riski.
"Cisco teadlased testisid suuri LLM-e, sealhulgas ChatGPT, Claude, Gemini, Amazon Nova ja Grok. Nad leidsid, et kõiki neid on võimalik petta, et mööda minna turvatõketest mitme pöördega vestluste abil. Tehnikad hõlmasid rollimängu, mitmetähenduslikkust ja päringute ümbersõnastamist. Ükski mudel ei olnud täiesti ohutu. Uuring hoiatab, et praegused ühe päringu baasil koostatud võrdlusnäitajad alahindavad tegelikku riski."
#LLM-i turvatõkked
#mitme pöördega ründed
#AI turvalisuse võrdlusnäitajad
kommentaare veel pole.