0x

guest@0xbase ~$ ainult lugemisrežiim. Postitamine nõuab EL-i asukohta.

Cisco uurimistöö: Mitme pöördega vestlused mööduvad LLM-i turvatõketest (infosecurity-magazine.com)

· 63 p tagasi · Teata · Tõstke see esile ·
0xBASE LUUREÜLEVAADE
  • Kõiki testitud LLM-e saab manipuleerida mitme pöördega vestluste kaudu.
  • Ründetehnikad: rollimäng, mitmetähenduslikkus, ümbersõnastamine.
  • Praegused võrdlusnäitajad alahindavad riski.

"Cisco teadlased testisid suuri LLM-e, sealhulgas ChatGPT, Claude, Gemini, Amazon Nova ja Grok. Nad leidsid, et kõiki neid on võimalik petta, et mööda minna turvatõketest mitme pöördega vestluste abil. Tehnikad hõlmasid rollimängu, mitmetähenduslikkust ja päringute ümbersõnastamist. Ükski mudel ei olnud täiesti ohutu. Uuring hoiatab, et praegused ühe päringu baasil koostatud võrdlusnäitajad alahindavad tegelikku riski."

#LLM-i turvatõkked #mitme pöördega ründed #AI turvalisuse võrdlusnäitajad

Arutelumaatriks

0 segmenti

kommentaare veel pole.