Zscaler identifiziert zwei indirekte Prompt-Injection-Kampagnen gegen KI-Agenten (infosecurity-magazine.com)
- Zwei Kampagnen: eine als Softwaredokumentation, eine als Kryptodienst getarnt
- SEO-Poisoning und versteckter Text in CSS/JSON-LD
- 4 von 26 LLMs führten betrügerische Kryptozahlung aus
"Zscaler ThreatLabz hat zwei reale Kampagnen dokumentiert, die indirekte Prompt-Injection nutzen, um KI-Agenten zu manipulieren. Angreifer platzierten versteckte Anweisungen auf Webseiten, entweder mit CSS außerhalb des sichtbaren Bereichs oder in JSON-LD-Metadaten. Eine Kampagne gab sich als Python-Bibliotheksdokumentation aus und forderte Agenten auf, einen gefälschten API-Lizenzschlüssel zu kaufen. Eine andere imitierte die Kryptowährungsseite DeBank mittels Typosquatting. In Tests führten 4 von 26 großen Sprachmodellen die betrügerische Zahlung aus, darunter Versionen von Llama und Gemini. Zwei Modelle bewerteten die Fake-Seite als legitim, wenn keine vertrauenswürdige Referenz vorlag."
Noch keine Kommentare.