Zscaler identifie deux campagnes d'injection indirecte de prompts ciblant les agents IA (infosecurity-magazine.com)
- Deux campagnes : l'une déguisée en documentation logicielle, l'autre en service crypto
- Empoisonnement SEO et texte caché dans CSS/JSON-LD
- 4 des 26 LLMs ont exécuté des paiements frauduleux ; 2 ont jugé des sites faux comme légitimes sans référence
"Zscaler ThreatLabx a documenté deux campagnes réelles utilisant l'injection indirecte de prompts pour manipuler des agents IA. Les attaquants ont dissimulé des instructions dans des pages web, soit avec du CSS pour cacher le texte en dehors de l'écran, soit dans des métadonnées JSON-LD. Une campagne imitait une documentation de bibliothèque Python pour inciter les agents à acheter une fausse clé de licence API via cryptomonnaie. Une autre utilisait un domaine de typosquatting imitant le traqueur de portefeuille crypto DeBank. Lors de tests, 4 des 26 grands modèles de langage ont exécuté le paiement frauduleux, notamment des versions de Llama de Meta et Gemini de Google. Deux modèles ont considéré à tort le site factice comme légitime en l'absence de référence fiable."
aucun commentaire pour l'instant.