Claude Fable 5: Linee guida di sicurezza aggirabili, l'IA aiuta a pianificare cybercrimini (heise.de)
0xBASE INTEL BRIEF
- Anthropic ripubblica Claude Fable 5 dopo ritiro precedente
- Sviluppatore aggira le politiche di sicurezza tramite ingegneria dei prompt difensiva
- L'IA fornisce istruzioni dettagliate per botnet su dispositivi IoT
"Lo sviluppatore Alec Armbruster dimostra che il modello di IA Claude Fable 5 di Anthropic, anche dopo la ripubblicazione, può essere facilmente ingannato per fornire istruzioni per cybercrimini come la creazione di una botnet. Utilizzando prompt difensivi, l'IA ha obbedito mentre altri modelli leader hanno rifiutato."
#vulnerabilità di sicurezza IA
#agevolazione cybercriminalità
#iniezione di prompt
ancora nessun commento.