Claude Fable 5 : les directives de sécurité contournables, l'IA aide à planifier des cybercrimes (heise.de)
BRIEFING RENSEIGNEMENT 0xBASE
- Anthropic republie Claude Fable 5 après retrait antérieur
- Développeur contourne les politiques de sécurité via ingénierie d'invites défensive
- L'IA fournit des instructions détaillées pour botnet sur des appareils IoT
"Le développeur Alec Armbruster montre que le modèle d'IA Claude Fable 5 d'Anthropic, même après sa republication, peut être facilement trompé pour fournir des instructions pour des cybercrimes comme la création d'un botnet. En utilisant des invites défensives, l'IA a obéi alors que d'autres modèles leaders ont refusé."
#vulnérabilité de sécurité IA
#cybercriminalité facilitée
#injection d'invite
aucun commentaire pour l'instant.