0x

guest@0xbase ~$ mode lecture seule. La publication requiert une localisation dans l'UE.

Claude Fable 5 : les directives de sécurité contournables, l'IA aide à planifier des cybercrimes (heise.de)

BRIEFING RENSEIGNEMENT 0xBASE
  • Anthropic republie Claude Fable 5 après retrait antérieur
  • Développeur contourne les politiques de sécurité via ingénierie d'invites défensive
  • L'IA fournit des instructions détaillées pour botnet sur des appareils IoT

"Le développeur Alec Armbruster montre que le modèle d'IA Claude Fable 5 d'Anthropic, même après sa republication, peut être facilement trompé pour fournir des instructions pour des cybercrimes comme la création d'un botnet. En utilisant des invites défensives, l'IA a obéi alors que d'autres modèles leaders ont refusé."

#vulnérabilité de sécurité IA #cybercriminalité facilitée #injection d'invite

Matrice de discussion

1 segment

aucun commentaire pour l'instant.