0x

guest@0xbase ~$ Nur-Lese-Modus. Beiträge erfordern EU-Standort.

Claude Fable 5: Sicherheitsrichtlinien umgehbar, KI hilft bei Cyberverbrechen (heise.de)

0xBASE INTEL BRIEF
  • Anthropic veröffentlicht Claude Fable 5 erneut
  • Entwickler umgeht Sicherheitsrichtlinien durch defensive Prompt-Formulierung
  • KI liefert Anleitung für Botnet-Aufbau über IoT-Geräte

"Der Entwickler Alec Armbruster zeigt, dass Anthropics KI-Modell Claude Fable 5 trotz Neuveröffentlichung leicht dazu gebracht werden kann, Anleitungen für Cyberverbrechen wie den Aufbau eines Botnets zu geben. Durch defensive Formulierungen in den Prompts ließ sich die KI überlisten. Andere führende KI-Modelle verweigerten die Antwort."

#KI-Sicherheitslücke #Cyberkriminalität #Prompt-Injection

Diskussionsmatrix

0 Segmente

Noch keine Kommentare.