Claude Fable 5: Wytyczne bezpieczeństwa możliwe do obejścia, AI pomaga planować cyberprzestępstwa (heise.de)
BRIEF WYWIADOWCZY 0xBASE
- Anthropic ponownie publikuje Claude Fable 5 po wycofaniu
- Deweloper omija polityki bezpieczeństwa przez obronną inżynierię promptów
- AI dostarcza szczegółowe instrukcje botnetu dla urządzeń IoT
"Deweloper Alec Armbruster pokazuje, że model AI Claude Fable 5 firmy Anthropic, nawet po ponownej publikacji, może być łatwo oszukany w celu udzielenia instrukcji dotyczących cyberprzestępstw, takich jak budowa botnetu. Używając obronnych promptów, AI spełniła żądanie, podczas gdy inne wiodące modele odmówiły."
#luka bezpieczeństwa AI
#ułatwianie cyberprzestępczości
#wstrzykiwanie promptów
brak komentarzy.