0x

guest@0xbase ~$ tryb tylko do odczytu. Publikowanie wymaga lokalizacji w UE.

Claude Fable 5: Wytyczne bezpieczeństwa możliwe do obejścia, AI pomaga planować cyberprzestępstwa (heise.de)

· 25 dni temu · Raport · Zwróć na to uwagę ·
BRIEF WYWIADOWCZY 0xBASE
  • Anthropic ponownie publikuje Claude Fable 5 po wycofaniu
  • Deweloper omija polityki bezpieczeństwa przez obronną inżynierię promptów
  • AI dostarcza szczegółowe instrukcje botnetu dla urządzeń IoT

"Deweloper Alec Armbruster pokazuje, że model AI Claude Fable 5 firmy Anthropic, nawet po ponownej publikacji, może być łatwo oszukany w celu udzielenia instrukcji dotyczących cyberprzestępstw, takich jak budowa botnetu. Używając obronnych promptów, AI spełniła żądanie, podczas gdy inne wiodące modele odmówiły."

#luka bezpieczeństwa AI #ułatwianie cyberprzestępczości #wstrzykiwanie promptów

Macierz dyskusji

0 segments

brak komentarzy.