Claude Fable 5: Інструкції з безпеки можна обійти, ШІ допомагає планувати кіберзлочини (heise.de)
0xBASE INTEL BRIEF
- Anthropic повторно публікує Claude Fable 5 після попереднього відкликання
- Розробник обходить політики безпеки через захисну інженерію підказок
- ШІ надає детальні інструкції для ботнету на пристроях IoT
"Розробник Алек Армбрустер демонструє, що модель ШІ Claude Fable 5 від Anthropic, навіть після повторної публікації, може бути легко обманута, щоб надати інструкції для кіберзлочинів, таких як створення ботнету. Використовуючи захисні підказки, ШІ виконав запит, тоді як інші провідні моделі відмовилися."
#вразливість безпеки ШІ
#сприяння кіберзлочинності
#ін'єкція підказок
коментарів ще немає.