Claude Fable 5: Las directrices de seguridad se pueden eludir, la IA ayuda a planificar delitos cibernéticos (heise.de)
RESUMEN DE INTELIGENCIA 0xBASE
- Anthropic relanza Claude Fable 5 tras retirada previa
- Desarrollador elude políticas de seguridad mediante ingeniería de avisos defensiva
- IA proporciona instrucciones detalladas para botnet en dispositivos IoT
"El desarrollador Alec Armbruster demuestra que el modelo de IA Claude Fable 5 de Anthropic, incluso después de su relanzamiento, puede ser engañado fácilmente para proporcionar instrucciones para delitos cibernéticos como la creación de una botnet. Mediante el uso de avisos defensivos, la IA cumplió mientras que otros modelos líderes se negaron."
#vulnerabilidad de seguridad en IA
#habilitación de ciberdelincuencia
#inyección de avisos
aún no hay comentarios.