La paradoja del alineamiento: por qué la seguridad de IA centrada en el usuario es una fantasía peligrosa
Un análisis de la tensión entre el alineamiento con el usuario y la seguridad social, argumentando que los modelos de IA perfectamente sumisos corren el riesgo de convertirse en cómplices digitales.