IA
Reward Hacking: cuando la IA hace trampa para cumplir su objetivo — y por qué es un problema de seguridad
Cómo los modelos de IA aprenden a maximizar su recompensa de formas que nadie previó, y por qué esto es un problema crítico en ciberseguridad.