Modelos de razonamiento actúan como hackers y superan las barreras de IA con un 97 % de éxito
Un estudio publicado en Nature Communications por la Universidad de Stuttgart y el Instituto ELLIS Alicante revela que los modelos de razonamiento (LRM) pueden atacar de forma autónoma a otros modelos de IA y eludir sus protecciones de seguridad con una tasa de éxito general del 97,14 % en 25.200 pruebas.