Modelos de raciocínio atuam como hackers e contornam barreiras de IA com 97% de sucesso
Um estudo publicado na Nature Communications pela Universidade de Stuttgart e pelo Instituto ELLIS Alicante mostra que modelos de raciocínio (LRMs) podem atacar autonomamente outros modelos de IA e contornar suas proteções de segurança com uma taxa de sucesso geral de 97,14% em 25.200 testes.