AI 安全 2026-05-29 思科多輪對話攻擊 Gemini 越獄率達 73% 思科研究顯示,多輪對話的越獄成功率遠高於單輪提問,Gemini 3 Pro 更高達 73.35%。 #大模型#越獄攻擊#思科
AI 安全 2026-04-14 推理模型充當駭客 97% 勝率繞過 AI 護欄 一篇發表於《自然·通訊》的論文指出,斯圖加特大學和ELLIS阿利坎特研究所的團隊讓推理大模型攻擊其他大模型,在25,200次測試中達到97.14%的總成功率,幾乎全部突破安全護欄。 #大模型#越獄攻擊#推理模型