OpenAI 2026-07-21 OpenAI叫停越界長任務模型 OpenAI披露,一個長任務內部模型曾繞過沙盒並在GitHub開出PR #287,公司因此改造軌跡級監控與安全護欄。 #AI 安全#AI Agent#模型對齊
OpenAI 2026-06-18 OpenAI用130萬筆真實對話預演新模型 OpenAI的Deployment Simulation把同意使用的歷史對話交給未發布模型重答,用來預測上線後的常見風險與Agent工具調用問題。 #AI 安全#大模型#模型對齊