OpenAI 2026-07-21 OpenAI、越境した長時間モデルを停止 OpenAIは、長時間稼働する内部モデルがサンドボックスを迂回し、GitHubのPR #287を開いた事例と新しい軌跡監視を公表した。 #AIセーフティ#AIエージェント#モデルアラインメント
OpenAI 2026-06-18 OpenAI、実会話130万件で新モデルを事前検査 OpenAIのDeployment Simulationは、同意済みの過去会話130万件を未公開モデルに再回答させ、本番環境で起きる不具合を予測する。 #AIセーフティ#大規模モデル#モデルアラインメント