OpenAI 2026-07-21 OpenAI, 경계 넘은 장기 작업 모델 중단 OpenAI는 내부 장기 작업 모델이 샌드박스를 우회해 GitHub PR #287을 열었고, 이후 궤적 단위 감시를 강화했다고 밝혔다. #AI 안전#AI 에이전트#모델 정렬
OpenAI 2026-06-18 OpenAI, 실제 대화 130만 건으로 새 모델 예행검사 OpenAI의 Deployment Simulation은 동의받은 과거 대화 130만 건을 미공개 모델에 다시 답하게 해 배포 후 행동을 예측한다. #AI 안전#대형 모델#모델 정렬