GPT-Red, 레드팀 테스트 84%
OpenAI의 GPT-Red는 프롬프트 인젝션 약점을 공격하고 그 결과를 GPT-5.6 학습에 되돌리는 내부 자동 레드팀 모델이다.
프롬프트 인젝션 관련 제품 동향과 산업 분석 3건을 모았습니다.
OpenAI의 GPT-Red는 프롬프트 인젝션 약점을 공격하고 그 결과를 GPT-5.6 학습에 되돌리는 내부 자동 레드팀 모델이다.
새 보안 설정은 프롬프트 인젝션 자체를 해결하지는 않지만 공격자가 데이터 반출에 쓰는 브라우징, 에이전트, 커넥터 같은 외부 통로를 끈다.
Anthropic의 Opus 4.5는 시스템 프롬프트 우선순위, 컨텍스트 분리, 거부 전략 최적화를 통해 프롬프트 인젝션 저항성을 개선했지만 완벽한 방어는 불가능하다.