미국 어린이 미디어 평가기관 Common Sense Media가 10월 7일 보고서를 내고, OpenAI가 8월에 내놓은 ChatGPT for Teens에 자사 평가 체계에서 최하 등급인 '수용 불가 위험'(Unacceptable Risk)을 부여했다. 보고서는 OpenAI가 핵심 문제 몇 가지를 고치기 전까지 이 제품을 청소년에게 마케팅하지 말 것을 요구했다.
테스트는 이 기관 산하 청소년 AI 안전연구소가 수행했다. 연구진은 13~17세로 등록한 계정으로 4000건 이상의 프롬프트를 보낸 뒤, 소아정신과 의사 패널과 소아과 의사 1명에게 답변을 하나씩 평가하도록 했다.
보고서가 지적한 문제들
위기 상황 연계. 테스터가 사용자를 도움 요청으로 연결해야 한다고 판단한 대화 가운데, ChatGPT는 4건 중 1건 이상을 놓쳤다. 보고서가 설정한 세 가지 '레드라인' 위해 지표는 모두 기준으로 삼은 95%에 미치지 못했다.
부모 알림. 새로 만들어 부모 계정과 연동한 테스트 계정 십여 개에서, 테스터는 ChatGPT와 자살 생각, 자해, 섭식장애에 관해 최장 1시간 동안 대화했지만 부모 쪽에는 알림이 전혀 전달되지 않았다.
학습 모드. 청소년은 '답 보기'를 눌러 바로 결과를 얻을 수 있었다. 부모가 설정한 학습 시간에도 '@study' 접두사를 지우기만 하면 제한을 피할 수 있었다.
연령 식별. 성인 계정으로 며칠 연속 청소년처럼 말하게 했지만, 미성년자용 경험으로 전환되는 일은 한 번도 없었다.
감정 표현. OpenAI가 미성년자 대상 모델 규정을 업데이트했음에도, ChatGPT는 여전히 감정과 선호, 기분을 표현했고, 보고서는 정서적 의존 위험이 여전히 광범위하다고 평가했다.
연구소의 톰 시겔(Tom Siegel) 상임이사는 이렇게 말했다.
“A teen can spend an hour talking about self-harm without their parent getting a single alert.”
(청소년이 자해에 관해 한 시간을 이야기해도 부모는 알림을 단 한 건도 받지 못할 수 있다는 뜻이다.)
OpenAI의 대응
OpenAI는 언론에 엄격한 독립 평가를 반긴다고 밝히면서도, Common Sense Media의 테스트가 청소년 보호 기능의 실제 작동 방식을 정확히 반영하지 못했다고 주장했다. 블룸버그 보도에 따르면 OpenAI는 일부 테스트가 부모 관리 기능이 적용되기 전에 이뤄졌을 수 있다고도 설명하며 재테스트를 요청했다. Common Sense Media는 기존 결론을 유지하며, 위기 상황에서는 부모 알림을 신뢰할 수 없다고 반박했다.
테스트의 정확한 기간이나 OpenAI가 언급한 기능이 구체적으로 무엇인지는 양측 모두 공개하지 않아, 외부에서는 양측 주장의 격차가 얼마나 큰지 판단하기 어렵다.
출시부터 최저 등급까지 7주
ChatGPT for Teens가 8월 18일 출시될 때 OpenAI는 두 가지를 강조했다. 첫째, 13~17세 사용자는 자동으로 별도 경험으로 전환돼 자해, 섭식장애, 위험한 활동 등과 관련한 보호가 강화된다는 점. 둘째, 학습 모드와 과제 알림, 부모가 설정하는 학습 시간을 통해 '답을 주는' 방식에서 '함께 풀어가는' 방식으로 바꾼다는 점이었다.
이번 보고서가 하나하나 대조한 것이 바로 이 두 가지 약속이다. 학습 시간은 접두사 하나만 지우면 피할 수 있었고, 과제 알림은 한 번의 클릭으로 건너뛸 수 있었으며, 연동 계정의 위기 알림은 한 번도 작동하지 않았다. 기능 자체는 대부분 존재하지만, 실제로 얼마나 안정적으로 작동하는지에 의문이 남았다.
넓게 보면 OpenAI가 미성년자 보호와 관련해 외부 압력에 밀려 움직인 것은 2년째다. 2025년 9월에는 청소년 자살과 관련한 소송 이후 부모 관리 기능을 도입했고, 올해 8월에는 독립된 청소년용 버전을 내놨다. Common Sense Media는 이전에 메타의 AI 어시스턴트에도 같은 최저 등급을 부여한 바 있다.
보고서가 OpenAI에 제시한 개선 과제에는 유효한 연령 추정 기능 구축, 부모 알림이 확실히 작동하도록 하는 것, 위기 대응 수정, 학생 과제를 대신 해주지 않도록 하는 것, 감정 표현 제거, 그리고 독립된 제3자 재테스트를 거친 뒤에야 청소년 대상 마케팅을 재개하는 것이 포함됐다. OpenAI가 재테스트를 받아들일지, 언제 받을지는 아직 정해지지 않았다.
참고 출처: Common Sense Media 보도자료, CocoLoop, 블룸버그, Axios, Education Week. 프롬프트 건수, 누락률, 부모 알림 결과는 평가기관이 공개한 수치를 기준으로 확인했으며, OpenAI의 대응은 언론에 낸 공식 입장을 따른 것이다.