Claude의 새 표시 방식은 오래된 질문을 실제 제품 문제로 끌어냈다. AI가 만든 텍스트를 기계가 읽을 수 있는 방식으로 식별할 수 있는가.
량쯔웨이는 8월 11일 Anthropic이 Claude 생성 콘텐츠에 보이지 않는 표시를 추가하고 있다고 보도했다. Anthropic 도움말에 따르면 8월 2일 이후 EU에서 출시되는 새 Claude 모델은 출시 첫날부터 기계 판독 표시를 지원한다. 생성 텍스트에는 내장 워터마크가 들어가고, 지원되는 파일에는 서명된 출처 메타데이터가 붙는다.
공식 문구는 짧다.
Generated text will carry embedded watermarks사용자 관점에서는 Claude가 만든 텍스트가 복사, 붙여넣기, 가벼운 편집 뒤에도 남을 수 있는 신호를 품는다는 뜻이다.
워터마크가 모델 출력층으로 들어간다
적용 범위는 넓다. Claude, Claude Platform API, Claude Code, Claude Cowork, Claude Tag가 포함되고, AWS, Google Cloud, Microsoft Foundry를 통한 접근도 대상이다. 지역도 Claude가 제공되는 곳에서는 전 세계적으로 적용된다.
Claude의 규제 대응은 일반적인 화면 안내보다 더 깊다. 화면 안내는 사람에게 “AI를 썼다”고 알려준다. 모델층 신호는 기계 검출에 연결된다. 대형 플랫폼에는 자동 심사에 넣기 쉬운 방식이지만, 창작자와 이용자에게는 오탐 비용도 커진다.
EU 법이 마감일을 만들었다
배경에는 EU AI Act 제50조가 있다. Cloud Security Alliance는 제50조의 투명성 의무를 네 갈래로 정리한다. 대화형 AI는 사용자가 AI와 상호작용한다는 사실을 알려야 하고, 오디오·이미지·비디오·텍스트 생성 시스템은 출력물을 기계가 읽을 수 있게 표시해야 한다.
제50조 투명성 의무는 8월 2일 적용 단계에 들어갔다. 이미 출시된 시스템의 워터마크 의무에는 전환 기간이 있으며, CSA와 The Verge는 기존 제품에 12월 2일까지의 개조 창구가 있다고 설명했다.
검출 결과는 저자 증명이 아니다
Claude 표시가 검출됐다는 사실은 콘텐츠가 Claude로 처리됐을 가능성을 보여줄 뿐, Claude가 원저자임을 단독으로 증명하지 않는다. 사용자가 직접 쓴 글을 Claude로 교정, 번역, 요약, 서식 정리했을 때도 표시가 남을 수 있다. 반대로 표시가 없다고 AI를 쓰지 않았다는 증거도 아니다.
워터마크가 공식화될수록 경계 설명은 더 중요해진다. 완전한 추측에 기대는 비용은 줄지만 새 회색지대도 생긴다. Anthropic은 아직 텍스트 워터마크 알고리즘과 검출 기술 문서를 공개하지 않았다. 기업이 지금 할 수 있는 일은 검출 결과를 최종 판정이 아니라 위험 신호로 다루는 것이다.
출처: 량쯔웨이, Anthropic Claude Help Center, The Verge, Cloud Security Alliance, CocoLoop, iThome; 모델 적용 범위, 제품 입구, 클라우드 범위, C2PA 파일 형식, 제50조 의무, 기존 모델 전환 기간, 검출 한계, 미공개 기술 문서 상태를 확인.