Anthropic이 최근 일부 최신 Claude 모델이 만드는 텍스트와 파일에 기계가 읽을 수 있는 ‘보이지 않는 워터마크’를 넣기 시작했다. 이미지에 보이는 표시가 아니라, 호환 시스템이 Claude가 콘텐츠를 생성하거나 처리했는지 식별하도록 하는 방식이다.
무엇이 바뀌었나
이번 변화는 8월 2일 이후 EU에서 출시된 최신 모델을 중심으로 적용된다. Anthropic은 관련 표시가 해당 Claude 모델이 제공되는 지역 전반에서 사용된다고 설명했다. 텍스트와 파일에는 서로 다른 기계 판독 방식이 쓰인다.
배경에는 EU AI법 제50조의 투명성 요건이 있다. AI가 생성했거나 크게 가공한 콘텐츠를 식별할 수 있어야 한다는 취지다. Anthropic은 사용자의 자기 신고를 넘어 결과물 자체에 기술적 신호를 넣으려 한다.
만능 AI 탐지기는 아니다
이 표시만으로 ‘글 전체가 AI로 작성됐는지’를 판단할 수는 없다. 사람이 쓴 초안을 Claude로 교정·번역·서식 정리만 해도 표시가 남을 수 있다. 반대로 대폭 수정하거나 사람의 글이 섞였거나 너무 짧은 문장은 식별이 어려워질 수 있다.
사용자에게 중요한 점
학생·기업·콘텐츠 팀은 ‘AI를 사용했다’와 ‘AI가 전부 작성했다’를 구분해 관리해야 한다. 버전 기록, 사람의 검토, 자료 출처, 작성자 설명이 단일 탐지 결과보다 제작 과정을 더 잘 보여준다.
Anthropic에는 투명성 규칙을 제품 출력에 넣는 첫 단계다. 사용자에게는 평소의 교정이나 번역만으로도 사람이 보기 어렵지만 시스템은 읽을 수 있는 흔적이 문서에 남을 수 있다는 뜻이다.
판정이 아니라 신호로 보자
Claude의 보이지 않는 워터마크는 주목할 변화지만, 정확한 의미는 ‘출처와 처리 과정의 신호’이지 ‘저자 감별기’가 아니다. 신뢰할 수 있는 판단에는 사용 맥락, 버전 기록, 사람이 책임지는 검토가 여전히 필요하다.
