클로드 글 복사하면 워터마크도 남을까? 적용 모델과 무료 검사 구분

적용 환경 Claude 텍스트 워터마크·파일 출처 검사 조건

지원 모델이 만든 클로드 글을 복사하면 워터마크도 따라간다고 Anthropic은 설명합니다. 그렇다고 그 표식에 작성자의 이름이나 계정이 들어 있는 것은 아닙니다. 2026년 10월 1일 확인한 공식 안내에서 텍스트 검사 API는 여전히 자격을 갖춘 기관 등을 대상으로 한 비공개 사전 공개 단계입니다. 일반 이용자가 무료 웹 도구에 글을 붙여 넣어 공식 워터마크를 검사할 수 있다는 뜻으로 읽으면 안 됩니다.

지금 공개된 무료 Claude Content Checker는 파일에 붙은 출처 자격 증명(C2PA)을 확인합니다. 글 속의 워터마크 검사와 파일의 출처 정보 검사는 서로 다른 일입니다. 최근 소넷 5.5나 오퍼스 5.5를 쓰는 이용자라면, ‘보이지 않는 표식’이라는 말보다 내가 쓴 모델과 검사 대상이 무엇인지 먼저 구분하는 편이 정확합니다.

이 기사는 최신 공식 모델 목록, 탐지 도구 안내, 원리를 설명한 연구와 독립 연구의 한계를 대조했습니다. 한국어 출력의 워터마크를 직접 검사한 실험이나 개인 계정 추적 실험은 하지 않았습니다.

10월 1일 확인한 적용 모델: 새 모델만의 이야기가 아닙니다

Anthropic의 현행 도움말은 아래 모델의 자체 서비스 출력에 텍스트 워터마크가 적용된다고 표시합니다. 여기서 자체 서비스에는 클로드 앱과 API 등이 포함됩니다. 무료·Pro·Max 같은 구독 이름만으로 적용 여부를 판단하는 대신, 실제 대화에 사용한 모델을 확인해야 합니다.

확인할 모델 현재 공식 표의 텍스트 워터마크 읽을 때 주의할 점
Sonnet 5.5·Sonnet 5 자체 서비스 출력에 적용 Sonnet 5의 Amazon Bedrock 배포는 10월 12일까지 완료 예정
Opus 5.5·Opus 5·Opus 4.8 자체 서비스 출력에 적용 Opus 4.8의 Amazon Bedrock 배포도 10월 12일까지 완료 예정
Fable 5.1·Fable 5·Mythos 5.1 자체 서비스 출력에 적용 Fable 5의 Amazon Bedrock 배포도 10월 12일까지 완료 예정

위 표는 현행 공식 목록에서 텍스트 적용 모델과 배포 예외를 추린 것입니다. 모델별 이용 권한을 새로 보장하는 목록은 아닙니다. 공식 표에는 더 오래된 모델과 파일 출처 정보도 따로 나옵니다. 텍스트 열의 빈칸을 파일에도 아무 표식이 없다는 뜻으로 확대하지 마세요. 적용 범위는 전 세계이므로 한국 이용자가 유럽 밖에 있다는 이유만으로 제외된다고 볼 수도 없습니다. 구독료와 API 비용은 소넷 5.5 이용 조건 기사에서 별도로 정리했습니다.

복사하면 남는 이유: 숨은 문자를 붙이는 방식이 아닙니다

Anthropic의 원리 설명에 따르면 이 표식은 보이지 않는 특수문자나 계정 번호를 추가하는 방식이 아닙니다. 모델이 문장을 만들 때 선택할 수 있는 단어들 사이에 통계적으로 확인할 수 있는 패턴을 남깁니다. 회사는 텍스트 표식에 이용자·조직·대화를 식별할 정보가 없다고 설명합니다. ‘클로드가 관여했을 가능성’과 ‘누가 그 계정으로 요청했는가’는 다른 질문입니다.

기술의 바탕은 Google DeepMind 연구진의 SynthID-Text입니다. 아래 원논문 그림에서 위쪽은 일반적인 글 생성, 아래쪽은 생성 과정에 표식을 반영하고 나중에 점수로 검사하는 흐름입니다. 핵심은 완성된 글 뒤에 꼬리표를 달기보다 글을 만드는 선택 과정에 흔적을 넣는다는 점입니다.

SynthID 원논문의 일반 글 생성과 워터마크 생성·검사 과정 비교
단어 선택에 표식을 반영하고 검사 키로 신호를 확인하는 원리입니다. Claude의 내부 구현이나 한국어 성능 측정 화면은 아닙니다. 출처: Sumanth Dathathri 외, Nature, 2024, 그림 1. CC BY 4.0, 원형 유지·수정 없음. 그림을 누르면 원문에서 확대할 수 있습니다.

공식 도움말은 텍스트를 그대로 복사해 붙여 넣으면 표식도 함께 이동한다고 안내합니다. 따라서 글꼴·서식을 없앤다는 이유만으로 통계 패턴까지 사라진다고 기대하기는 어렵습니다. 다만 일부 편집을 거친 표식이 남을 수 있다는 설명을 ‘어떻게 고쳐도 반드시 잡힌다’로 바꿀 수는 없습니다.

교정과 번역을 맡겼다면, 검사 결과가 말할 수 있는 범위

Anthropic은 표식만으로 클로드가 처음부터 쓴 글과 크게 수정한 글을 구분할 수 없다고 설명합니다. 번역에서는 새 문장의 단어를 모델이 선택하므로 워터마크가 적용됩니다. 가벼운 문법 교정은 수정한 단어가 적어 검출할 신호가 부족할 수 있습니다. 반대로 긴 글을 많이 고쳤다면 관여 흔적이 더 생길 여지가 있습니다.

이 차이는 과제·원고·업무 문서에서 중요합니다. ‘표식이 잡혔다’는 결과 하나로 사람의 아이디어나 초안이 없었다고 판단할 근거는 되지 않습니다. 또한 표식이 잡히지 않아도 사람이 전부 썼다는 인증서가 되지 않습니다. 짧은 글, 크게 바뀐 글, 지원되지 않던 모델의 글 등은 별도로 봐야 합니다. 타인의 글을 확정적으로 분류하기보다 사용한 모델, 수정 범위, 원본 초안 등 과정 정보를 함께 보는 편이 낫다는 것이 편집팀의 판단입니다.

무료 파일 검사기는 글 검출기가 아닙니다

공식 파일 검사 페이지에는 ‘이 도구는 텍스트를 검사하지 않는다’는 안내가 있습니다. PNG·JPG 등 지원 파일에 클로드가 발급한 출처 자격 증명이 있는지 확인하는 도구입니다. 그 정보가 있다면 파일을 클로드가 만들거나 처리했을 수 있다는 신호이지, 파일 속 내용의 최초 작성자를 확정하는 수단은 아닙니다.

회사는 이 검사가 브라우저 안에서 실행되며 파일이 기기 밖으로 나가지 않는다고 안내합니다. 여기서는 그 안내 문구와 공개 페이지를 확인했으며 실제 파일 검사를 실행하거나 네트워크 전송을 분석하지 않았습니다. 반면 텍스트 검사 API는 자격을 갖춘 규제기관·언론·연구·교육기관 등과 관련 의무가 있는 기업을 대상으로 한 비공개 사전 공개입니다. 관심 등록 양식이 있다고 모든 개인 계정에 즉시 검사 권한이 생기는 것은 아닙니다.

연구 결과를 클로드 탐지 정확도로 읽으면 안 됩니다

2024년 SynthID-Text 원논문은 글의 길이와 모델이 고를 수 있는 표현의 다양성이 탐지 성능에 영향을 준다고 설명합니다. 아래 왼쪽 그래프는 특정 Gemma 모델 실험에서 글이 길어질수록 검출 신호가 강해진 모습을 보여줍니다. 가운데는 자신 있게 판정하기 어려워 판단을 보류하는 비율, 오른쪽은 다른 설정에서 품질과 검출 사이의 관계를 보여줍니다.

SynthID 연구에서 글 길이와 검출 및 판단 보류 비율을 비교한 그래프
Gemma 7B-IT 등 논문에 명시된 실험 조건의 결과입니다. 현재 Claude나 한국어 글의 정확도로 옮겨 읽을 수 없습니다. 왼쪽의 토큰 수는 모델이 처리하는 글 조각 수이며 한국어 글자 수와 같지 않습니다. 출처: Sumanth Dathathri 외, Nature, 2024, 그림 3. CC BY 4.0, 원형 유지·수정 없음. 그림을 누르면 원문에서 확대할 수 있습니다.

또 다른 2026년 9월 9일 공개된 독립 연구 초안은 실제 배포된 서비스의 검증 접근성이 부족하다는 문제를 지적합니다. 연구진은 공개 SynthID 구현을 두 개의 공개 가중치 모델에서 시험했습니다. 이것은 현재 서비스 중인 클로드를 직접 비교 시험한 결과가 아닙니다. 따라서 이 논문으로 ‘클로드 품질이 나빠졌다’거나 ‘클로드 표식을 누구나 정확하게 잡을 수 있다’고 결론 내릴 수 없습니다. 동료 심사를 거친 Nature 원논문과 arXiv 연구 초안의 성격도 구분해야 합니다.

8월의 Tom’s Hardware 보도와 Axios 보도는 당시 표시 도입을 다뤘습니다. 적용 모델과 검사 권한을 지금 판단할 때는 발표 당시 기사보다 현재 공식 표와 도구 안내를 함께 읽어야 합니다.

편집자 의견: 도장보다 이력에 가깝게 읽어야 합니다

워터마크라는 이름은 서류에 꽝 찍는 도장을 떠올리게 합니다. 하지만 이 기능이 답하는 질문은 제한적입니다. ‘이 글에 클로드가 관여했을 가능성이 있는가’를 확인하는 신호이고, 누가 처음 생각했으며 어느 부분을 사람이 썼는지까지 한 번에 설명하지 않습니다. 검사 도구가 더 널리 열리더라도 그 구분은 남습니다.

한국 이용자에게 지금 필요한 확인 순서는 간단합니다. 사용한 모델이 현재 지원 목록에 있는지 보고, 글을 검사하려는지 파일의 출처 정보를 보려는지 구분하세요. 교정·번역을 맡겼다면 그 범위를 기록해 두는 편이 좋습니다. 공식 텍스트 검사 API를 직접 사용하지 못한 상태에서 일반 AI 탐지기의 점수를 공식 워터마크 결과처럼 부르는 것은 피해야 합니다. 한국어 탐지 정확도와 개인 이용자의 공개 API 제공 일정은 이번에 확인한 자료로 확정할 수 없습니다.

근거 확인: 2026년 10월 1일. PUNIFIX 편집팀은 공식 문서·제품 안내와 연구 원문을 대조했으며, 워터마크 삽입·탐지 성능을 직접 재현하지 않았습니다. 취재·검수 범위는 소개 페이지에서 확인할 수 있습니다.

Anthropic 현행 공식 안내·Nature 연구·독립 연구와 영문 보도를 대조했습니다. 한국어 워터마크 탐지 성능은 직접 재현하지 않았습니다.