클로드 흔적이 발견되면, 누가 쓴 글이라고 봐야 할까요?

외주 원고나 채용 과제에서 Claude 워터마크가 탐지됐다고 해볼게요. 곧바로 “AI가 전부 작성했다”고 결론 내려도 될까요? 반대로 워터마크가 나오지 않으면 사람이 썼다고 믿어도 될까요?

둘 다 안 됩니다. Claude의 텍스트 워터마크가 알려주는 범위는 ‘Claude가 이 문장을 생성하거나 처리했을 가능성’까지예요. 최초 작성자와 소유권, 사람이 얼마나 고쳤는지는 판정하지 못합니다.

다만 “아직 아무도 워터마크를 확인할 수 없다”는 기존 설명도 이제는 고쳐야 합니다. 2026년 9월 현재 텍스트 탐지 API는 자격을 갖춘 기관과 기업을 대상으로 비공개 프리뷰 중이고, Claude가 만든 파일의 자격 증명을 확인하는 도구는 일반에 공개됐어요.

텍스트 검사와 파일 검사는 서로 다른 기능이에요

일반 사용자가 지금 바로 확인할 수 있는 것은 파일의 Content Credential입니다. 공개된 Claude Content Checker는 파일에 포함된 C2PA 기반 서명 메타데이터를 확인하지만, 복사해 붙여 넣은 텍스트의 워터마크는 검사하지 않아요.

구분텍스트 워터마크파일 Content Credential
표시 방식단어 선택에 통계적 패턴 반영파일에 C2PA 기반 서명 메타데이터 첨부
현재 확인 수단적격 기관·기업용 Detection API 비공개 프리뷰공개 Claude Content Checker
확인할 수 있는 것Claude가 텍스트 생성·처리에 관여했을 가능성파일에서 Claude Content Credential이 발견되는지 여부
확인할 수 없는 것원저자·소유권·사람의 편집 비중원저자·소유권과 파일의 전체 편집 이력

텍스트 Detection API의 프리뷰 대상에는 규제기관, 법집행기관, 언론, 팩트체커, 독립 연구자, 교육기관, EU 시민사회단체와 관련 검증 의무가 있는 기업이 포함됩니다. 관심 등록 경로는 열려 있지만 승인 기준과 API 사양, 일반 공개 일정은 확인되지 않았어요.

파일 검사기는 누구나 이용할 수 있지만 이것도 완전한 출처 증명서는 아닙니다. 재저장, 포맷 변환, 스크린샷 과정에서 메타데이터가 사라질 수 있고, 자격 증명이 발견되더라도 누가 원본을 작성했는지까지 알려주지는 않아요.

워터마크는 숨은 문자가 아니라 단어 선택의 패턴입니다

텍스트 안에 특수문자나 별도 메타데이터를 몰래 넣는 방식은 아니에요. Anthropic은 Google DeepMind가 Nature에 발표한 SynthID-Text를 변형해 사용합니다. 모델이 다음 단어를 선택할 때 비밀 키에 따른 통계적 패턴을 반영하고, 탐지기는 충분한 패턴이 남았는지 분석해요.

이 구조 때문에 긴 초안이나 대규모 재작성에서는 신호가 쌓일 수 있지만, 짧은 문구와 가벼운 교정에서는 탐지할 단서가 부족할 수 있습니다. 정확한 표현을 바꾸기 어려운 사실 문장이나 코드도 선택 가능한 단어가 적어 신호가 약해질 수 있고, 대폭 편집하거나 번역하고 다른 글과 섞으면 검출되지 않을 수 있어요.

사람이 쓴 원고를 Claude로 교정하면 항상 워터마크가 남는다는 설명도 정확하지 않습니다. 워터마크는 Claude가 선택한 단어에만 적용되므로 문법과 구두점을 조금 고친 정도라면 탐지 가능한 신호가 거의 없을 수 있어요. 반대로 문장을 상당 부분 다시 쓰게 했다면 탐지 가능성이 커집니다.

양성은 ‘Claude 단독 작성’의 증거가 아니고, 음성은 ‘사람 작성’의 증거가 아닙니다. 탐지 결과는 저작권이나 계약 위반을 자동 판정하는 결론이 아니라, 생성 시점과 모델 기록, 원고 버전, 사람의 편집 내역을 더 살펴보게 하는 하나의 신호로 다뤄야 해요.

SynthID-Text 원 연구는 약 2천만 개의 Gemini 응답을 비교해 사용자 평가와 표준 평가에서 품질 저하가 없었다고 보고했습니다. 하지만 이는 Claude의 실제 오탐률·미탐률이나 한국어 탐지 성능을 입증한 결과가 아니에요. Anthropic 역시 Claude 구현의 언어별 최소 길이, 판정 임계값과 정확도 수치를 공개하지 않았습니다.

오늘은 탐지기보다 생성 기록부터 맞춰보세요

첫 행동은 콘텐츠 한 건의 원본과 최종본을 나란히 놓는 것입니다. 탐지 API 접근 권한이 없어도 Claude의 관여 범위와 사람이 책임진 편집 과정을 기록하면, 나중에 공개나 분쟁 대응에 쓸 수 있는 근거가 남아요.

  1. 모델과 생성 시점을 확인합니다. API 로그나 작업 기록에서 사용 모델과 날짜를 찾고, 공식 지원 문서에서 당시 워터마크 적용 대상이었는지 대조하세요. 2026년 8월 2일 이후 출시된 지원 모델은 출시 때부터 표시 기능이 적용되지만, 모든 과거 모델이 이미 지원된다는 뜻은 아닙니다.
  2. Claude가 맡은 일을 구분합니다. ‘전체 초안’, ‘대규모 재작성’, ‘번역’, ‘가벼운 교정’ 중 하나로 적으세요. 짧은 글과 가벼운 교정은 Claude가 관여했어도 미탐될 수 있다는 제한도 함께 남깁니다.
  3. 검사 수단의 종류를 확인합니다. 자격이 있는 조직은 공식 지원 문서의 텍스트 Detection API 신청 경로를 검토하세요. 권한이 없다면 제3자 AI 탐지 결과를 Claude 워터마크 검사 결과인 것처럼 대체하지 않습니다.
  4. 파일은 별도로 검사합니다. Claude가 만든 지원 파일이 있다면 공개 Content Checker에서 Content Credential을 확인하세요. 이 결과를 본문 텍스트 검사 결과와 합치지 말고 별도 칸에 기록합니다.
  5. 사람의 편집과 승인을 연결합니다. 최초 원고, 최종본, 수정자와 승인자를 함께 보존하세요. 최종 판정에는 ‘Claude 관여 가능성’, ‘적용 모델·시점’, ‘사람 편집 내역’, ‘공개 의무 검토’를 분리해 적습니다.

콘텐츠 ID: ______
생성일·모델: ______
Claude 작업: 전체 초안 / 재작성 / 번역 / 교정
원본·최종본 보존: 예 / 아니요
사람 검토자·편집 책임자: ______
텍스트 탐지 접근: 있음 / 없음
파일 자격 증명: 양성 / 음성 / 해당 없음
공개 의무 검토: 완료 / 미완료

이 점검의 성공 기준은 워터마크 하나로 사람과 AI를 가르는 것이 아닙니다. Claude가 어디까지 관여했고, 누가 무엇을 고쳐 최종 책임을 졌는지 설명할 수 있는 상태가 첫 결과물이에요.

EU 규정도 ‘표시’와 ‘공개’를 나눠 봐야 합니다

AI 제공자가 넣는 기계 판독 표시와 콘텐츠 게시자가 독자에게 하는 공개는 서로 다른 의무입니다. EU AI Act 제50조 2항은 합성 콘텐츠를 생성하는 AI 시스템 제공자에게 결과가 기계 판독 가능한 형식으로 식별되도록 요구합니다. 다만 AI 시스템이 통상적인 편집을 보조하거나, 제공된 입력 데이터 또는 그 의미를 실질적으로 바꾸지 않는 경우에는 이 의무의 예외가 적용됩니다. 특정 교정 작업이 예외에 해당하는지는 ‘교정’이라는 이름만으로 정할 수 없고 실제 변경 범위를 살펴야 해요.

제50조 4항은 공익 사안을 알리기 위해 AI 생성·조작 텍스트를 게시하는 배포자에게 공개 의무를 두되, 사람의 검토·편집 통제와 편집 책임이 있는 경우 예외를 규정합니다. 관련 투명성 의무는 2026년 8월 2일부터 적용돼요.

다만 특정 회사나 게시물에 어느 의무가 적용되는지는 관할, 콘텐츠 목적, 조직의 역할과 편집 과정에 따라 달라집니다. 워터마크 탐지 여부만으로 공개 의무나 법적 책임까지 판단해서는 안 돼요.