서론
Anthropic은 지원되는 Claude 생성 콘텐츠에 대해 기계 판독 가능한 표시를 배포하기 시작했습니다.
이 변경 사항은 두 가지 계층으로 구성됩니다:
- 생성된 텍스트에 삽입되는 워터마크.
- 지원되는 생성 파일에 대한 디지털 서명된 출처 메타데이터.
이 정책은 EU AI 법 제50조 제(2)항의 AI 생성 콘텐츠 투명성에 관한 행동 강령에 따른 Anthropic의 약속과 관련이 있습니다.
그러나 시행 범위는 EU를 넘어섭니다.
Anthropic은 Claude 모델이 표시를 지원할 때 해당 표시가 해당 모델이 전 세계적으로 제공되는 모든 채널에 적용된다고 밝혔습니다. 출력이 Claude의 소비자 인터페이스, API, Claude Code, Claude Cowork, Claude Tag 또는 지원되는 클라우드 서비스 제공업체 통합에서 나오든, 동일한 모델 수준의 텍스트 표시가 나타나야 합니다.
이는 이전에 생성된 모든 Claude 텍스트가 이제 감지될 수 있다는 것을 의미하지는 않습니다.
몇 가지 중요한 제한 사항이 있습니다:
- 표시 기능 출시 이전에 공개된 모델에는 아직 표시가 없을 수 있습니다.
- 대규모 재작성, 개편, 번역 또는 다른 텍스트와의 혼합은 감지 가능한 신호를 약화시키거나 제거할 수 있습니다.
- 매우 짧은 텍스트 조각은 안정적인 감지를 위한 충분한 신호를 갖지 못할 수 있습니다.
- 스크린샷, 형식 변환, 재저장 또는 지원되지 않는 플랫폼은 파일 메타데이터를 제거할 수 있습니다.
- Claude 표시가 감지되었다는 것은 콘텐츠가 Claude를 거쳤을 가능성을 의미합니다. 이는 Claude가 원저자임을 증명하지는 않습니다.
이러한 차이점이 유용한 출처 신호와 일반적인 AI 저자 식별 탐지기의 차이입니다.
Anthropic이 기계 판독 가능한 표시를 추가하는 이유
직접적인 규제 배경은 EU AI 법입니다.
제50조는 특정 AI 시스템과 AI 생성 콘텐츠에 투명성 의무를 도입합니다. EU 집행위원회가 마련한 투명성 행동 강령은 제공업체와 배포자가 이러한 의무를 이행하도록 돕기 위한 것입니다.
위원회는 관련 요구사항을 다음과 같이 설명합니다:
- AI 생성 또는 조작된 콘텐츠에 대한 기계 판독 가능한 표시.
- 이러한 표시의 감지.
- 딥페이크 표시.
- 대중에게 공개하기 위해 게시되는 특정 AI 생성 또는 조작된 텍스트의 표시.
투명성 의무는 2026년 8월 2일부터 적용됩니다.
Anthropic은 생성형 AI 모델 및 시스템 제공업체로서 제50조 제(2)항의 투명성 강령에 서명했습니다.
Claude 표시 시스템은 이러한 약속을 이행하기 위한 회사의 구현 경로입니다.
핵심은 법적 요구사항이 투명성과 출처 신호에 관한 것이지, AI가 생성한 모든 문장에 독자에게 보이는 경고를 표시하도록 하는 것이 아니라는 점입니다.
기계 판독 가능한 표시는 콘텐츠 내에서 눈에 보이지 않게 작동하면서도 호환 도구가 검사할 수 있게 합니다.
Claude는 두 가지 상호 보완적인 표시 계층을 사용합니다
Anthropic의 설계는 텍스트 출처와 파일 출처를 분리합니다.
| 계층 | 적용 대상 | 역할 | 주요 제한 사항 |
|---|---|---|---|
| 삽입된 워터마크 | 생성된 텍스트 | 텍스트 자체에 감지하기 어려운 기계 판독 가능한 신호를 배치 | 대규모 편집, 번역, 개편 또는 축약 후 약화될 수 있음 |
| 서명된 출처 메타데이터 | 지원되는 생성 파일 |
파일 | C2PA 표준을 따라 서명된 출처/이력 정보 추가 | 메타데이터는 형식 변환, 스크린샷, 재저장 또는 지원되지 않는 워크플로우로 인해 제거될 수 있음 |
두 계층을 동시에 사용하는 것은 중요합니다. 텍스트와 파일의 손상 방식이 다르기 때문입니다.
메타데이터에만 의존하는 시스템은 파일이 변환될 때 정보를 쉽게 잃습니다.
텍스트 신호만으로는 생성된 이미지 또는 기타 파일의 더 풍부한 이력을 설명할 수 없습니다.
따라서 Anthropic은 단일 기술을 모든 출력 유형에 충분한 수단으로 간주하는 대신 계층적 접근 방식을 채택합니다.
제1계층: 텍스트에 삽입된 보이지 않는 워터마크
지원되는 모델의 경우 Claude가 생성한 텍스트에는 텍스트에 직접 삽입된 지각 불가능한 워터마크가 포함됩니다.
Anthropic은 해당 워터마크가 다음과 같다고 밝힙니다:
- 독자에게 보이지 않음.
- 의도된 의미를 변경하지 않음.
- 가독성을 저하시키지 않음.
- 복사하여 붙여넣을 때 텍스트와 함께 전파됨.
- 일부 편집 작업 후에도 유지될 수 있음.
- 특정 제품 인터페이스에만 적용되는 것이 아니라 모델 수준에서 적용됨.
마지막 사항이 특히 중요합니다.
워터마크는 단순히 Claude 웹사이트가 추가하는 HTML 태그가 아닙니다.
Anthropic은 워터마크가 모델 출력 수준에서 통합된다고 밝혔으며, 이것이 서로 다른 Claude 제품 또는 플랫폼을 통해 동일한 모델에 접근할 때 지원되는 텍스트가 계속 표시 상태를 유지하는 이유입니다.
복사하여 붙여넣기해도 워터마크가 자동으로 제거되지 않음
사용자가 표시된 Claude 텍스트 조각을 한 인터페이스에서 다음으로 복사하는 경우:
- 이메일.
- 문서.
- CMS 시스템.
- 메모 앱.
- 블로그 초안.
워터마크는 텍스트와 함께 전파될 수 있습니다.
이는 가시적인 라벨이나 일반적인 파일 메타데이터와 다릅니다. 후자는 콘텐츠가 원래 앱에서 복사되면 즉시 사라질 수 있습니다.
그러나 "텍스트와 함께 전파됨"은 "제거할 수 없음"으로 해석되어서는 안 됩니다.
Anthropic은 충분히 큰 변환이 신호를 감지 불가능하게 만들 수 있다고 명시합니다.
편집이 텍스트 워터마크에 미치는 영향
Anthropic은 Claude 생성 텍스트가 더 이상 감지 가능한 표시를 갖지 않을 수 있는 몇 가지 상황을 나열합니다:
- 대규모 편집.
- 개편.
- 번역.
- 다른 작성 콘텐츠와의 혼합.
- 매우 짧은 발췌문.
이것은 텍스트 워터마크의 근본적인 한계입니다.
텍스트는 의미를 유지하면서 쉽게 변환될 수 있습니다.
예를 들어:
원본 Claude 초안
→ 사람이 30% 개편
→ 번역가가 언어 변경
→ 편집자가 사람이 작성한 단락과 병합
→ 최종 문서에 짧은 발췌문만 포함
어느 시점에서는 탐지기가 Claude 표시를 안정적으로 식별할 수 있는 충분한 원래 통계 또는 임베딩 구조가 없을 수 있습니다.
이는 워터마크가 존재할 때 긍정적인 출처 신호로 간주되어야 하지, 부재 시 인간 저작자임을 증명하는 것으로 간주되어서는 안 된다는 것을 의미합니다.
Claude 표시는 Claude가 원본 콘텐츠를 창작했다는 것을 증명하지 않음
이것은 Anthropic의 가장 중요한 경고 중 하나입니다.
감지된 표시는 콘텐츠가 Claude를 거쳤을 가능성을 의미할 수 있습니다.
이는 Claude가 모든 아이디어나 표현을 독창적으로 만들었다는 증명과 동일하지 않습니다.
사용자가 수동으로 보고서를 작성한 다음 Claude에게 다음을 요청하는 상황을 가정해 보세요:
- 교정.
- 번역.
- 요약.
- 명확성 개선.
- 다른 파일 형식으로 변환.
- 요약 정리.
최종 출력에는 Claude 표시가 있을 수 있습니다.
기본 콘텐츠가 원래 사용자로부터 왔음에도 불구하고요.
올바른 해석은 다음과 같습니다:
Claude 표시 감지됨
→ Claude가 해당 콘텐츠를 처리했을 가능성이 높음
다음과 같은 해석이 아닙니다:
Claude 표시 감지됨
→ Claude가 해당 콘텐츠의 모든 내용을 독립적으로 창작함
이 구분은 학교, 출판사, 고용주, 컴플라이언스 팀 및 자동화된 신호에서 저자 정보를 추론하려는 모든 사람에게 중요합니다.
제2계층: 파일 서명 출처 메타데이터
Claude가 지원되는 파일 유형을 생성할 때 Anthropic은 디지털 서명된 출처 메타데이터를 첨부할 수 있다고 밝힙니다.
예시는 다음과 같습니다:
.svg
.png
.jpg
이 메타데이터는 콘텐츠 출처 및 진위 연합(C2PA) 표준을 따릅니다.
C2PA는 디지털 콘텐츠의 출처를 기록하기 위한 개방형 기술 표준입니다.
해당 콘텐츠 자격 증명에는 다음과 같은 파일의 서명된 이력 정보가 포함될 수 있습니다:
- 사용된 도
이 시스템을 지원하면 출력 결과는 지원되는 모든 Claude 인터페이스에서 표시됩니다.
Claude API 출력도 포함됨
API를 통해 Claude를 사용하는 개발자도 표시 시스템 밖에 있지 않습니다.
Anthropic은 Claude 플랫폼(API) 을 적용 대상 제품 목록에 명시적으로 포함합니다.
지원되는 모델의 경우:
애플리케이션
→ Claude API
→ 생성된 텍스트
→ 삽입된 Claude 워터마크
개발자는 소비자용 Claude 웹사이트를 사용할 필요가 없으며 워터마크는 존재합니다.
이는 자체 인터페이스 뒤에서 Claude를 사용하는 기업에게 중요한 컴플라이언스 문제를 제기합니다.
다운스트림 제품은 다음과 같은 작업을 할 수 있습니다:
- 텍스트를 직접 표시.
- 텍스트를 재작성.
- 텍스트를 요약.
- 데이터베이스 콘텐츠와 결합.
- 문서로 변환.
- 다른 모델에 전달.
- 최종 사용자에게 전송.
Anthropic은 개발자들이 Claude의 상류 표시가 모든 하류 컴플라이언스 요구사항을 자동으로 충족시킬 것이라고 가정하기보다, EU AI 법 제50조에 따른 자체 의무를 독립적으로 평가할 것을 권고합니다.
Claude
Code도 동일하게 적용됩니다
Anthropic은 Claude Code를 적용 대상 인터페이스로 명시합니다.
즉, Claude Code를 통해 지원 모델이 생성한 텍스트에는 동일한 모델 수준의 워터마크가 포함될 수 있습니다.
이는 코딩 에이전트의 출력이 다양한 형태를 띨 수 있기 때문에 중요합니다:
- 설명.
- 커밋 메시지.
- 문서.
- 코드 주석.
- 생성된 코드.
- Markdown 파일.
- 터미널 대상 텍스트.
공식 도움말 페이지에서는 워터마크가 생성된 텍스트에 일반적으로 적용된다고 설명합니다.
그러나 Anthropic은 다양한 프로그래밍 언어, 짧은 코드 스니펫, 압축 파일 또는 대규모 편집이 이루어진 코드베이스에서 감지기가 어떻게 작동하는지에 대한 확실한 주장을 뒷받침할 충분한 기술적 세부 사항을 아직 공개하지 않았습니다.
따라서 개발자는 워터마크를 소프트웨어 규정 준수 스캐닝 도구로 취급해서는 안 됩니다.
Claude Cowork 및 Claude Tag도 동일하게 포함됩니다
동일한 정책이 지원 모델을 사용하는 Claude Cowork 및 Claude Tag에도 적용됩니다.
이러한 제품은 단순한 채팅 응답 범위를 넘어서는 작업 산출물을 생성할 수 있기 때문에 이는 중요합니다.
사용자는 Claude에게 다음을 요청할 수 있습니다:
- 보고서 초안 작성.
- 프레젠테이션 제작.
- 시각 자료 제작.
- 문서 생성.
- 구조화된 작업 출력 준비.
따라서 텍스트 마킹과 파일 출처 추적이 동일한 워크플로우의 서로 다른 부분에 나타날 수 있습니다.
문서에는 워터마크가 있는 텍스트가 포함될 수 있고, 내보낸 지원 이미지에는 서명된 출처 메타데이터가 포함됩니다.
AWS, Google Cloud 및 Microsoft Foundry에서의 상황
Anthropic은 타사 클라우드 플랫폼도 다룹니다.
다음 채널을 통해 액세스하는 지원 Claude 모델의 경우:
- 아마존 웹 서비스(AWS).
- Google Cloud.
- Microsoft Foundry.
텍스트 포함 워터마크가 동일하게 적용됩니다.
파일 출처 추적 계층은 더 조건적입니다.
Anthropic은 사용 가능한 파일 처리 기능이 다르기 때문에 서명된 출처 메타데이터가 모든 클라우드 플랫폼에서 지원되지 않을 수 있다고 밝혔습니다.
실제 차이점은 다음과 같습니다:
| 액세스 경로 | 텍스트 포함 워터마크 | 서명된 파일 출처 |
|---|---|---|
| Claude / Anthropic 인터페이스 | 마킹된 모델에 지원됨 | 파일 유형 및 기능이 허용하는 경우 지원됨 |
| Claude 플랫폼/API | 마킹된 모델에 지원됨 | Claude 파일 처리에서 허용하는 경우 |
| AWS | 지정 모델 지원 | 플랫폼/기능 관련 |
| Google Cloud | 지정 모델 지원 | 플랫폼/기능 관련 |
| Microsoft Foundry | 지정 모델 지원 | 플랫폼/기능 관련 |
이것이 전체 시스템을 하나의 보편적인 워터마크로 설명해서는 안 되는 또 다른 이유입니다.
텍스트 계층과 파일 계층은 서로 다른 배포 요구 사항을 가지고 있습니다.
어떤 Claude 모델에 마킹이 적용되나요?
Anthropic의 현재 규칙은 모델 출시 날짜를 기준으로 합니다.
공식 문서는 다음과 같이 설명합니다:
2026년 8월 2일 이후 EU에서 출시된 Claude 모델은 출시 시 기계 판독 가능 마킹을 지원합니다.
이전에 출시된 모델은 위 진술 범위에 자동으로 포함되지 않습니다.
Anthropic은 초기 모델에 대한 마킹 지원을 추가하기 위해 노력하고 있다고 밝혔습니다.
회사는 각 역사적 Claude 모델이 현재 두 계층의 마킹을 모두 갖추고 있는지 설명하는 간단하고 영구적인 표를 아직 공개하지 않았습니다.
따라서 안정적인 구현은 단순히 "Claude"라는 단어만으로 지원 여부를 추론하지 말고 현재 모델 문서를 참조해야 합니다.
이전 모델을 사용하는 제품은 다음을 가정해서는 안 됩니다:
Claude 모델
= 확실히 마킹이 있음
올바른 질문은 다음과 같습니다:
이 특정 Claude 모델이 현재 마킹을 지원합니까?
8월 2일 날짜는 모든 이전 출력이 소급 변경되었다는 주장이 아닙니다
워터마크는 지원 모델이 콘텐츠를 생성하거나 처리할 때 적용됩니다.
이는 몇 달 전에 Claude가 생성한 텍스트를 소급하여 변경하지 않습니다.
출시 전에 생성된 문서는 모델이 나중에 업데이트되었다고 해서 갑자기 숨겨진 신호를 얻지 않습니다.
마찬가지로, 이전 모델이 텍스트 생성 시 마킹을 지원하지 않았다면 마킹이 없다는 것은 Claude가 관여했는지에 대해 거의 증명력이 없습니다.
이것이 감지기가 완전한 역사적 AI 저자 데이터베이스 역할을 할 수 없는 이유 중 하나입니다.
Anthropic은 탐지 도구를 구축 중입니다
아무도 확인할 수 없다면 워터마크의 실질적 가치는 제한적입니다.
Anthropic은 다음 측의 탐지를 지원할 계획이라고 밝혔습니다:
- Claude 사용자.
- 기타 제3자.
회사는 향후 기술 문서에서 탐지 메커니즘을 더 자세히 설명할 것이라고 밝혔습니다.
본 문서 발행일 현재 해당 기술 가이드는 아직 준비 중입니다.
이는 다음 두 가지 사이에 중요한 차이가 있음을 의미합니다:
Anthropic이 마킹 지원을 배포했습니다
그리고:
누구나 완전히 문서화된 공개 감지기를 즉시 실행하여 모든 Claude 마킹을 감지할 수 있습니다
첫 번째 주장은 뒷받침됩니다.
두 번째는 너무 절대적입니다.
미래의 Claude 감지기가 알려줄 수 있는 것
Anthropic은 탐지를 텍스트나 파일에 지원되는 Claude 마킹이 있는지 확인하는 것으로 설명합니다.
지원되는 마킹이 감지되면 안전한 해석은 다음과 같습니다:
이 콘텐츠는 Claude에 의해 처리되었을 수 있습니다.
이 표현이 중요합니다.
감지기는 자동으로 다음을 주장해서는 안 됩니다:
- Claude가 모든 문장을 작성했다.
- 인간의 기여가 없다.
- 콘텐츠가 허위다.
- 콘텐츠가 표절이다.
- 사용자가 정책을 위반했다.
- 전체 문서가 AI로 생성되었다.
출처 정보는 처리 이력에 대한 증거입니다.
それは 도덕적 또는 품질 판단이 아닙니다.
"워터마크 미감지"가 약한 증거인 이유
Anthropic은 반대 상황에 대해서도 마찬가지로 명확합니다.
워터마크를 감지하지 못했다고 해서 콘텐츠가 인간이 작성했다는 것을 증명하지 않습니다.
Claude가 생성한 콘텐츠에 감지 가능한 신호가 없을 수 있는 이유는 다음과 같습니다:
- 아직 워터마크 마킹을 지원하지 않는 모델에서 나온 경우.
- 대규모 편집을 거친 경우.
- 재작성되거나 의역된 경우.
- 번역을 거친 경우.
- 다른 텍스트와 혼합된 경우.
- 너무 짧은 경우.
- 관련 파일 메타데이터가 제거된 경우.
- 사용된 플랫폼 또는 파일 유형이 해당 워터마크 마킹 방식을 지원하지 않는 경우.
이로 인해 감지기는 비대칭적입니다.
양성 결과는 유용한 증거를 제공할 수 있습니다.
음성 결과는 AI 개입 가능성을 신뢰할 수 있게 배제할 수 없습니다.
이것이 학교와 고용주에게 중요한 이유
AI 감지 시스템은 고위험 시나리오에서 자주 사용됩니다.
예를 들어:
- 학술 부정행위 검토.
- 채용 평가.
- 뉴스 업계.
- 직원 성과 평가.
- 출판 업계.
- 법률 문서 워크플로우.
Claude 워터마크는 출처 추적을 개선할 수 있지만 자동화된 "유죄 감지기"로 취급되어서는 안 됩니다.
책임 있는 처리 절차는 다음을 구분해야 합니다:
기계 판독 가능한 Claude 신호
와:
누군가 규칙을 위반했다는 증거
대학이 AI 보조 교정을 허용하지만 완전히 AI가 작성한 과제를 금지한다면, 워터마크가 감지되었다는 것만으로 어떤 행위가 발생했는지 결정할 수 없습니다.
텍스트는 학생 본인에게서 비롯되었을 수 있으며 Claude가 편집만 수행했을 수 있습니다.
여전히 인간 정책과 상황적 증거가 판단에 필요합니다.
이것이 출판사와 뉴스룸에 중요한 이유
출판사는 기계 판독 가능한 출처 정보가 내부 워크플로우 추적에 유용하다는 것을 알 수 있습니다.
예를 들어, 뉴스룸은 다음을 구분할 수 있습니다:
- 인간이 작성한 초안.
- Claude 보조 편집.
- Claude 번역.
- AI 생성 일러스트레이션.
- 인간 편집 후 최종 출판물.
그러나 출처 추적 시스템은 데이터가 보존되는 워크플로우에서 가장 잘 작동합니다.
콘텐츠가 메타데이터를 제거하는 도구 간에 반복적으로 복사되거나 크게 재작성된 경우 추적 체인은 불완전해집니다.
민감한 출판 워크플로우의 경우 조직은 다음을 보존해야 할 수 있습니다:
- 원본 파일.
- 콘텐츠 자격 증명.
- 편집 이력.
- AI 보조 기록.
- 인간 승인 기록.
워터마크는 더 넓은 출처 추적 시스템에서 하나의 신호일 뿐 전체가 아닙니다.
이 시스템은 AI 텍스트를 "숨길 수 없게" 만들기 위한 것이 아닙니다
원문 기사의 제목은 AI 생성 콘텐츠가 숨길 수 없게 될 수 있음을 암시합니다.
이는 Anthropic의 주장을 과장한 것입니다.
Anthropic
다양한 상황에서 워터마크가 감지되지 않을 수 있다는 점이 명확히 기록되어 있다.
대폭적인 재작성은 텍스트 신호를 약화시킨다.
몇 분 만에 쇼케이스 사이트를 만들고 리드를 늘리세요
아이디어를 한 문장으로 입력하면 We0 AI가 쇼케이스 사이트, 페이지, CMS를 생성하고 출시 후 고객과 트래픽 확보를 돕습니다.
무료 등록을 위한 하나의 완전한 프로젝트 생성
하나의 완전한 생성 흐름을 시도하고 첫 번째 프로젝트 초안을 빠르게 보는 데 가장 적합합니다.
스크린샷 및 형식 변환은 파일 메타데이터를 제거한다.
지원되지 않는 인터페이스는 모든 유형의 워터마크를 보존하지 못할 수 있다.
더 정확한 결론은 다음과 같다:
출처 신호가 보존되는 경우, Claude가 생성한 콘텐츠는 점점 더 식별 가능해지고 있지만, 이 시스템이 AI 참여를 영구적이거나 보편적으로 감지 가능하게 만들지는 않는다.
이는 출처 추적 시스템의 더 광범위한 기술적 현실과 일치한다.
견고성은 절대적 보장이 아닌 점진적인 스펙트럼이다.
Claude의 접근 방식과 C2PA 및 SynthID 비교
Anthropic의 접근 방식은 AI 업계 다른 곳에서 이미 볼 수 있는 두 가지 개념을 결합한다.
C2PA / 콘텐츠 자격 증명
C2PA는 디지털 자산에 암호화 서명된 출처 정보를 제공한다.
이 표준은 점점 확장되는 생태계에서 지원되며, 여기에는 다음이 포함된다:
- AI 기업.
- 카메라 제조사.
- 소프트웨어 공급업체.
- 미디어 기관.
- 콘텐츠 플랫폼.
공개된 Content Credentials Verify 도구는 지원되는 파일에서 호환 자격 증명의 존재 여부를 확인할 수 있다.
Google SynthID
Google DeepMind의 SynthID는 인지 불가능한 워터마크를 AI 생성 콘텐츠에 직접 내장한다.
Google은 SynthID가 적용될 수 있다고 밝힌다:
- 이미지.
- 오디오.
- 텍스트.
- 비디오.
이 개념은 C2PA 메타데이터보다는 Anthropic의 내장형 워터마크 레이어에 더 가깝다.
OpenAI 출처 신호
OpenAI는 현재 지원되는 생성 미디어에 대한 출처 신호를 문서화하고 있으며, 지원되는 이미지 및 오디오 워크플로우의 C2PA 메타데이터와 SynthID를 포함한다.
OpenAI의 공개 검증 도구는 지원되는 미디어 파일을 대상으로 하며, 임의의 AI 생성 텍스트를 탐지하는 범용 탐지기가 아니다.
따라서 더 광범위한 업계 방향은 계층화된 출처 추적이다:
내장 신호
+
서명된 메타데이터
+
검증 도구
+
플랫폼 라벨
Anthropic은 텍스트 워터마크를 추가하여 Claude를 이 모델에 더 직접적으로 통합한다.
텍스트 워터마크는 이미지 메타데이터보다 더 어렵다
텍스트는 특히 까다로운 출처 추적 문제를 제기한다.
이미지는 픽셀이나 메타데이터에 숨겨진 정보를 담으면서도 동일한 시각적 대상을 유지할 수 있다.
텍스트는 의미론적 수준에서 자주 변환된다.
사용자는 다음을 수행할 수 있다:
- 동의어를 교체한다.
- 문장 순서를 조정한다.
- 텍스트를 번역한다.
- 요약한다.
- 확장한다.
- 여러 초안을 병합한다.
- 다른 모델로 재작성한다.
결과는 동일한 의미를 유지하면서도 원래 토큰 시퀀스의 대부분을 대체할 수 있다.
따라서 강력한 텍스트 워터마크는 경쟁하는 목표들 사이에서 균형을 맞춰야 한다:
- 인지 불가능해야 한다.
- 언어 품질을 유지해야 한다.
- 일상적인 편집을 견뎌야 한다.
- 탐지 가능해야 한다.
- 오탐지에 저항해야 한다.
- 쉽게 위조되어서는 안 된다.
Anthropic은 이러한 모든 균형을 독립적으로 평가할 수 있을 만큼 충분한 구현 세부 사항을 아직 공개하지 않았다.
Anthropic이 아직 모든 기술 세부 사항을 공개하지 않은 이유
워터마크 시스템은 적대적 문제에 직면한다.
공격자가 워터마크의 구성 방식을 정확히 알게 되면 다음을 시도할 수 있다:
- 워터마크 제거.
- 워터마크 위조.
- 인간이 작성한 텍스트로 전이.
- 탐지를 회피하는 변환 설계.
- 오탐지 유발.
한편, 완전히 투명한 시스템은 연구자와 규제 기관이 평가하기 어렵다.
Anthropic의 현재 입장은 절충적이다.
공개적으로 문서화한 내용:
- 마커의 존재.
- 2계층 아키텍처.
- 제품 적용 범위.
- 주요 제한 사항.
- 제3자 탐지 계획.
상세한 탐지 지침은 아직 공개되지 않았다.
이는 회사가 향후 더 완전한 기술 프레임워크를 발표할 여지를 남긴다.
EU AI 법 제50조의 범위는 Claude보다 더 넓다
Anthropic의 마킹 시스템은 광범위한 유럽 투명성 체제에 대한 특정 공급업체의 이행으로 이해되어야 한다.
유럽위원회는 제50조가 생성형 AI 시스템의 공급자와 배포자에 대한 투명성 의무를 다룬다고 밝힌다.
실천 강령은 준수 메커니즘으로서 자발적이지만, 제50조의 법적 의무 자체는 단순히 자발적인 것이 아니다.
이 강령은 다음과 같은 별도의 섹션을 포함한다:
- 공급자: 마킹 및 탐지.
- 배포자: 딥페이크 및 일부 AI 생성 또는 처리된 텍스트의 라벨링.
따라서 실제 의무는 조직이 다음과 같은지에 따라 달라질 수 있다:
생성형 AI 시스템을 구축하는 경우
또는:
생성형 AI 시스템을 사용하여 콘텐츠를 게시하는 경우
개발자는 규정을 준수하는 상위 모델을 사용한다고 해서 하위 배포자가 부담하는 모든 의무가 자동으로 충족된다고 가정해서는 안 된다.
투명성 강령과 GPAI 강령은 다르다
EU에는 여러 AI 실천 강령이 있어 혼란을 초래할 수 있다.
**《AI 생성 콘텐츠 투명성 실천 강령》**은 제50조의 마킹 및 라벨링 의무를 다룬다.
이전의 **《일반 AI 실천 강령》**은 일반 AI 모델 공급자의 의무를 다루며, 다음 영역을 포함한다:
- 투명성 문서.
- 저작권.
- 시스템적 위험 모델의 안전과 보안.
Anthropic은 GPAI 강령의 서명자 중 하나이기도 하다.
Claude 마킹 관련 문서는 특히 제50조 제2항 투명성 강령을 인용한다.
이 두 가지 준수 프레임워크는 동일한 문서로 간주되어서는 안 된다.
Claude를 사용하는 개발자는 어떻게 해야 하는가
Anthropic의 권고는 간단하다: 자신의 의무를 독립적으로 평가하라.
실용적인 구현 체크리스트는 다음과 같다.
- Claude 모델 식별
애플리케이션이 사용하는 정확한 모델을 기록한다.
막연한 "Claude" 라벨에 의존하지 말라.
- 마킹 지원 확인
해당 모델이 현재 기계 판독 가능한 마킹을 지원하는지 확인한다.
이전 모델은 다르게 동작할 수 있다.
- 출력 파이프라인 검토
Claude가 콘텐츠를 반환한 후 발생하는 모든 것을 기록한다.
예를 들어:
Claude API
→ 애플리케이션 후처리
→ 데이터베이스
→ 다른 모델
→ 템플릿 엔진
→ PDF 내보내기
→ 고객
모든 변환은 출처 추적에 영향을 미칠 수 있다.
- 텍스트와 파일의 출처 추적 구분
C2PA 메타데이터와 텍스트 워터마크가 동일한 작업에서 존속한다고 가정하지 말라.
각각 별도로 테스트하라.
- 필요한 경우 원본 아티팩트 보존
규제 또는 높은 신뢰도가 요구되는 워크플로우의 경우 다음을 보존하라:
- 원본 모델 출력.
- 원본 생성 파일.
- 서명된 메타데이터.
- 변환 이력.
- 인간 편집 기록.
- 최종 게시 버전.
- 탐지 결과를 저작자 증명으로 간주하지 말라
긍정적 마커는 Claude 처리를 거쳤음을 나타낼 수 있다.
그러나 원본 저작자를 증명하지는 않을 수 있다.
- 짧은 텍스트와 편집된 콘텐츠 테스트
사용 사례에는 다음이 포함될 수 있다:
- 제목.
- 코드 스니펫.
- 요약.
- 번역.
- 대폭 편집된 보고서.
이러한 상황은 정확히 탐지가 덜 신뢰할 수 있는 시나리오이다.
- 제50조 의무 검토
제품이 EU 시장에서 제공되거나 EU 시장에 영향을 미치는 경우, 구체적인 역할에 따라 관련 법률과 유럽위원회의 현재 지침을 평가하라.
- Anthropic의 탐지 문서 주시
Anthropic은 더 많은 기술 지침을 발표할 것이라고 밝혔다.
아직 공개되지 않은 탐지기에 대한 가정을 바탕으로 영구적인 준수 아키텍처를 구축하지 말라.
실용적인 출처 추적 워크플로우
Claude를 사용하여 공개 콘텐츠를 제작하는 회사를 위한 견고한 워크플로우는 다음과 같을 수 있다:
인간 또는 소스 데이터
↓
Claude 지원 모델
↓
원본 마킹 출력 저장
↓
인간 편집
↓
최종 게시 파일
↓
지원되는 곳에 출처 메타데이터 보존
↓
법적 또는 편집 요구 사항이 있는 곳에 공개/라벨 추가
↓
감사 기록 유지
이 접근 방식은 워터마크가 모든 변환에서 존속한다는 가정에 의존하지 않는다.
공개된 최종 제품이 변경되더라도 내부 증거 체인은 유지된다.
콘텐츠 제작자는 무엇을 기대해야 하는가
지원되는 Claude 모델을 사용하여 다음을 작성하는 경우:
- 이메일.
- 보고서.
- 블로그 게시물.
- 문서.
- 마케팅 카피.
- 기사.
생성된 텍스트에는 기계 판독 가능한 워터마크가 포함될 수 있다.
다른 애플리케이션으로 텍스트를 복사한다고 해서 반드시 워터마크가 제거되지는 않습니다.
또한 이는 사용자가 보는 문서에 "Claude가 작성함"이라고 표시된다는 의미도 아닙니다.
해당 표시는 감지가 어렵도록 설계되었습니다.
또한 모든 미래의 독자가 오늘 바로 그것을 스캔할 수 있다는 의미도 아닙니다.
Anthropic의 제3자 감지 가이드라인은 아직 마련 중입니다.
수동 편집 후에는 어떻게 되나요?
워터마크가 사라지는 고정된 편집 비율 임계값은 존재하지 않습니다.
Anthropic은 다음과 같은 일반적인 임계값을 공개하지 않았습니다.
20% 재작성 = 감지 가능
50% 재작성 = 감지 불가
회사는 해당 표시가 특정 편집 후에도 유지될 수 있지만, 대대적인 편집, 재작성, 번역 또는 혼합 후에는 감지가 불가능해질 수 있다고만 밝혔습니다.
결과는 다음에 따라 달라질 수 있습니다:
- 문단 길이
- 편집 유형
- 변경되지 않은 텍스트의 양
- 감지기 설계
- 언어
- 변환 방법
따라서 Anthropic이 해당 주장을 뒷받침하는 증거를 공개하지 않는 한, 정확한 일반적인 편집 임계값이 존재한다고 주장하는 도구는 주의해서 다루어야 합니다.
생성된 이미지에는 어떻게 되나요?
지원되는 생성 파일 형식(예: PNG 및 JPG)의 경우, Claude는 C2PA 표준에 따라 서명된 출처 메타데이터를 첨부할 수 있습니다.
메타데이터가 온전하게 유지되면 호환되는 검증 도구가 이를 검사할 수 있습니다.
이미지가 다음과 같은 경우:
- 스크린샷으로 캡처된 경우
- 변환된 경우
- 지원되지 않는 소프트웨어를 통해 다시 내보내진 경우
- 메타데이터를 제거하는 서비스에 업로드된 경우
출처 정보가 사라질 수 있습니다.
자격 증명이 없다고 해서 이미지가 인간에 의해 생성되었음을 증명하지는 않습니다.
SVG 파일에는 어떻게 되나요?
Anthropic은 SVG를 서명된 출처 메타데이터를 지원하는 파일 형식 예시에 명시적으로 포함시켰습니다.
SVG는 Claude가 구조화된 파일 형식으로 벡터 그래픽과 다이어그램을 생성할 수 있기 때문에 유용합니다.
다른 파일 형식과 마찬가지로, 처리 체인이 메타데이터를 보존하는 경우에만 출처 정보가 존속할 수 있습니다.
사용자가 SVG 마크업만 새 파일에 복사하는 경우 원래 자격 증명이 보존되지 않을 수 있습니다.
누군가 Claude 워터마크를 위조할 수 있나요?
Anthropic의 현재 공개 문서는 임베디드 텍스트 표시의 위조 난이도에 대해 신뢰할 수 있는 판단을 내리기에 충분한 정보를 제공하지 않습니다.
이는 중요한 공개 보안 문제입니다.
모든 출처 추적 시스템은 다음을 모두 고려해야 합니다:
제거 공격
그리고:
위조 공격
악의적인 행위자는 둘 다에서 이익을 얻을 수 있습니다.
인간이 생성한 콘텐츠를 AI 생성처럼 보이게 만드는 것은 숨겨진 AI 출처를 이용하는 것만큼이나 이익이 될 수 있습니다.
이것이 고위험 결정이 단일 자동화 신호에만 의존해서는 안 되는 이유입니다.
워터마크가 AI 허위 정보를 막을 수 있나요?
아니요.
기계 판독 가능한 표시는 투명성을 높일 수 있지만, 허위 정보 문제를 단독으로 해결할 수는 없습니다.
악의적인 행위자는 다음을 활용할 수 있습니다:
- 표시가 없는 모델
- 구버전 모델
- 추론 코드가 수정된 오픈 가중치 모델
- 인간의 재작성
- 스크린샷
- 메타데이터를 제거하는 도구
- 전적으로 인간이 작성한 허위 주장
출처 추적은 다음 질문에 답하는 데 도움이 됩니다:
콘텐츠의 생성 또는 처리 방식에 대해 우리가 알 수 있는 것은 무엇인가?
하지만 다음 질문에는 답할 수 없습니다:
이 콘텐츠가 사실인가?
팩트체크와 출처 추적은 상호 보완적인 작업입니다.
더 유용한 미래는 "AI 감지"보다 출처 추적입니다
"AI 감지기"라는 용어는 이분법적 테스트를 암시합니다:
AI
또는
인간
실제 콘텐츠 제작은 점점 더 혼합적으로 변하고 있습니다.
하나의 문서에는 다음이 포함될 수 있습니다:
- 인간의 연구
- Claude의 초안 작성
- 인간의 편집
- AI 번역
- 인간의 승인
- AI 레이아웃
- 인간의 게시
그런 세상에서 더 유용한 질문은 다음과 같습니다:
"AI가 사용되었는가?"
보다는:
"이 콘텐츠는 어떤 과정을 거쳤고, 어떤 도구가 관여했으며, 체인의 어느 부분을 검증할 수 있는가?"
이것이 바로 출처 추적 표준이 해결하려는 문제입니다.
자주 묻는 질문
Claude는 이제 모든 생성 텍스트에 워터마크를 추가하나요?
지원되는 Claude 모델은 생성된 텍스트에 기계 판독 가능한 워터마크를 삽입할 수 있습니다. Anthropic은 2026년 8월 2일 이후 EU에서 출시된 모델이 출시 시점에 표시 기능을 지원하며, 이전 모델에 대한 표시 지원은 점진적으로 추가되고 있다고 밝혔습니다.
텍스트에서 Claude 워터마크를 볼 수 있나요?
아니요. Anthropic은 워터마크를 감지할 수 없도록 설계되었다고 설명하며, 응답의 의도된 의미, 품질 또는 가독성을 변경하지 않는다고 밝혔습니다. 이는 기계 판독 가능한 감지를 위해 설계된 것이지 가시적인 라벨이 아닙니다.
Claude 텍스트를 Word나 이메일에 복사하면 워터마크가 제거되나요?
반드시 그렇지는 않습니다. Anthropic은 임베디드 신호가 복사하여 붙여넣은 텍스트와 함께 전파되며 특정 편집 후에도 유지될 수 있다고 밝혔습니다. 대대적인 재작성, 의역, 번역, 혼합 또는 단축은 표시를 감지할 수 없게 만들 수 있습니다.
Claude 워터마크가 전체 문서가 Claude가 작성했음을 증명할 수 있나요?
아니요. 감지된 표시는 콘텐츠가 Claude를 거쳤음을 나타낼 수 있지만, Claude가 인간이 작성한 자료를 단순히 교정, 번역, 요약 또는 재포맷했을 수도 있습니다. Anthropic은 이 표시가 원본 저작자임을 완전히 증명하는 것은 아니라고 명시적으로 경고합니다.
Claude는 생성된 이미지에 C2PA 메타데이터를 추가하나요?
Anthropic은 SVG, PNG, JPG와 같은 지원되는 생성 파일 형식이 C2PA 표준을 따르는 디지털 서명 출처 메타데이터를 받을 수 있다고 밝혔습니다. 지원 여부는 제품, 플랫폼, 기능 및 파일 형식에 따라 달라질 수 있습니다.
Claude 워터마크는 AWS, Google Cloud 및 Microsoft Foundry에서 활성화되나요?
Anthropic은 AWS, Google Cloud 또는 Microsoft Foundry를 통해 지원되는 Claude 모델에 액세스할 때 임베디드 텍스트 워터마크가 적용된다고 밝혔습니다. 파일 처리 기능이 다르기 때문에 모든 클라우드 플랫폼이 서명된 출처 메타데이터를 지원하는 것은 아닙니다.
공개된 Claude 워터마크 감지기가 있나요?
Anthropic은 사용자와 제3자를 위한 감지 지원을 구축 중이며 더 많은 기술 가이드를 공개할 것이라고 밝혔습니다. 2026년 8월 11일 현재, 회사의 공식 문서는 임베디드 텍스트 워터마크에 대한 완전한 공개 감지 사양을 제공하지 않았습니다.
Claude 워터마크가 없다는 것이 텍스트가 인간이 작성했다는 증명인가요?
아니요. 워터마크가 없거나 감지되지 않을 수 있는 이유는 다음과 같습니다: 워터마크 지원 기능 이전의 모델, 너무 짧은 텍스트, 대대적인 편집 또는 번역을 거친 텍스트, 또는 관련 파일 메타데이터가 제거된 경우입니다. 워터마크 신호가 없다고 해서 텍스트가 인간이 작성했다는 신뢰할 수 있는 증명이 되지는 않습니다.
관련 도구
- Claude: Anthropic의 공식 AI 어시스턴트이자, 지원되는 모델에서 기계 판독 가능한 표시가 적용되는 제품 인터페이스 중 하나입니다.
- Claude Platform: Claude 모델을 사용하여 애플리케이션을 구축하기 위한 Anthropic의 개발자 플랫폼으로, 표시가 적용된 지원 모델 출력을 포함합니다.
- Claude Code: Anthropic의 프로그래밍 에이전트로, 지원 모델의 텍스트 출력은 동일한 모델 수준 표시 정책을 따릅니다.
- Content Credentials Verify: 디지털 자산에서 지원되는 콘텐츠 자격 증명 및 출처 정보를 확인하기 위한 공식 검증 도구입니다.
- C2PA: 오픈 콘텐츠 자격 증명 출처 사양 뒤에 있는 표준 기구로, Claude의 서명된 파일 메타데이터가 기반하는 표준입니다.
- Google SynthID: Google DeepMind의 임베디드 워터마킹 기술로, AI 생성 텍스트, 이미지, 오디오 및 비디오에 적용됩니다.
- EU 투명성 행동 강령: 유럽연합 집행위원회의 지침으로, AI법 제50조에 따른 표시 및 라벨링 의무 준수를 지원합니다.
관련 링크
Anthropic: Claude가 AI 생성 콘텐츠를 표시하는 방법: Claude 텍스트 워터마크, C2PA 출처 정보, 제품 적용 범위, 클라우드 동작, 탐지 계획 및 한계에 대한 주요 공식 소스입니다.
- EU AI 생성 콘텐츠 투명성 행동 강령: 유럽위원회 페이지로, 제50조에 따른 제공자 및 배포자 투명성 프레임워크를 설명합니다.
- EU 인공지능법: EU의 AI 투명성 의무와 더 넓은 규제 프레임워크를 확립한 공식 법적 텍스트입니다.
- C2PA 기술 사양: 암호화 방식으로 바인딩된 출처 기록 및 콘텐츠 자격 증명에 관한 개방형 기술 사양입니다.
- C2PA 콘텐츠 자격 증명 설명: 출처 기록이 어떻게 첨부되고, 서명되고, 검증되는지에 대한 더 이해하기 쉬운 설명입니다.
- Content Credentials Verify: 호환되는 출처 정보를 확인하기 위한 공개 도구입니다.
지원되는 디지털 콘텐츠의 자격 증명.
- Google DeepMind SynthID: 여러 생성 미디어 유형에 걸친 Google의 보이지 않는 워터마크 시스템에 대한 공식 개요입니다.
요약
Anthropic은 두 가지 상호 보완 메커니즘을 통해 지원되는 Claude 출력에 기계가 읽을 수 있는 출처 정보를 도입하고 있습니다: 생성된 텍스트에 삽입되는 보이지 않는 워터마크와 지원되는 파일에 첨부되는 C2PA 기반 서명 출처 메타데이터입니다.
이 이니셔티브는 EU 인공지능법 제50조의 투명성 프레임워크와 연계되어 있지만, Anthropic은 지원되는 모델이 전 세계적으로 Claude, API, Claude Code, Claude Cowork, Claude Tag 및 지원되는 클라우드 제공업체 접근 경로에 표시를 적용할 것이라고 밝혔습니다. 2026년 8월 2일 이후 EU에서 출시되는 새 모델은 출시 시점부터 표시를 지원하는 반면, 더 오래된 모델은 여전히 업데이트 중입니다.
이 시스템은 유용하지만 완벽한 AI 저자 탐지기는 아닙니다. 텍스트 워터마크는 대대적인 편집이나 번역 후에는 감지되지 않을 수 있으며, 파일 메타데이터는 제거될 수 있고, 감지된 신호는 단지 Claude가 해당 콘텐츠를 처리했을 가능성을 나타낼 뿐입니다 — Claude가 콘텐츠의 모든 부분을 생성했다는 의미는 아닙니다.
실질적인 전환은 무언가가 "AI가 쓴 것처럼 보인다"고 추측하는 것에서, 디지털 콘텐츠가 어떻게 생성되고 처리되었는지에 대한 검증 가능한 증거를 보존하는 것으로 이동하는 것입니다.



