Anthropic, Claude 모델이 생성한 텍스트에 워터마크 추가
support.claude.com조회수 06일 전
핵심
Anthropic이 EU AI 법 제50조(2)항의 AI 생성 콘텐츠 투명성 협약에 서명했으며, Claude가 생성하는 콘텐츠에 기계가 읽을 수 있는 표시를 삽입하는 방식으로 투명성 의무를 이행할 계획이다.
Claude의 콘텐츠 표시 방식
Claude는 두 가지 상호보완적 기법으로 Claude가 생성하고 처리한 콘텐츠를 표시한다.
1. 텍스트에 삽입된 워터마크
- Claude 모델이 텍스트를 생성할 때 텍스트 자체에 인식 불가능한 워터마크를 직접 삽입한다
- 워터마크는 눈에 띄지 않으며 응답의 의미, 품질, 읽기 용이성을 변경하지 않는다
- 워터마크는 텍스트의 일부이기 때문에 다른 곳으로 복사해서 붙여넣을 때 함께 이동하며, 일부 편집 과정에서도 지속될 수 있다
- 워터마킹은 모델 수준에서 적용되므로 어떤 Claude 제품이나 인터페이스에서 생성되든 현재된다
2. 파일에 첨부되는 서명된 출처 메타데이터
- Claude가 .svg, .png, .jpg 등 지원되는 파일 형식을 생성할 때 서명된 출처 메타데이터를 첨부한다
- 이 메타데이터는 업계 전역에서 콘텐츠 출처 정보를 기록하는 데 사용되는 개방형 표준인 콘텐츠 출처 및 진정성 연합(C2PA, Coalition for Content Provenance and Authenticity) 표준을 따른다
- 서명된 메타데이터 라벨이 있으면 파일이 Claude에 의해 처리되었음을 나타내며, 파일이 변조되었는지 감지할 수 있다
Claude 표시의 감지
Anthropic은 사용자와 제3자가 Claude의 임베드된 워터마크와 출처 메타데이터를 감지할 수 있도록 활성화 작업을 진행 중이다. 감지는 텍스트나 파일이 지원되는 Claude 표시를 포함하고 있는지 확인한다. 지원되는 표시가 발견되면 콘텐츠가 Claude에 의해 처리되었을 가능성이 있음을 나타낸다. 감지 메커니즘에 대한 자세한 내용은 향후 기술 문서에서 공유할 예정이다.
한계
기계가 읽을 수 있는 표시는 콘텐츠에 대한 중요한 신호를 제공하지만, 모든 콘텐츠 유형에 걸쳐 그 한계를 이해하는 것이 중요하다.
Claude를 활용하는 경우
- 자신의 제품에 Claude를 배포하는 경우 제50조가 자신의 제품과 서비스에 요구하는 바를 독립적으로 평가해야 한다
- EU 협약 하의 Anthropic의 약속과 일치하게, 목표는 사용자가 자신의 투명성 의무를 충족하도록 지원하는 것이며, 표시 및 감지 접근 방식에 대한 기술 지침은 이용 가능해질 때 공유할 것이다