클로드 생성물에 비가시 표식…EU 투명성 규약 대응
핵심 요약
앤트로픽이 EU의 투명성 규약에 대응해 클로드 생성 텍스트와 파일에 워터마크를 적용했다. 텍스트에는 편집 후에도 남는 신호를, 파일에는 C2PA 기반 제작 정보를 넣는다. 과도한 수정이나 번역으로 신호가 사라질 수 있고 정확도와 탐지 도구는 공개되지 않았다.
앤트로픽이 AI 모델 클로드가 생성한 텍스트와 파일에 사람이 알아보기 어려운 워터마크를 적용했다. 2026년 8월 2일 발효된 유럽연합의 AI 생성 콘텐츠 투명성 실천규약에 대응한 조치다. 같은 달 11일 규약 서명을 발표했으며, 8월 2일 이후 출시되는 모든 클로드 모델에는 이 기능을 기본 탑재하고 기존 모델에도 순차적으로 확대할 계획이다.
텍스트 워터마크는 문장 생성 과정에 고유한 신호를 넣어 복사하거나 붙여넣고 일부 내용을 고친 뒤에도 흔적이 남도록 설계됐다. 이미지 등 파일에는 제작 주체와 사용 도구, 변경 이력을 암호화된 정보로 붙이는 개방형 C2PA 표준을 활용한다. 이를 통해 학교 과제와 기업 보고서, 언론 기사 등에 포함된 클로드 생성 콘텐츠를 식별할 기술적 단서를 제공한다.
AI 생성물의 출처를 드러내려는 움직임은 허위 정보와 딥페이크 확산에 대한 우려 속에서 이어져 왔다. 한국 정부는 2023년 AI 생성 콘텐츠 워터마크와 신뢰성 검증 체계를 검토했고, 2024년에는 국내 기업들이 선거 딥페이크 방지 공동선언과 이미지 워터마크, 검색 경고 표시를 도입했다. 구글과 메타, 마이크로소프트, 오픈AI 등 주요 기업도 EU의 투명성 규약을 준수하기로 했다.
다만 워터마크만으로 작성 주체를 확정하기는 어렵다. 사람이 쓴 글을 클로드로 교정·번역·요약해도 신호가 남을 수 있는 반면, 문장을 대폭 수정하거나 다른 언어로 재작성하면 사라질 수 있다. 짧은 문장은 탐지가 어렵고 앤트로픽 고유 규칙을 쓰기 때문에 다른 회사 AI의 생성물은 가려내지 못한다. 정확도와 오탐·미탐 비율, 탐지 도구도 공개되지 않아 판정 증거로 활용하려면 추가 검증이 필요한 상태다.