클로드 결과물에 기계 판독형 투명성 표시
핵심 요약
앤트로픽이 클로드의 AI 생성 텍스트에 기계 판독형 워터마크를 도입했다. 복사나 일부 편집 뒤에도 유지되지만 짧은 글과 대폭 수정·번역된 문장에서는 탐지가 어려울 수 있다. 표시는 전 세계 서비스에 적용되며 탐지 도구는 아직 공개되지 않았다.
AI 챗봇 클로드를 개발한 앤트로픽이 생성형 AI의 텍스트 결과물에 사람의 눈으로는 보이지 않고 기계로 판독할 수 있는 워터마크를 넣는다. 이 기능은 지난 2일 발효된 유럽연합의 AI 관련 법에 대응해 도입됐다. 법 시행 이후 출시된 클로드 모델에는 이미 적용됐고, 기존 모델에도 순차적으로 추가되고 있다.
워터마크는 텍스트 자체에 융합되는 방식이어서 내용을 다른 곳에 복사해 붙이거나 일부 문장을 편집해도 유지된다. 표시가 들어가더라도 답변의 의미와 품질, 가독성에는 영향을 주지 않도록 설계됐다. 앤트로픽은 텍스트뿐 아니라 이미지와 파일 형태로 생성되는 결과물에도 출처를 확인할 수 있는 메타데이터를 부착한다.
다만 워터마크의 존재만으로 클로드가 해당 글을 처음 작성했다고 단정할 수는 없다. 이용자가 외부에서 작성한 글을 클로드로 교정하거나 번역·요약한 경우에도 표시가 적용될 수 있기 때문이다. 텍스트가 지나치게 짧거나 생성 문장을 대폭 고쳐 쓰고 번역한 때에는 반대로 워터마크가 탐지되지 않을 가능성도 있다.
앤트로픽은 이 투명성 표시 체계를 유럽연합에만 한정하지 않고 클로드가 제공되는 전 세계 서비스에 동일하게 적용할 계획이다. 다만 워터마크를 확인하는 탐지 도구는 아직 공개하지 않았다. 앞서 구글도 디지털 워터마크 기술인 ‘신스ID’를 개발해 AI 결과물에 적용한 바 있어, 생성 콘텐츠의 출처를 표시하려는 기술 도입이 이어지고 있다.