클로드 생성·수정 문서에 기계 판독 표시 적용
핵심 요약
EU 출시 클로드 새 모델은 생성하거나 처리한 텍스트와 파일에 기계 판독용 표시를 남긴다. 단순 교정·번역에도 표시될 수 있지만 대폭 수정하거나 문구를 섞으면 탐지되지 않을 수 있다. 앤트로픽은 오는 12월 2일 유예기한을 앞두고 EU 인공지능법 제50조 대응에 나섰다.
앤트로픽이 지난 2일 유럽연합에서 출시한 클로드 새 모델의 생성·처리 결과물에 기계 판독용 워터마크를 적용했다. 이 모델은 이용 지역과 관계없이 텍스트와 파일 메타데이터에 클로드가 생성하거나 처리한 자료라는 표시를 남긴다. 사람이 작성한 보도자료를 다듬거나 번역하고 서식만 정리한 경우에도 표시가 포함될 수 있다.
텍스트에는 사람이 알아보기 어려운 패턴이 삽입되고, 파일 메타데이터에는 클로드를 거쳤음을 확인할 수 있는 디지털 서명이 들어간다. 다만 탐지에는 한계가 있다. 사람이 쓴 문구를 교정하는 수준으로 클로드를 활용해도 인공지능 생성물로 식별될 수 있으며, 반대로 결과물을 대폭 다시 쓰거나 다른 문구와 섞고 길이를 지나치게 줄이면 워터마크가 검출되지 않을 수 있다.
이번 조치는 생성되거나 조작된 콘텐츠에 인공지능이 사용됐다는 사실을 공개하도록 한 EU 인공지능법 제50조에 대응하기 위한 것이다. 관련 기업에는 오는 12월 2일까지 법 준수 유예기간이 주어졌다. 오픈AI도 규정 준수를 위한 워터마크 도입 방안을 제시했으며, 텍스트보다는 이미지와 오디오에 표시를 적용하는 방안에 무게를 두고 있다.
디지털 플랫폼들도 인공지능 콘텐츠 식별과 유통 관리를 강화하고 있다. 링크드인은 ‘인공지능이 만든 저질 콘텐츠처럼 보임’ 버튼을 시험 중이며, 서브스택은 팬그램의 인공지능 탐지 기능을 통합했다. 스냅은 인공지능으로 생성된 동영상의 노출을 중단했다. 클로드의 표시 체계는 단순 생성뿐 아니라 교정·번역·서식 작업까지 포괄하지만, 수정 정도에 따라 탐지 결과가 달라질 수 있다는 점도 함께 드러냈다.