앤트로픽, 클로드 보이지 않는 텍스트 워터마크 기술 상세 공개

앤트로픽, 클로드 보이지 않는 텍스트 워터마크 기술 상세 공개

앤트로픽이 클로드 텍스트에 삽입되는 보이지 않는 워터마크의 작동 방식을 공개했습니다.

앤트로픽이 2026년 8월 15일, EU AI법(제50조) 투명성 코드 준수를 위해 클로드가 생성하는 텍스트에 적용되는 보이지 않는 워터마크의 작동 방식을 공식 블로그를 통해 자세히 공개했어요. 이 워터마크 기술은 구글 딥마인드가 개발한 SynthID-Text 방식을 활용하는데, AI 모델이 동의어처럼 결과에 큰 영향을 주지 않는 선택을 할 때 독자가 눈치챌 수 없는 패턴을 텍스트 안에 심어 넣는 방식이에요. 예를 들어 같은 의미의 단어 중 어떤 것을 고를지에 미묘한 규칙을 부여해 패턴을 만드는 거예요. 독자 눈에는 일반 텍스트와 전혀 구별되지 않지만, 전용 감지 키를 사용하면 AI 생성 여부를 확인할 수 있어요. 앤트로픽은 워터마크가 클로드의 응답 품질에 어떠한 영향도 주지 않는다고 강조하며, 이 기술을 8월 2일부터 실제 서비스에 적용했어요.

이번 발표 이후 일부 이용자들의 반발이 나왔어요. 비즈니스 인사이더는 구독을 취소하는 이용자가 생겨났다고 보도했는데, 직장이나 학교에서 AI 글쓰기 보조 도구를 활용해 온 이용자들이 외부에 노출될 수 있다는 점이 주된 이유예요. 앤트로픽은 가벼운 편집만으로는 워터마크가 제거되지 않지만, 모든 단어를 교체하는 수준의 전면 재작성을 거치면 사라질 수 있다고 설명했어요. 그 경우엔 해당 텍스트가 과연 AI가 생성한 것으로 볼 수 있는지 자체가 애매해진다는 논리예요. 코드의 경우 기능에 영향을 주지 않는 변수명이나 주석에만 워터마크를 삽입할 수 있어 일반 텍스트보다 탐지 강도가 훨씬 낮아요. 앤트로픽은 향후 워터마크 감지 API도 공개할 예정이며, 다른 주요 AI 기업들도 같은 투명성 코드를 채택해 각자의 워터마킹 시스템을 배포할 계획이에요. AI 보조 글쓰기를 활용하는 크리에이터라면 이 정책이 자신의 작업에 어떤 영향을 줄지 살펴볼 필요가 있어요.

원문: TechCrunch