앤트로픽이 챗봇 클로드의 워터마킹 방식에 대한 상세 설명을 담은 블로그 글을 공개했다. 클로드는 '날씨가 흐리다'를 표현할 때 'overcast'와 'grey' 중 하나를 고르는 것과 같은 저위험 선택에서 패턴을 만들어내며, 이는 독자에게는 감지되지 않지만 암호화 키를 가진 사람만 확인할 수 있다. 앤트로픽은 구글 딥마인드가 2024년 공개한 'SynthID-Text' 방식을 채택했으며 워터마크 탐지 API도 출시할 계획이라고 밝혔다. 가벼운 편집으로는 워터마크가 완전히 제거되지 않지만 전체 문장을 다시 쓰면 제거될 수 있으며, 코드의 경우 임의 선택 여지가 적어 워터마크 흔적이 상대적으로 적다.
- •클로드, 'overcast'·'grey' 같은 저위험 단어 선택에서 워터마크 패턴 생성
- •워터마크는 독자에게 감지되지 않으며 암호화 키 보유자만 확인 가능
- •구글 딜마인드의 'SynthID-Text' 방식 채택, 워터마크 탐지 API 출시 예정
- •가벼운 편집은 워터마크 유지, 전체 재작성 시에는 제거 가능
- •코드에는 임의 선택 여지가 적어 워터마크 영향 미미, 주석 등 일부 적용 가능
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Anthropic shares more details about how Claude’s new watermarks will work

- 1.앤트로픽, EU AI법 투명성코드 준수 위해 클로드에 워터마크 삽입... 구글딜마인드 SynthID-Text 방식 채택
- 2.저위험 단어선택 과정에서 독자는 못 알아채지만 키를 가진 자만 감지 가능한 패턴 삽입, 품질엔 영향 없어
- 3.가벼운 편집으론 제거 어려우나 전체 재작성시 제거 가능, 코드는 자연어보다 워터마크 흔적 적을 전망
- 4.다른 주요 모델 개발사들도 동일한 EU 실천규범(Code of Practice)에 서명해 자체 워터마크를 도입할 예정
왜 중요한가?
AI 생성 콘텐츠 판별에 대한 사용자 반발(구독 취소 사례 포함)에도 불구하고, EU 규제 준수를 위한 워터마킹이 업계 전반의 표준으로 자리잡을 가능성을 보여준다.
본문 미리보기
How will the watermarking actually work? Can it be hidden with editing? And how does this affect code?
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:47AI 초안

