Claude가 이제 출력물에 워터마크를 새깁니다. 여러분의 코드는 거의 영향받지 않습니다.

Anthropic이 Claude의 출력물에 워터마크를 넣습니다. 실제로 무엇이 표시되는지, 생성된 코드가 왜 대부분 벗어나는지, 누가 탐지할 수 있는지, SEO가 왜 그대로인지 정리했습니다.

Anthropic이 Claude의 AI 생성 콘텐츠 표시 방식을 설명하는 지원 문서를 공개했고, 하루도 지나지 않아 해석은 한 문장으로 굳어졌습니다. Claude가 이제 여러분을 밀고하며, 에이전트로 손댄 저장소는 전부 리스크가 되었다는 것입니다.

이 해석은 사람들이 가장 신경 쓰는 지점에서 틀렸습니다. 표시는 실제로 존재하고, 전 세계에 적용되며, 선택 사항이 아닙니다. 그리고 그 대상은 산문이며, 산문은 코드가 결코 아닌 바로 그것입니다. 아래에서 실제로 출시된 내용, 그 메커니즘이 평범한 말로 어떻게 작동하는지, 생성된 코드가 왜 최악의 운반체인지, 그리고 SEO 패닉에 왜 아무런 근거가 없는지를 정리합니다.

Anthropic이 실제로 내놓은 것

Anthropic은 EU AI Act의 Code of Practice on Transparency of AI-Generated Content에 서명했습니다. 이번 표시는 그 약속의 기술적 이행이며, 두 가지 서로 다른 형태를 취합니다.

텍스트에는 통계적 워터마크가 들어갑니다. 생성된 텍스트 자체에 짜 넣은, 감지할 수 없는 표식입니다. Anthropic의 표현을 그대로 옮기면 “감지할 수 없는 워터마크를 텍스트 자체에 직접 짜 넣습니다. 눈에 보이지 않으며, Claude 응답의 의미나 품질, 가독성을 바꾸지 않습니다”라고 합니다. 이 표식은 복사와 붙여넣기를 거쳐도 남고, “일부 편집을 거쳐도 유지될 수 있습니다”.

파일에는 서명된 출처 메타데이터가 붙습니다. Claude가 지원되는 파일 형식을 생성할 때, 현재는 .svg, .png, .jpg이며, C2PA 개방형 표준을 따르는 메타데이터를 함께 붙입니다. Adobe, Microsoft, BBC가 뒷받침하는 바로 그 Content Credentials 체계입니다.

적용 범위는 넓고, 정확히 짚어둘 가치가 있습니다. 많은 논평이 이것을 EU 한정 또는 Claude.ai 한정 조치로 넘겨짚었기 때문입니다:

모델2026년 8월 2일 이후 출시된 모든 모델, 출시 시점부터 표시
적용 채널API, Claude web, Claude Code, Cowork, Tag
클라우드 파트너AWS, Google Cloud, Microsoft Foundry
지역전 세계, EU에 국한되지 않음

워터마크는 숨겨진 문자가 아닙니다

이것이 가장 큰 오해이고, 지금 돌아다니는 조언의 절반이 쓸모없는 이유입니다.

사람들은 이 표식이 텍스트에 삽입된 무언가라고 가정합니다. 폭이 없는 공백, 흔치 않은 유니코드 변형, 특징적인 구두점 패턴 같은 것 말입니다. 그 가정은 곧장 “클리너에 한 번 돌리면 끝”이라는 결론으로 이어집니다. 통하지 않습니다. 지울 만한 삽입물 자체가 없기 때문입니다.

표식은 어떤 단어가 선택되었는가 그 자체입니다.

Claude의 보이지 않는 텍스트 워터마크가 토큰 선택을 편향시켜 작동하는 방식을 설명하는 다이어그램: 생성 단계마다 비밀 키가 후보 토큰을 선호 그룹과 나머지로 나누고, 여러 후보가 사실상 동등할 때 모델이 선호 그룹의 토큰을 내보내며, 수백 개의 토큰에 걸쳐 누적된 불균형이 탐지 가능한 통계적 신호가 된다.

Anthropic은 알고리즘을 공개하지 않았고, 이것은 뒤에서 다시 다룰 의도적인 선택입니다. 하지만 그들이 설명하는 모든 특성(보이지 않고, 텍스트 내부에 있으며, 복사와 붙여넣기를 견디고, 읽어내려면 충분한 분량이 필요하다)은 이미 공개된 샘플링 편향 워터마크 계열과 일치합니다. Google의 SynthID-Text와 그에 앞선 학술 연구가 취한 접근법입니다.

발상은 들리는 것보다 단순합니다. 모델은 글을 쓸 때마다 후보 집합에서 다음 토큰을 고릅니다. 여러 후보가 사실상 동등한 경우가 아주 많습니다. 빠른, 신속한, 재빠른, 날랜 모두 통합니다. 비밀 키가 어휘를 선호 그룹과 나머지로 나누고, 샘플러는 그렇게 기울여도 의미나 품질에서 잃을 것이 없을 때마다 선호 그룹 쪽으로 기웁니다.

그런 선택 하나로는 아무것도 알 수 없습니다. 우연만으로도 토큰의 절반가량은 선호 그룹에 들어갑니다. 하지만 수백 개의 토큰에 걸치면 그 불균형은 측정 가능한 크기로 자라고, 키를 가진 탐지기는 그 텍스트가 우연이 만들어낼 결과에서 얼마나 떨어져 있는지 계산할 수 있습니다. 그 격차가 신호의 전부입니다.

여기서 두 가지 귀결이 곧바로 따라 나오고, 둘 다 메커니즘 자체보다 중요합니다:

  • 길이는 타협 불가능한 조건입니다. 트윗 하나나 커밋 메시지에는 쓸 만한 신호가 없습니다. 탐지기에는 분량이 필요합니다.
  • 단어를 바꾸는 것만이 워터마크를 지웁니다. 그것이 영리한 제거법이어서가 아니라, 단어가 표식이기 때문입니다.

생성된 코드가 최악의 운반체인 이유

패닉이 건너뛴 지점이 여기입니다. 샘플링 워터마크는 선택의 자유에 매기는 세금이고, 세금은 선택이 존재하는 곳에서만 걷을 수 있습니다. 산문에는 그것이 넘칩니다. 코드는 파산 직전입니다.

Claude의 텍스트 워터마크가 산문에서는 살아남지만 코드에서는 살아남지 못하는 이유를 나란히 비교한 도표: 산문은 문단마다 사실상 동등한 단어 선택지를 수십 개 제공해 각각이 워터마크의 일부를 실어 나를 수 있는 반면, 코드의 토큰은 문법과 이미 존재하는 식별자, 함수 시그니처에 의해 강제되고, prettier, eslint, gofmt, black, rustfmt 같은 포매터가 남아 있는 자유로운 선택마저 정규화해 버린다.

지극히 평범한 한 줄을 봅시다: const user = await getUserById(id).

const는 파일 자체의 컨벤션이 정합니다. getUserById는 선택이랄 것이 전혀 없습니다. 이미 코드베이스에 존재하는 이름이고, 비슷한 대체어를 쓰면 그냥 버그입니다. await는 함수의 시그니처가 강제합니다. 괄호와 인자는 문법이 강제합니다. 진짜로 자유로운 것은 무엇일까요? 지역 변수의 이름, 그리고 주석의 표현입니다. 그것이 채널의 전부입니다.

이제 산문 한 문단과 비교해 보십시오. 거의 모든 내용어에 서로 바꿔 쓸 수 있는 대안이 서넛씩 있습니다. 이 차이는 미미하지 않습니다. 문단당 수십 개의 운반 슬롯이냐, 파일당 몇 개냐의 차이입니다.

그리고 파이프라인이 돌아갑니다.

포매터가 구체적인 문제입니다. prettier, eslint --fix, gofmt, black, rustfmt는 전부, 샘플링 워터마크가 운반체로 삼는 바로 그 사실상 동등한 표면적 선택을 정규화하려고 존재합니다. 생성된 코드에 포매터를 돌리는 것은 기능적으로 워터마크에 세탁 공정을 한 번 돌리는 일입니다. 누구도 그럴 의도가 없었는데도 말입니다. 여기에 리뷰 수정, 이름 변경, 리팩터링, 그리고 같은 파일 안에서 생성된 코드와 사람이 쓴 코드가 뒤섞이는 상황까지 더하면, 잔여 신호는 어차피 측정하기에는 한참 짧은 diff들에 흩어집니다.

정직한 단서, 이것은 확인된 예외가 아니라 메커니즘에서 끌어낸 논증이기 때문입니다. Anthropic은 코드가 제외된다고 말한 적이 없고, 알고리즘을 공개하지 않았으며, 탐지기를 내놓지도 않았습니다. Anthropic 바깥의 누구도 커밋된 .ts 파일에 실제로 무엇이 남아 있는지 측정할 수 없습니다. 잔여 노출이 가장 큰 시나리오는 길게 생성된 파일을 손대지 않고, 포맷하지 않고, 한 번도 리뷰하지 않은 채 커밋하는 경우입니다. 그것이 여러분의 워크플로를 설명한다면, 워터마크는 그 워크플로가 만드는 문제 중 가장 사소한 축이고, 에이전트가 쓴 코드의 리뷰에 대한 우리 입장이 이 문제보다 훨씬 먼저 적용됩니다.

무엇이 지우고, 누가 실제로 탐지할 수 있는가

Anthropic은 한계에 대해 이례적으로 솔직하고, 그 점은 인정할 만합니다. 표식이 탐지되었다는 것은 해당 콘텐츠가 Claude를 거쳤을 수도 있다는 뜻입니다. 결정적 증거가 아니라고 명시적으로 밝히고 있습니다. 그리고 표식이 없다는 사실은 그야말로 아무것도 증명하지 못합니다.

Claude의 워터마크를 무엇이 지우고 누가 탐지할 수 있는지 보여주는 도표: 텍스트 워터마크는 복사와 붙여넣기, 가벼운 수정, 문단 재배치를 견디지만 대폭 재작성, 패러프레이즈, 번역, 스크린샷, 코드 포매터에 의해 지워진다. 텍스트 워터마크는 Anthropic의 비밀 키가 있어야 하므로 제3자는 아직 검증할 수 없는 반면, 생성된 png, jpg, svg 파일에 붙는 C2PA 서명 메타데이터는 공개 키를 쓰기 때문에 오늘 당장 누구나 검증할 수 있지만 이미지를 다시 인코딩하면 제거된다.

탐지 문제는 깔끔하게 둘로 갈라지고, 이 두 갈래를 뒤섞은 것이 잘못된 분석 대부분을 만들어냈습니다.

파일은 지금 당장 누구나 검증할 수 있습니다. C2PA는 평범한 암호학적 서명입니다. 개인 키가 서명하고, 공개 키가 검증합니다. 누구든 생성된 .png를 Content Credentials 뷰어에서 확인할 수 있고, Google은 그 검증을 Search, Lens, Chrome에 넣고 있습니다. 여기에 Anthropic만의 특권은 없으며, 서명은 파일이 생성 이후 변조되었는지까지 함께 드러내 일석이조 역할을 합니다.

텍스트는 그렇지 않고, 오늘은 Anthropic만 읽을 수 있습니다. 탐지에는 샘플링을 편향시킨 비밀 키가 필요합니다. 키가 없으면 그 텍스트는 표시되지 않은 텍스트와 통계적으로 구별할 수 없습니다. 이것이 현재 상태이고, “Claude만이 당신을 잡을 수 있다”는 반응이 나온 출처입니다.

하지만 이것이 목표로 하는 최종 상태는 아닙니다. Anthropic이 서명한 Code of Practice는 제3자 탐지 수단을 제공하도록 그들을 의무화하며, 지원 문서에도 사용자와 제3자가 표식을 탐지할 수 있게 하는 작업을 진행 중이고 문서가 뒤따를 것이라고 적혀 있습니다.

아직 나오지 않은 이유는 일을 미루는 것이 아니라 진짜 딜레마입니다. 탐지기를 공개하는 것은 표식을 제거하는 지도를 함께 공개하는 일입니다. 어떤 글에 점수를 매겨주는 신탁을 손에 쥐여주면, 점수가 임계값 아래로 떨어질 때까지 반복해서 고쳐 쓸 수 있습니다. Google도 SynthID-Text에서 같은 딜레마를 마주했고, 주변 모델 없이는 무기로 돌려쓰기 어려운 형태의 탐지기를 내놓았습니다. Anthropic의 가장 유력한 결말은 원클릭 공개 검사기가 아니라, 검증된 접근 권한과 할당량을 둔 접근 제한형 탐지 API입니다.

거의 아무도 짚지 않은 디테일

표식은 모델이 생산한 텍스트에 적용됩니다. Claude가 지어낸 텍스트와 Claude가 손만 댄 텍스트를 구분하지 않습니다.

여러분이 직접 쓴 문단의 문법을 고쳐달라고 Claude에게 시키면, 그 출력물은 워터마크를 지닙니다. 문단을 조여달라고 하거나, 한 문장을 번역해달라고 하거나, 여러분의 메모를 정리해달라고 해도 마찬가지입니다.

이것은 양쪽으로 작용하며, 스캔들이라는 프레이밍이 암시하는 것보다 흥미롭습니다. 사람들이 두려워하는 고발 시나리오를 약화시킵니다. 탐지에 걸렸다는 사실만으로는 “AI가 이것을 썼다”와 “사람이 썼고 AI가 다듬었다”를 갈라낼 수 없고, 이 둘은 전혀 같은 주장이 아니기 때문입니다. 동시에 탐지를 저작 증명으로 다루려는 사람은 모래 위에 짓고 있다는 뜻이기도 합니다. Anthropic도 탐지를 “Claude가 처리했을 수 있음”이라고 표현하며 사실상 이를 인정합니다.

SEO에 달라지는 것: 없습니다

우리는 이 사이트의 SEO를 공개적으로 운영하고 있으니, 가장 시끄러웠던 지점부터 분명히 하겠습니다. 여기에 순위 리스크는 없습니다. 이유는 세 겹으로 쌓입니다.

Google은 AI가 쓴 콘텐츠를 그 자체로 제재하지 않습니다. 정책은 그대로입니다. 제재 대상은 scaled content abuse, 즉 가치 없이 대량 생산된 페이지입니다. 판단은 품질과 유용성에 대한 것이지 단어의 출처에 대한 것이 아닙니다. 진짜로 좋은 글은 여전히 진짜로 좋은 글입니다.

Google은 애초에 이 워터마크를 읽을 수 없습니다. Anthropic이 쥔 키로 잠겨 있기 때문입니다. Google이 이것을 순위 신호로 쓰고 싶다 해도, 신호를 얻으려면 Anthropic과의 협약이 필요합니다. 그런 발표는 없었고, AI가 쓴 텍스트를 겨냥한 신호 역시 I/O 2026에서 발표되지 않았습니다.

실제로 출시된 것은 미디어 출처 표시이고, 그것은 순위 요소가 아니라 라벨입니다. Google의 2026년 작업은 SynthID와 C2PA를 통해 이미지, 동영상, 오디오를 다루며, 사용자가 Search, Lens, Circle to Search에서 어떤 이미지가 AI로 생성되었는지 물어볼 수 있도록 노출됩니다. 독자를 위한 투명성이지 순위를 움직이는 지렛대가 아닙니다.

실질적이고 현실적인 결과가 하나 있는데, 텍스트가 아니라 이미지 쪽입니다. Claude로 생성한 비주얼을 게시한다면 이제 그 파일에는 Content Credentials가 실려 있고, Chrome과 Search는 점점 더 그것에 라벨을 붙일 수 있게 됩니다. 효과는 순위 강등이 아니라 CTR과 신뢰입니다. AI 생성으로 표시된 대표 이미지는 사진과 같은 방식으로 읽히지 않습니다.

누군가 대응을 과잉 설계하기 전에 알아둘 것: 대부분의 이미지 파이프라인은 시키지 않아도 이미 C2PA를 제거합니다. sharp, next/image, 빌드 시점 압축, 즉석에서 재인코딩하는 CDN까지 전부 메타데이터를 떨어뜨립니다. 일반적인 사이트에서는 브라우저가 보기 한참 전에 출처 정보가 사라져 있습니다. 이것은 양날의 결과입니다. 라벨링 문제를 우연히 해소해 주지만, 용도가 규제 대상이 되는 순간 출처 정보를 의도적으로 제거하는 행위 자체가 컴플라이언스 문제가 됩니다. 그리고 유럽연합에 서비스를 낸다면 그 질문은 AI 지원 작업의 GDPR 측면과 나란히 놓입니다.

실제로 해야 할 일

짧은 목록입니다. 담론이 시사하는 것보다 할 일이 적기 때문입니다.

  1. 코드에 대해서는 아무것도. 클리너도, 스트리퍼도, 워크플로 변경도 필요 없습니다. 제거할 것이 없고, 여러분이 추가할 수 있는 어떤 도구보다 이미 포매터가 더 많은 일을 하고 있습니다.
  2. 생성된 코드는 계속 리뷰하십시오, 이미 통하던 이유들 그대로. 워터마크는 그중 무엇도 바꾸지 않습니다.
  3. 이미지에 대해서는 의식적으로 결정하십시오. Claude로 생성한 비주얼을 게시한다면, 여러분의 파이프라인이 Content Credentials를 보존하는지 제거하는지 파악하고, 그것을 사고가 아니라 결정으로 만드십시오.
  4. 텍스트의 워터마크 제거를 쫓지 마십시오. 유일하게 확실한 제거법은 여러분이 직접 다시 쓰는 것이고, 직접 다시 쓰고 있다면 질문은 이미 스스로 답한 셈입니다.
  5. 대신 품질을 걱정하십시오. 실제로 순위를 깎아먹는 것은 scaled content abuse이고, 그것은 어떤 워터마크가 존재하기 훨씬 전부터 순위를 깎아먹고 있었습니다.

이 조치는 투명성 의무이고, 정직하게 문서화되었으며, 그 한계를 저자 스스로 조심스럽게 밝히고 있습니다. 반응이 시사하는 것보다 훨씬 작은 사건이고, 에이전트로 코드를 내보내는 사람에게는 사실상 비사건에 가깝습니다.

규모 있게 에이전트를 돌리고 있다면, 주목할 만한 운영상의 질문은 여전히 예전 그대로입니다. 에이전트가 무엇을 건드렸는지, 무엇이 리뷰되었는지, 무엇이 배포되었는지. 그 부분을 보이게 만들려고 AgentsRoom이 존재합니다.

AgentsRoom 다운로드

모든 프로젝트에서 AI 에이전트(Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code)를 하나의 창에서 실행하세요.

무료AgentsRoom 다운로드

컴패니언 앱: 이동 중에도 에이전트를 모니터링

Claude, Codex, Antigravity CLI 또는 다른 AI 공급자를 사용하세요.

확장 프로그램 설치
Chrome Web Store

버그와 요청을 공개 백로그로 바로 보내세요.

AgentsRoom의 실제 모습.

멀티 프로젝트
멀티 프로바이더
멀티 에이전트
실시간 상태
파일 diff & 커밋
모바일 앱
라이브 프리뷰
에이전트 팀
브라우저 자동화
백로그 기반 개발
프롬프트 라이브러리
스킬 라이브러리
모든 기능 보기

계속 읽기