Anthropic이 Claude의 텍스트 및 이미지 출력에 보이지 않는 워터마크를 출시하기 시작한 지 며칠 후, 이 기능은 정확히 비평가들이 예측한 것과 같은 종류의 마찰적 워터마크를 생성하고 있습니다. 사용자는 마크가 직장이나 수업에서 AI를 사용하는 데 노출될 것이라고 걱정했고, 개발자는 워터마크가 실제 코딩 작업 흐름 내에서 어떻게 작동하는지 문서화했으며, 이를 제거할 것을 약속하는 작지만 눈에 띄는 도구 시장이 되었습니다.
Anthropic은 이러한 변화로 인해 Claude가 2026년 8월 2일 이후 새로운 모델에 대해 투명성 규칙이 시행된 유럽 연합의 AI 법을 준수하게 되었다고 말했습니다. 이 법의 50조는 AI 시스템 제공업체가 기계 생성 출력을 "인위적으로 생성된 것으로 감지 가능"하게 만들도록 요구합니다. Anthropic은 EU뿐만 아니라 전 세계적으로 제공되는 모든 새로운 모델이 AI 생성 콘텐츠를 "처음부터"로 표시하고 이전에 출시된 모델을 업데이트하기 위한 유예 기간을 2026년 12월까지 확인할 것이라고 확인했습니다. 이 이야기에 대한 자세한 내용은 AI 뉴스를 참조하세요.
마크 자체는 보이지 않습니다. Anthropic 지원 기사에 따르면 텍스트 출력에는 "워터마크가 내장되어 있습니다." 생성된 파일에는 형식이 지원하는 디지털 서명된 출처 메타데이터가 포함되어 있습니다. 이전 Claude 모델은 텍스트도 표시하도록 업데이트될 예정입니다. 즉, 전체 차량이 결국 출력에 스탬프를 찍게 됩니다.
워터마크는 생성된 텍스트뿐만 아니라 편집된 텍스트에도 적용됩니다.
기술적 호기심을 반발로 바꾼 세부 사항은 8월 13일 Ars Technica에서 공개되었습니다. 워터마크는 Claude가 처음부터 생성하는 콘텐츠뿐만 아니라 프로세스하는 콘텐츠에 적용됩니다. Ars는 이 접근 방식을 "궤도에서 핵을 제거"하는 것으로 특징지었습니다. 왜냐하면 Anthropic은 AI 시스템이 "표준 편집을 위한 보조 기능"을 수행하는 경우(규정의 예는 문법 교정) 또는 사용자의 텍스트를 "실질적으로 변경"하지 않는 경우 EU 자체 지침에서 이를 요구하지 않더라도 지원되는 모든 처리된 콘텐츠를 표시하기 때문입니다.
모델 수준에 적용된 워터마크는 쉼표 수정과 도매 생성을 구분할 수 없기 때문에 이러한 구별이 중요합니다. Ars Technica의 Ashley Belanger는 Claude가 법에 따라 그대로 두기 위해 약간 손을 댄 인간의 글과 똑같은 도장을 찍게 될 수도 있다고 지적했습니다. 실제로 이 마크는 Claude가 처리한 모든 항목을 표시합니다. 사람이 작성하고 Claude에게만 다듬어달라고 요청한 문서도 마찬가지입니다.
사용자는 직장과 학교에서 잡힐까 봐 두려워합니다.
이용자 반응은 빨랐다. TechCrunch는 8월 13일에 일부 Claude 사용자가 "Anthropic의 새로운 워터마크가 직장이나 수업에서 이를 사용하는 것을 포착할 것이라는 사실에 화가 났다"고 보고했습니다. 조용히 Claude에게 의지하여 이메일, 보고서 또는 슬라이드 데크 초안을 작성하는 직원과 이를 과제에 사용하는 학생은 이제 상사나 강사가 탐지 도구를 사용하여 AI 개입을 확인할 수 있는 가능성에 직면하게 되었습니다.
Ars Technica는 이러한 역동성을 "주홍글씨"로 구성했습니다. 이는 독자는 볼 수 없지만 기관에서는 곧 볼 수 있는 AI 사용의 보이지 않는 배지입니다. 워터마크는 복사-붙여넣기 및 형식 변경을 통해 텍스트와 함께 이동하기 때문에 "조금 편집했을 뿐이에요"라는 일반적인 방어는 더 이상 AI의 지문을 남기지 않습니다.
제거 시장은 이미 부상하고 있습니다
워터마크가 있는 곳에는 제거 산업이 뒤따릅니다. SC미디어는 클로드 업데이트 이후 며칠 만에 이미 AI 워터마크 제거 도구 시장이 등장하고 있다고 보도했다. Decrypt는 빌더가 마킹 체계를 깨기 위해 적극적으로 노력하고 있으며, 패러프레이징, 번역 및 재형식화 시 마킹 체계가 어떻게 작동하는지 조사하고 있음을 문서화했습니다.
초기 테스트에서는 워터마크가 일상적인 취급에 대해서는 견고하지만 전문적인 조건에서는 누출되는 것으로 나타났습니다. New Stack의 보도에서는 이 마크가 "복사-붙여넣기에서는 살아남지만 실제 개발 워크플로에서는 살아남지 못한다"고 결론지었습니다. 이는 AI가 제안한 코드를 일반 엔지니어링의 일부로 실질적으로 재작업하는 소프트웨어 개발자가 의도하지 않은 채 마크를 지워버릴 수 있다는 의미입니다.
마크가 실제로 작동하는 방식
declaude.org에 게시되어 널리 공유되는 시각적 설명자는 메커니즘을 분석합니다. 텍스트에는 데이터를 숨길 수 있는 픽셀이 없으며 복사하여 붙여넣어도 유지되는 메타데이터가 없으므로 워터마크는 "단어 사이의 선택"에 존재합니다. 모델이 글을 쓰면서 똑같이 그럴듯한 다음 단어 몇 개 중에서 반복적으로 선택합니다. 비밀 암호화 키는 키 보유자만이 감지할 수 있는 패턴을 선택하도록 조용히 편향됩니다.
이 기술은 Kirchenbauer et al.의 연구에서 유래되었습니다. 2023년부터 후보 단어를 "녹색"과 "빨간색" 목록으로 나누고 세대를 녹색 토큰으로 기울였습니다. Google의 SynthID는 더 미묘한 경로를 통해 유사한 대상에 도달하며 Google은 2024년부터 Gemini 앱과 웹 환경의 텍스트에 워터마크를 표시했습니다. 해당 API는 문서화된 예외였습니다. 2026년 8월부터 새로운 Claude 모델은 모델 수준에서 텍스트를 표시하며 이전 모델도 뒤따를 예정입니다.
회의론자들은 제거가 사소한 일이라고 말합니다.
군비 경쟁이 인류에게 유리하다고 모든 사람이 확신하는 것은 아닙니다. 널리 유포된 에세이에서 엔지니어 Sean Goedecke는 텍스트가 극도로 압축된 매체이기 때문에 텍스트 워터마크는 "항상 제거하기가 쉽지 않습니다"라고 주장했습니다. 결정된 제거에도 살아남을 만큼 강한 변화는 인간 독자가 알아차릴 수 있는 변화입니다. 의역 도구, 왕복 번역, 고의적인 단어 변경 등은 모두 의미를 훼손하지 않고 통계 패턴을 제거할 위험이 있습니다.
토론은 개발자 커뮤니티에서 진행되고 있습니다. 이번 주 Hacker News에서 가장 많이 논의된 기사 중 두 개의 별도 워터마킹 설명자가 선정되어 수백 개의 참여 지점을 이끌어냈습니다.
다음에 무슨 일이 일어날까요?
Anthropic은 결국 마크를 감지하는 방법(EU 규정에서 요구하는 기술 지원)에 대한 세부 정보를 공유할 것이라고 말했습니다. 그러나 공개 감지 도구가 배송될 때까지 외부 당사자는 마킹이 실제로 얼마나 철저한지 확인할 수 없습니다. 회사는 또한 워터마크를 지원하지 않는 "일부 플랫폼이나 기능"에서는 워터마크가 작동하지 않을 것임을 인정했습니다.
구형 모델은 2026년 12월 규정 준수 기한을 앞두고 있고 경쟁 연구소에서는 사용자가 투명성을 위해 Anthropic을 처벌하는지 여부를 지켜보고 있는 가운데, 앞으로 몇 달 동안 업계가 수년 동안 회피해 왔던 제안을 테스트하게 될 것입니다. 즉, AI 제공업체가 결과를 의존하는 사람들에게 해를 끼치지 않고 추적 가능하게 만들 수 있는지 여부입니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →