Claude 텍스트 워터마크가 Turnitin 리포트에 나타날까요?
Anthropic은 Claude 텍스트 워터마크에 관한 문서를 두 개 공개하고 있고, 그 둘이면 사람들이 실제로 궁금해하는 것의 대부분에 답이 됩니다. 어떤 모델에 표시가 붙는지, 초안의 어디까지 붙을 수 있는지, 키를 쥔 쪽이 누구인지, 그리고 누군가 그것을 읽을 수만 있다면 감지된 표시가 무엇을 입증하는지입니다.
HumanPen 팀
· 16분
짧게 정리하면
초안에 표시가 붙는지는 어떤 Claude 모델이 그 글을 썼는지에 달려 있습니다. Anthropic의 AI 생성 콘텐츠에 표시를 남기는 방식에 관한 헬프센터 페이지에 따르면, 표시는 2026년 8월 2일 이후에 출시된 모델에 적용되고 현재 이름이 올라 있는 것은 Fable 5.1과 Mythos 5.1 두 개입니다.
제출물을 읽는 사람은 그 표시를 볼 수 없습니다. 그 두 모델을 발표한 페이지에서 Anthropic이 쓴 표현은 "this watermark is invisible to anyone who does not have the detection API" (이 워터마크는 감지 API를 가진 사람이 아니면 누구에게도 보이지 않습니다)이며, 그 API는 비공개 프리뷰 상태입니다.
그리고 제가 확인한 여섯 개의 탐지기 가운데, Turnitin을 포함해 어느 것도 워터마크를 읽을 수 있다고 말하지 않습니다. Anthropic은 그 이유를 워터마크 작동 방식을 다룬 뉴스 게시물에서 직접 밝힙니다. AI 탐지 소프트웨어와 무엇이 다르냐는 질문에 답하는 부분입니다: "AI detection software uses a different method, because the companies that provide it don't have our key." (AI 탐지 소프트웨어는 다른 방식을 씁니다. 그것을 제공하는 회사들이 우리의 키를 가지고 있지 않기 때문입니다.)
저는 워터마크가 들어간 텍스트를 만들지 않았고, 어떤 도구에도 돌려보지 않았습니다. 아래 내용은 모두 문서에 적혀 있는 것이며, 직접 확인하실 수 있도록 페이지와 수치를 함께 적었습니다.
지금 표시가 붙는 Claude 결과물은 무엇인가
아마 보셨을 날짜는 2026년 8월 2일입니다. 실제 있는 날짜이지만, 그날부터 Claude 출력물에 워터마크가 붙기 시작한 것은 아닙니다. 그날은 EU AI법의 표시 의무가 적용되기 시작한 날이고, Anthropic은 그것을 모델을 가르는 기준선으로 쓰고 있습니다.
Models. Claude models launched on or after August 2, 2026 support marking at launch. Models currently supported include Fable 5.1 and Mythos 5.1. (모델. 2026년 8월 2일 이후에 출시된 Claude 모델은 출시 시점부터 표시를 지원합니다. 현재 지원되는 모델에는 Fable 5.1과 Mythos 5.1이 포함됩니다.)
Fable 5.1과 Mythos 5.1은 2026년 9월 1일에 발표되었습니다. Anthropic 자체 뉴스 목록에 있는 카드의 날짜 기준입니다. 따라서 8월 대부분 동안 그 지원 목록에 올라 있는 출시 모델은 없었습니다. 더 오래된 모델로 쓴 글은 같은 단락의 다음 문장에 해당합니다:
We're working to add marking support to other Claude models released before that date, and we'll update this article as that becomes available. (그 날짜 이전에 출시된 다른 Claude 모델에도 표시 지원을 추가하는 작업을 하고 있으며, 가능해지는 대로 이 문서를 업데이트하겠습니다.)
현재진행형이고, 날짜는 없습니다. 뉴스 게시물도 같은 이야기를 하며 이유를 댑니다: "The EU law includes a transition period for Anthropic models launched before August 2, 2026, and we're working to add watermarking for those models as well." (EU 법에는 2026년 8월 2일 이전에 출시된 Anthropic 모델에 대한 전환 기간이 포함되어 있고, 그 모델들에도 워터마킹을 추가하는 작업을 하고 있습니다.)
표시가 적용되는 곳에서는 그 범위가 넓습니다. 헬프센터는 대상을 이렇게 적고 있습니다:
Marks will apply to output from supported Claude models across Claude Platform (API), Claude, Claude Code, Claude Cowork, and Claude Tag, and wherever Claude is offered, worldwide. (표시는 지원되는 Claude 모델의 출력물에 적용됩니다. 대상은 Claude Platform, API, Claude, Claude Code, Claude Cowork, Claude Tag이며, 전 세계에서 Claude가 제공되는 모든 곳이 포함됩니다.)
다음 문장도 읽어보세요. Anthropic 스스로 단 단서이면서, 그 페이지에서 가장 넘기기 쉬운 문장입니다: "Some platforms or features may not support certain marking types." (일부 플랫폼이나 기능은 특정 표시 유형을 지원하지 않을 수 있습니다.) 대형 클라우드를 통한 재판매도 포함됩니다: "When supported Claude models are accessed through AWS, Google Cloud, or Microsoft Foundry they will carry watermarks." (지원되는 Claude 모델을 AWS, Google Cloud, Microsoft Foundry를 통해 이용하는 경우에도 워터마크가 부여됩니다.)
그러니 오늘 밤 정리할 수 있는 질문은 하나로 좁혀집니다. 이 글을 어떤 모델이 만들었는가입니다. 어디를 보면 되는지는 지원 페이지 두 개가 알려줍니다. 모델 설정에 관한 페이지는 분명하게 적고 있습니다. "The selected model and effort level appear next to the send button" (선택한 모델과 노력 수준은 전송 버튼 옆에 표시됩니다)이라고요. 또 그것을 "at any point in a conversation" (대화 중 어느 시점에서든) 바꿀 수 있고, 변경 사항은 "starting with Claude's next response" (Claude의 다음 응답부터) 적용된다고 덧붙입니다. 따라서 하나의 대화가 두 모델에 걸칠 수도 있습니다.
요청하지 않아도 Claude가 모델을 바꾸는 경우도 있습니다. 대체에 관한 지원 페이지에 따르면, 차단된 요청은 같은 대화 안에서 Opus 모델로 다시 실행되며 "the response will be labeled with the model that answered" (응답에는 실제로 답한 모델이 표시됩니다)라고 합니다. 이런 전환을 일으키는 범주는 좁습니다. 공격적 사이버 보안과 이중 용도 생물학의 상당 부분이 여기에 해당하는데, 에세이가 걸릴 일은 거의 없습니다. 바이러스학이나 독성학을 다루고 있다면 그 표시를 찾아 되짚어볼 만합니다. Anthropic 뉴스 목록에서 Opus 5의 날짜는 2026년 7월 24일로 기준일 이전이므로, 지원 목록에는 없습니다.
초안의 어디까지 붙을 수 있는가
다음 부분은 많은 초안에서 답을 바꿔놓습니다. 그리고 헬프센터가 아니라 뉴스 게시물에 들어 있습니다.
The watermark only applies to words Claude chooses. When Claude proofreads text written by a person, what it gives back has generally only been lightly edited; because nearly all the words are the person's, there's very little (if anything) for the watermark to attach to. (워터마크는 Claude가 선택한 단어에만 적용됩니다. 사람이 쓴 글을 Claude가 교정하면, 돌려받는 결과는 대체로 가볍게 편집된 정도입니다. 단어의 거의 전부가 그 사람의 것이므로, 워터마크가 붙을 자리는 있다 해도 매우 적습니다.)
그다음 두 문장이 규모를 알려줍니다. "Depending on the length of the text and how heavily Claude has edited it, those changes might not be enough to make Claude's involvement detectable." (텍스트의 길이와 Claude가 얼마나 많이 편집했는지에 따라, 그 변경만으로는 Claude가 관여했다는 사실을 감지할 수 없을 수도 있습니다.) 그리고 이렇게 이어집니다: "The more Claude writes, the more decisions it has to make, and the more space there is for a watermark." (Claude가 쓰는 분량이 많을수록 내려야 하는 결정도 많아지고, 워터마크가 들어갈 자리도 넓어집니다.)
번역은 정반대입니다:
Yes. A translation produced by Claude carries a watermark, because in this case every word is chosen by Claude. (예. Claude가 만든 번역에는 워터마크가 붙습니다. 이 경우에는 모든 단어를 Claude가 선택하기 때문입니다.)
모국어로 초안을 쓰고 Claude에게 영어로 옮기게 했다면, 페이지에 있는 영어 단어 하나하나를 Claude가 고른 것입니다. 신호가 가장 적은 경우가 아니라 가장 많은 경우입니다.
헬프센터의 문장 하나는 천천히 읽을 만합니다. 서로 다른 동사를 두 개 쓰고 있기 때문입니다:
Because the watermark is part of the text, it will travel with the text when it's copied and pasted elsewhere, and may persist through some editing. (워터마크는 텍스트의 일부이므로, 텍스트를 다른 곳에 복사해 붙여넣으면 함께 따라가고, 어느 정도 편집을 거쳐도 남아 있을 수 있습니다.)
"Will travel" (함께 따라간다는 뜻입니다)는 복사와 붙여넣기에 관한 표현이고, "May persist through some editing" (어느 정도 편집을 거쳐도 남을 수 있다는 뜻입니다)는 편집에 관한 표현입니다. 둘은 같은 강도가 아니며, 요약이 가장 먼저 잃어버리는 것이 바로 그 차이입니다. 짧은 구절은 같은 페이지의 다른 곳에 별도 항목으로 나옵니다. 표시가 아예 감지되지 않을 수 있는 경우입니다: "The passage is very short, leaving too little text for a reliable signal" (그 구절은 매우 짧아서 신뢰할 만한 신호를 얻기에 텍스트가 너무 적습니다)
누가 읽을 수 있는가
이 모든 것이 얼마나 중요한지는 누가 확인할 수 있는지에 달려 있습니다. 접근에 관한 전문을 그 뉴스 게시물에서 그대로 옮깁니다. 문장을 받쳐주는 것이 바로 그 안의 단서들이기 때문입니다:
We are releasing a detection API in private preview. It is currently available to eligible organizations as required under EU law (such as regulators, law enforcement, media, fact-checkers, independent researchers, educational organizations, and EU civil society groups). It is also available for enterprises who are similarly obligated to verify watermarking for their own compliance with the Act. We plan to expand access to the detection API over time. (감지 API를 비공개 프리뷰로 공개하고 있습니다. 현재는 EU 법에서 요구하는 대상인 자격 있는 조직에 제공됩니다. 규제 기관, 법 집행 기관, 언론, 팩트체커, 독립 연구자, 교육 기관, EU 시민사회 단체 등이 여기에 해당합니다. 법 준수를 위해 워터마킹을 확인해야 하는 비슷한 의무가 있는 기업에도 제공됩니다. 감지 API 접근은 시간을 두고 확대할 계획입니다.)
"Educational organizations" (교육 기관)는 그 목록에 들어 있고, 사람들이 눈을 고정하는 표현도 바로 이것입니다. 주변에는 단서가 세 개 붙어 있습니다. 비공개 프리뷰라는 점, 개인이 아니라 조직이라는 점, 그리고 "as required under EU law" (EU 법에서 요구하는 경우에 한정된다는 뜻)입니다. Anthropic은 접근 권한을 받은 주체의 목록을 공개하지 않습니다. 다음 절의 여섯 탐지 업체 가운데 어느 쪽도 이 문제에 대해 어느 방향으로든 언급하지 않습니다. 대신 헬프센터 페이지에서 그 문장을 찾아보셔도 글자 그대로는 나오지 않습니다. 헬프센터는 자체 버전을 싣고 있고, 그것은 "Watermark detection is in private preview." (워터마크 감지는 비공개 프리뷰 단계입니다.)로 시작합니다.
Fable과 Mythos 발표 페이지에는 더 직설적인 표현이 있습니다: "this watermark is invisible to anyone who does not have the detection API." (이 워터마크는 감지 API를 가진 사람이 아니면 누구에게도 보이지 않습니다.)
소비자용 제품에 텍스트 워터마크를 넣은 다른 제공자는 Google입니다. 자체 SynthID 페이지에 이렇게 나옵니다: "We've expanded SynthID to watermarking and identifying text generated by the Gemini app and web experience" (Gemini 앱과 웹 환경에서 생성된 텍스트에 워터마크를 넣고 그것을 식별하는 데까지 SynthID를 확장했습니다). 공개 확인 도구는 텍스트 도구가 아닙니다. 같은 DeepMind 페이지는 확인 포털을 소개한 뒤 무엇을 넣을 수 있는지 적습니다: "Just upload an image, video or audio file." (이미지, 동영상, 오디오 파일을 올리기만 하면 됩니다.) 같은 블록은 포털이 아직 시험 단계라고 덧붙입니다. "We are currently collaborating with journalists and media professionals to test the portal and collect their feedback" (포털을 시험하고 의견을 모으기 위해 현재 언론인과 미디어 종사자들과 협력하고 있다는 내용입니다) 그 문장이 "Join the early tester waitlist" (초기 테스터 대기 명단에 등록하기) 버튼 위에 있습니다.
탐지기를 만드는 Pangram은 2026년 9월 14일에 상황을 정리한 글을 올렸습니다: "As of September 14th, 2026, no AI company has released an AI watermark detector for text publicly, although Gemini has a public image detector." (2026년 9월 14일 기준, 어떤 AI 기업도 텍스트용 AI 워터마크 탐지기를 공개하지 않았습니다. 다만 Gemini에는 공개된 이미지 탐지기가 있습니다.)
학생을 상대로 하는 여섯 탐지기가 워터마크에 대해 하는 말
아무도 워터마크를 읽지 않는다고 단정하는 대신, 제가 세어봤습니다. 여기 있는 모든 것은 2026년 9월 15일에 읽은 것이고, 모든 수치는 하나의 규칙을 따릅니다. 규칙이 없는 수치는 다시 재현할 수 없기 때문입니다.
규칙은 이렇습니다. 페이지 본문을 가져와 `script`, `style`, `noscript`를 제거하고 `textContent`를 읽습니다. 그전에 접혀 있는 패널을 모두 클릭해 펼칩니다. `innerText`가 아니라 `textContent`를 쓰는 이유는, `innerText`가 접힌 부분을 건너뛰기 때문입니다. Turnitin FAQ 하나만 봐도 그 차이가 31,739자와 40,991자입니다. 그다음 각 패널 안에서 확인용 문자열을 하나씩 뽑아, 그것이 읽은 내용에 들어 있는지 확인했습니다.
용어 수는 대소문자를 구분하지 않는 부분 문자열 일치로 셉니다. 다만 예외가 세 개 있어 그것을 적어두지 않으면 대조 수치를 재현할 수 없습니다. `the`는 대소문자를 구분하지 않고 세는 단어 전체 일치입니다. Turnitin FAQ에서 263이 나오는 곳이 여기이고, 대소문자를 구분해 세면 243이 됩니다. `AI`는 대소문자를 구분해 세는 단어 전체 일치입니다. `originality.ai`가 Originality 자체 페이지 곳곳에 등장해서, 대소문자를 구분하지 않고 세면 그 111이 160으로 바뀝니다. `key`는 단어 전체 일치이며 어느 쪽으로 세도 0이 나옵니다. 사이트맵 수는 중복을 제거한 뒤의 고유 URL이고, 모든 사이트맵 색인을 펼친 기준입니다.
| 업체 | 검색한 대상 | 결과 | 같은 도구로 잰 대조값 |
|---|---|---|---|
| Turnitin | guides.turnitin.com의 헬프센터 검색창 | `watermark`: 결과가 없고, 페이지에는 "Try searching another keyword." (다른 검색어로 검색해 보세요)라고 나옵니다. `SynthID`와 `provenance`: 각각 1건. 둘 다 관련 없는 페이지에서의 어간 일치로, Moodle 플러그인 가이드의 "synched"와 제출 문제 해결 페이지의 "proven"입니다 | `ai writing`: 152건. `Claude`: 3건 |
| Turnitin | 제가 센 FAQ 페이지, 패널 네 개를 모두 펼쳤을 때 40,991자, 페이지 시각 2026-08-28 | `watermark` 0건, `synthid` 0건, `provenance` 0건, `key` 0건 | `detect` 142건, `the` 263건, `Claude` 14건 |
| Turnitin | turnitin.com 사이트맵: `<loc>` 항목 2,473개, 고유 URL 1,801개 | 그 URL 가운데 "watermark"가 들어간 것은 정확히 하나이고, 알고 보니 그것은 한 기업이었습니다: "Watermark was launched in 2018 with a vision to empower better learning at institutions across the U.S. and beyond." (Watermark는 미국과 그 밖의 지역 교육기관에서 더 나은 학습을 가능하게 하겠다는 비전을 가지고 2018년에 출시되었습니다.) | 같은 파일, 같은 패턴 |
| Pangram | 2026년 9월 14일에 올린 글 | 질문에 바로 답합니다: "Pangram does not currently support AI watermarking detection." (Pangram은 현재 AI 워터마크 탐지를 지원하지 않습니다.) | 해당 없음. 수치가 아니라 진술입니다 |
| GPTZero | gptzero.me/technology 페이지, FAQ 패널 아홉 개를 모두 펼쳤을 때 13,040자 | `watermark` 0건, `synthid` 0건, `provenance` 0건 | `AI` 66, `detect` 53건 |
| Copyleaks | help.copyleaks.com의 헬프센터 검색 | `watermark`: Articles 패널에는 Articles에서 "watermark" 검색 결과가 없다고 나옵니다. `SynthID`: 같은 메시지에 자기 용어가 들어간 형태입니다 | `AI Detector`: Articles 패널에는 그 메시지 대신 결과가 채워집니다 |
| Originality.ai | 사이트맵, 고유 URL 1,386개, 그리고 검사기 페이지 (originality.ai로 리다이렉트, 17,155자) | 워터마크 슬러그 두 개, 둘 다 설명 글입니다. 검사기 페이지: `watermark` 0건, `synthid` 0건, `provenance` 0건 | 검사기 페이지: `AI` 111, `detect` 50건 |
| Winston AI | gowinston.ai 사이트맵 색인을 펼치면 하위 사이트맵이 세 개 나오고, 고유 URL은 932개입니다. 여기에 탐지 제품 페이지, 34,324자를 더했습니다. | 워터마크 슬러그는 없습니다. 제품 페이지: `watermark` 0건, `synthid` 0건, `provenance` 0건 | 제품 페이지: `AI` 57, `detect` 58건 |
세 사이트맵 행 가운데 완전한 목록이 필요한 것은 Winston 행뿐입니다. 없음을 주장하는 행이 그것 하나뿐이기 때문입니다. Winston의 `sitemap.xml`은 페이지 목록이 아니라 사이트맵 세 개를 더 가리키는 색인입니다. 처음 두 개만 읽으면 896개, 세 개를 다 읽으면 932개입니다. Turnitin 행과 Originality 행은 무언가 존재한다고 말하고, 존재는 불완전한 목록에서도 살아남습니다.
이것이 무엇을 밝히고 무엇을 밝히지 않는지 두 가지만 짚어두겠습니다. 양쪽으로 모두 작용하기 때문입니다.
밝혀진 것은 여섯 곳 가운데 어디도 워터마크를 읽는다고 말하지 않는다는 사실입니다. 어느 곳도 읽을 수 없다는 것이 밝혀진 것은 아니며, 저라도 탐지 업체 입장이라면 그렇게 읽지 않을 것입니다. 감지 API 접근 권한을 조용히 받아두고 아무것도 쓰지 않은 곳이 있다면, 밖에서 보기에는 지금과 정확히 같아 보일 것입니다.
사이트맵 행은 URL 슬러그만 검색하고, 호스트를 하나씩만 다룹니다. Turnitin 사이트맵은 `www.turnitin.com` 기준입니다. 헬프센터가 있는 `guides.turnitin.com`은 다른 호스트라 그 안에 들어 있지 않고, 그래서 헬프센터에 별도의 행 두 개가 배정되었습니다. 전문 검색 행은 표에 적힌 페이지만 다루며 그 사이트의 모든 페이지를 다루지는 않습니다. 제가 열어보지 않은 페이지에 언급이 있으면 여기에는 나타나지 않습니다.
Originality.ai는 다시 볼 만합니다. 이름에 SynthID가 들어간 대화형 도구를 공개하고 있기 때문입니다. "does not run Google's or Anthropic's detector" (Google이나 Anthropic의 탐지기를 실행하지 않는다는 뜻)이라는 표현이 그 페이지에 두 번, 서로 다른 문장으로 나옵니다. "It does not generate text with Gemini or Claude and does not run Google's or Anthropic's detector." (Gemini나 Claude로 텍스트를 생성하지 않으며, Google이나 Anthropic의 탐지기도 실행하지 않습니다.) 그리고 애니메이션 자체 아래에는 "Words, values, and thresholds are illustrative. This does not run Google's or Anthropic's detector." (단어, 수치, 임계값은 예시입니다. Google이나 Anthropic의 탐지기는 실행하지 않습니다.)라고 적혀 있습니다. 워터마크의 이름을 딴 것이 반드시 워터마크 판독기인 것은 아닙니다.
이 주제로 GPTZero에서 찾을 수 있었던 유일한 글은 2024년 10월 것이고, Anthropic이 아니라 Google에 관한 내용입니다. 현재 입장이 아니라 배경으로 보세요. 다만 분명한 조건문이 하나 들어 있습니다: "If Google were to release to developers a secure and reliable way of accessing its abilities to detect its own watermark, GPTZero would be the first to integrate any offering they have into our product." (Google이 자체 워터마크를 감지하는 기능에 개발자가 안전하고 신뢰할 수 있게 접근하는 방법을 공개한다면, GPTZero가 그들이 내놓는 것을 가장 먼저 자사 제품에 통합할 것입니다.)
그 Turnitin FAQ에서 직접 확인할 수 있는 것이 하나 더 있습니다. 단 까다로운 점이 붙어 있습니다. 그 페이지는 감지 가능한 모델 목록을 두 번 실어 놓았습니다. 한 번은 "How does it work?" (어떻게 작동하나요?) 아래, 또 한 번은 "Which AI writing models can Turnitin's technology detect?" (Turnitin 기술은 어떤 AI 작성 모델을 감지할 수 있나요?) 아래입니다. 두 목록에서 가장 최신 Claude 항목은 Claude Sonnet-4.6이지만, 출시일은 목록마다 다릅니다. 첫 번째는 2026-02, 두 번째는 2026-05입니다. Ctrl-F로 둘 다 확인하실 수 있습니다. 어느 쪽이든 Fable과 Mythos는 그 페이지에 한 번도 나오지 않습니다. 그리고 목록은 예측이 아니라 현재 시점의 스냅샷임을 밝히는 문장으로 끝납니다: "and tools based on these LLMs as well. We will continue to expand our detection capabilities to other models in the future." (이러한 LLM을 기반으로 한 도구도 마찬가지입니다. 앞으로도 감지 대상을 다른 모델로 계속 확대해 나가겠습니다.) Turnitin은 Claude를 특별히 감지하는가에서는 그 목록을 처음부터 끝까지 살펴봅니다.
붙잡아 둘 것은 그 분리입니다. 학교가 실행하는 AI 작성 리포트와 워터마크는 서로 다른 경로입니다. 워터마크가 생기기 전에 나온 저희 글도 같은 이야기를 했습니다. 영어 논문의 AIGC 탐지는 "the detector does not look for specific AI tool signatures or watermarks" (탐지기는 특정 AI 도구의 특징이나 워터마크를 찾지 않습니다)라고 적고, Turnitin은 Gemini와 Copilot을 감지하는가는 "the detector is not looking for a watermark or a single telltale feature" (탐지기는 워터마크나 단 하나의 결정적 특징을 찾고 있지 않습니다)라고 적습니다. 둘 다 지금도 유효합니다. 달라진 점은 이제 워터마크가 별도의 경로에 생겼고, 그 키를 다른 누군가가 쥐고 있다는 것입니다.
누군가 그것을 읽었다면, 무엇이 입증되는가
워터마크라는 단어가 시사하는 것보다 적습니다. 그리고 이는 양방향 모두에서 마찬가지입니다.
감지된 표시가 있는 경우부터 보겠습니다. 헬프센터는 그것이 무엇의 증거로도 서지 못하게 합니다: "A detected mark provides a signal that content was processed by Claude, but is not fully conclusive." (감지된 표시는 그 콘텐츠가 Claude를 거쳤다는 신호를 주지만, 그것만으로 결론이 나는 것은 아닙니다.) 근거로 드는 것이 가장 흔한 사용 방식입니다: "Claude may not be the original author. People often use Claude to proofread, translate, summarize, or convert files." (Claude가 원저자가 아닐 수 있습니다. 사람들은 교정, 번역, 요약, 파일 변환에 Claude를 자주 씁니다.) 뉴스 게시물은 같은 요점을 두 문장으로 압축합니다:
A watermark can only determine that Claude was likely involved with the content at some point. It cannot distinguish "Claude wrote this" from "Claude heavily edited this." (워터마크가 알려주는 것은 Claude가 그 콘텐츠에 어느 시점에서 관여했을 가능성이 높다는 것뿐입니다. 그것은 "Claude가 이것을 썼다"와 "Claude가 이것을 크게 편집했다"를 구분하지 못합니다.)
이번에는 반대 방향입니다. 같은 페이지가 여기에서도 똑같이 신중합니다: "Lack of a detected mark doesn't mean the content wasn't AI-generated or processed." (표시가 감지되지 않았다고 해서 그 콘텐츠가 AI로 생성되거나 처리되지 않았다는 뜻은 아닙니다.) 이어서 이유 다섯 가지가 나오고, 그중 첫 번째가 오래된 모델로 쓴 모든 초안에 해당합니다: "It was generated by a model released before marking was supported" (표시가 지원되기 전에 출시된 모델이 생성한 것입니다)
즉 워터마크는 저자 판별 도구가 아닙니다. 여러분이 썼다는 것을 확인해 주지도 못하고, 표시가 없다고 해서 쓰지 않았음을 확인해 주지도 못합니다. Anthropic 자신의 설명에 따르면 그것이 알려주는 것은, 어떤 구절의 작성 과정 어딘가에 Claude가 관여했을 가능성이 높다는 것뿐입니다.
EU 법은 여러분이 아니라 Anthropic을 겨냥합니다
이 모든 것이 존재하는 이유는 EU AI법 제50조입니다. 워터마크를 만들어낸 그 단락은 첫 네 단어에서 누가 준수해야 하는지 지목합니다:
Providers of AI systems, including general-purpose AI systems, generating synthetic audio, image, video or text content, shall ensure that the outputs of the AI system are marked in a machine-readable format and detectable as artificially generated or manipulated. (합성 오디오, 이미지, 동영상 또는 텍스트 콘텐츠를 생성하는 AI 시스템 제공자, 범용 AI 시스템을 포함한 제공자는, AI 시스템의 출력물이 기계 판독 가능한 형식으로 표시되고 인위적으로 생성 또는 조작된 것으로 감지될 수 있도록 보장해야 합니다.)
유럽 위원회는 투명성 실천 규범이 서명될 때 이를 더 쉬운 말로 풀어 설명했습니다: "Although the legal obligation applies only to providers of AI systems, Section 1 can also be signed by providers of marking and detection solutions..." (법적 의무는 AI 시스템 제공자에게만 적용되지만, 섹션 1은 표시 및 탐지 솔루션 제공자도 서명할 수 있습니다...)
제50조에는 제공자를 넘어 AI로 글을 쓰는 사람에게 닿는 단락이 하나 있습니다. 제4항인데, 과제는 여기에 해당하지 않습니다:
Deployers of an AI system that generates or manipulates text which is published with the purpose of informing the public on matters of public interest shall disclose that the text has been artificially generated or manipulated. (공공의 관심사에 관해 공중에게 알릴 목적으로 게시되는 텍스트를 생성하거나 조작하는 AI 시스템의 배포자는, 그 텍스트가 인위적으로 생성 또는 조작되었음을 공개해야 합니다.)
공개. 공중에게 알림. 공공의 관심사. 학과에 제출하는 과제는 세 가지 모두에 해당하지 않습니다. 제50조 어디에도 여러분에게 공개 의무를 지우는 부분은 없고, 대학에 워터마크를 찾아보라고 지시하는 단락도 없습니다.
이 조항이 탐지 쪽을 건드리는 부분이 마지막 단락에 한 번 나옵니다. 전혀 다른 곳을 겨냥하고 있지만 읽을 만합니다:
The AI Office shall encourage and facilitate the drawing up of codes of practice at Union level to facilitate the effective implementation of the obligations regarding the detection and labelling of artificially generated or manipulated content. (AI Office는 인위적으로 생성 또는 조작된 콘텐츠의 탐지와 표시에 관한 의무가 효과적으로 이행되도록, EU 차원의 실천 규범 작성을 장려하고 지원해야 합니다.)
그것은 EU 자체 AI Office의 일입니다. 여러분의 에세이를 받는 사람에게 주어진 의무가 아닙니다.
여러분을 실제로 규율하는 것은 대학이나 저널 자체의 AI 정책입니다. 별도의 문서이고 자체 규칙이 있으며, 결과가 붙어 있는 것도 바로 그것입니다.
남은 일주일 동안 할 수 있는 일
- 어떤 모델이 초안을 만들었는지 확인하세요. 모델 이름은 전송 버튼 옆에 있고, 대화 중에도 바꿀 수 있으며, 다른 모델로 대체된 응답에는 실제로 답한 모델이 표시됩니다. Fable 5.1이나 Mythos 5.1이라면 지금 Anthropic의 지원 목록에 올라 있습니다. 그보다 오래된 모델은 "we're working to add marking support" (표시 지원을 추가하는 작업을 하고 있습니다)에 해당하며, 날짜는 제시되지 않았습니다.
- 세 가지 경우 가운데 어디에 해당하는지 정리하세요. Claude가 본문을 썼는지, Claude가 번역했는지, 아니면 여러분이 쓴 글을 Claude가 교정했는지입니다. Anthropic 자신의 답에 따르면 교정은 "very little (if anything) for the watermark to attach to" (워터마크가 붙을 자리가 있다고 해도 매우 적습니다)에 해당하고, 번역에서 가장 많이 남습니다.
- 수강 중인 과목이나 프로그램의 AI 정책을 열어 제대로 읽어보세요. 확인할 것은 세 가지입니다. AI 지원을 신고해야 하는지, 어떤 표현으로 해야 하는지, 언제까지 해야 하는지입니다. 성적에 영향을 줄 수 있는 문서는 바로 그것이고, 제50조와 달리 여러분을 염두에 두고 쓰인 문서입니다. Turnitin에서 어느 정도의 AI 비율이 허용되는가에서는 기관들이 리포트 쪽을 어떻게 다뤄왔는지 다룹니다.
- 신고가 필요하다면 정책이 요구하는 방식으로 작성해서, 질문을 받은 뒤에 만드는 것이 아니라 논문과 함께 제출하세요.
- 초안이 어떻게 만들어졌는지에 관한 기록은 이미 있는 것이든 무엇이든 남겨두세요. 버전 기록은 "이 글을 직접 쓰셨는가"에 답하는 자료입니다. 그리고 그것은 워터마크가 어느 방향으로도 답할 수 없는 질문입니다. Google Docs 버전 기록이 실제로 남기는 것과 WPS나 Tencent Docs 버전 기록으로 직접 썼다는 것을 보여줄 수 있는가에서는 그 기록에 무엇이 담기고 무엇이 담기지 않는지 살펴봅니다.
- 그다음에는 워터마크 생각을 멈추세요. 위의 여섯 탐지기 가운데 워터마크를 읽는다고 말한 곳은 없고, 읽을 수 있는 API는 비공개 프리뷰 상태이며, 학교가 실제로 실행하는 리포트는 다른 신호로 작동합니다.
위의 수치 가운데 여러분 상황에 걸리는 것이 있으면 직접 다시 돌려보세요. 페이지는 모두 공개되어 있고, 검색어는 모두 표에 있으며, 대조값도 함께 넣어두었습니다. 진짜 0과, 조용히 말썽을 부리는 검색창을 구분하실 수 있을 것입니다.
계속 읽기