지폐를 불빛에 비춰 보면 숨어 있던 그림이 나타나죠. 평소엔 안 보이지만, 확인하려는 사람에겐 “진짜 맞아요”라고 알려 주는 표시예요. 이걸 워터마크라고 부릅니다.
이제 AI가 쓴 글에도 이런 표시가 들어가기 시작합니다. 오픈AI는 10월 5일(현지시간) 챗GPT와 코덱스(오픈AI의 코딩 AI)가 만든 텍스트에 눈에 안 보이는 워터마크를 넣겠다고 발표했어요. 다만 우선은 유럽연합(EU) 사용자만 대상입니다. 오늘은 이게 어떤 원리인지, 정말 잘 잡히는지, 한국에서 쓰는 우리에겐 뭐가 달라지는지 차근차근 풀어 볼게요.

한 줄 요약부터
| 궁금한 것 | 짧은 답 |
|---|---|
| 무엇이 생기나요? | 챗GPT·코덱스가 쓴 글에 사람 눈엔 안 보이는 ‘통계적 신호’가 들어가요. |
| 기술 이름은? | 텍스트그레인(textGrain) |
| 어디서 먼저? | EU의 모든 요금제 챗GPT·코덱스, 앞으로 몇 주에 걸쳐 |
| 한국은요? | 출시 시점엔 전 세계 기본 적용을 하지 않는다고 밝혔어요. |
| 왜 하나요? | EU AI법이 AI가 만든 콘텐츠를 기계가 알아볼 수 있게 표시하라고 요구하거든요. |
글자에 도장을 어떻게 찍어요?
사진이라면 구석에 로고를 넣으면 되지만, 글은 그럴 수가 없죠. 그래서 텍스트그레인은 글자를 덧붙이는 게 아니라 ‘단어 고르는 습관’을 살짝 바꿉니다.
AI는 글을 쓸 때 매번 “다음에 올 단어”를 여러 후보 중에서 골라요. 예를 들어 “오늘 날씨가 ___”라면 ‘좋다’, ‘맑다’, ‘화창하다’ 같은 후보가 있겠죠. 워터마크를 켜면 이 중 특정 후보를 아주 미세하게 더 자주 고르도록 기울입니다. 문장 하나만 보면 전혀 티가 안 나지만, 긴 글 전체를 모아 보면 우연이라고 보기 어려운 패턴이 생겨요. 전용 탐지기는 바로 그 패턴을 찾아냅니다.

이 방식의 장점은 숨은 문자나 이상한 띄어쓰기가 없다는 거예요. 그래서 글을 복사해서 다른 문서에 붙여 넣어도 신호가 어느 정도 남습니다. 단어 자체에 신호가 들어 있으니까요.
그럼 정말 잘 잡힐까요?
오픈AI는 솔직하게 “완벽하지 않다”고 밝혔어요. 숫자로 보면 이렇습니다. (허위 양성률, 즉 사람이 쓴 글을 AI 글로 잘못 짚는 비율을 1%로 맞췄을 때 기준이에요.)
| 상황 | 탐지율(대략) | 쉽게 말하면 |
|---|---|---|
| 200토큰 분량 글 | 약 80% | 짧은 글은 다섯 번 중 한 번꼴로 놓쳐요. |
| 400토큰 분량 글 | 약 95% | 길수록 패턴이 쌓여서 잘 잡혀요. |
| 400토큰 글, 단어 10%를 동의어로 바꿈 | 약 92% → 66% | 조금만 고쳐도 꽤 흐려져요. |
| 400토큰 글, 단어 25%를 바꿈 | 약 17% | 많이 고치면 거의 안 잡혀요. |

여기서 ‘토큰’은 AI가 글을 자르는 단위예요. 영어로는 대략 단어 하나보다 조금 작은 조각이라, 200토큰이면 영어 150단어 정도입니다. 수학 풀이처럼 쓸 수 있는 단어가 정해진 글, 번역된 글, 아주 짧은 글은 더 잡기 어렵다고 해요.
이런 한계 때문에 오픈AI는 탐지기를 일반인에게 바로 풀지 않고, 승인받은 연구자와 전문 기관에만 먼저 제공합니다. 탐지기는 “워터마크가 있다/없다”만 알려 주고, 누가 썼는지나 어떤 대화였는지는 알려 주지 않는다고 설명했어요.
워터마크가 알려 주는 것, 못 알려 주는 것
가장 많이 오해하는 부분이 여기예요. 워터마크는 생각보다 할 수 있는 일이 좁습니다.
| 이런 질문에 | 워터마크로는 |
|---|---|
| 이 글에 오픈AI 모델의 신호가 들어 있나요? | 알 수 있어요 (단, 확률적으로) |
| 사람이 얼마나 손을 봤나요? | 알 수 없어요 |
| 누가 썼나요? 소유권이나 법적 책임은요? | 알 수 없어요 |
| 내용이 사실인가요? | 알 수 없어요 |
그리고 반대로, 워터마크가 안 나왔다고 사람이 쓴 글이라는 증거도 아닙니다. 글이 짧았거나, 고쳤거나, 번역했거나, 워터마크가 없는 다른 AI로 썼을 수도 있으니까요. 그러니 “탐지기 돌려 보니 AI래, 넌 베꼈어!” 같은 식으로 쓰면 안 되는 도구라는 점을 꼭 기억해 두세요.
누구에게 적용되나요?

| 대상 | 워터마크 | 비고 |
|---|---|---|
| EU 챗GPT·코덱스 사용자 | 켜짐(순차 적용) | 무료부터 유료까지 모든 요금제 |
| 전 세계 API 고객(개발자·기업) | 선택(기본 꺼짐) | 일부 모델부터, 원하면 켤 수 있어요 |
| 한국 등 EU 밖 챗GPT 사용자 | 출시 시점 기본 적용 아님 | 실제 사용 후기를 보고 판단하겠다는 입장 |
| 앤트로픽 클로드 | 켜짐 | 8월부터 전 세계 적용, 당시 반발도 있었어요 |
덧붙이면 이미지와 음성은 이미 따로 표시를 하고 있어요. 오픈AI는 이미지에 C2PA라는 출처 정보와 보이지 않는 워터마크를 넣고 있고, 이번에 텍스트까지 범위를 넓힌 셈입니다. 오픈AI는 텍스트그레인을 앞으로 오픈소스로 공개하겠다고도 했어요.
우리는 뭘 신경 쓰면 될까요?
- 지금 당장 한국에서 쓰는 챗GPT는 그대로예요. 출시 시점엔 EU 밖 기본 적용이 아니니까, 쓰던 방식이 갑자기 바뀌진 않습니다.
- 회사·학교 규칙은 계속 지키세요. 워터마크는 “AI를 왜, 얼마나 썼는지”를 기록해 주지 않아요. AI 사용을 밝히라는 규칙이 있다면 그건 여전히 내가 직접 챙겨야 해요.
- ‘AI 판별기’ 결과를 맹신하지 마세요. 탐지율 표에서 봤듯이 짧거나 고친 글은 잘 안 잡히고, 안 잡혔다고 사람이 쓴 것도 아닙니다.
- 개발자라면 API 설정을 확인해 보세요. 내 서비스가 EU 사용자에게 AI 글을 보여 준다면, 워터마크를 켤지 미리 검토해 두는 게 좋아요.
정리하면, AI 글에 찍히는 ‘보이지 않는 도장’은 이제 막 첫발을 뗀 기술이에요. 완벽한 판별기가 아니라 “출처를 알려 주는 여러 단서 중 하나”쯤으로 이해하면 딱 맞습니다. 나중에 한국에도 적용 범위가 넓어지면 다시 쉽게 풀어 드릴게요.