AI가 쓴 글에 ‘보이지 않는 도장’? 챗GPT 텍스트 워터마크를 초보도 쉽게

지폐를 불빛에 비춰 보면 숨어 있던 그림이 나타나죠. 평소엔 안 보이지만, 확인하려는 사람에겐 “진짜 맞아요”라고 알려 주는 표시예요. 이걸 워터마크라고 부릅니다.

이제 AI가 쓴 글에도 이런 표시가 들어가기 시작합니다. 오픈AI는 10월 5일(현지시간) 챗GPT와 코덱스(오픈AI의 코딩 AI)가 만든 텍스트에 눈에 안 보이는 워터마크를 넣겠다고 발표했어요. 다만 우선은 유럽연합(EU) 사용자만 대상입니다. 오늘은 이게 어떤 원리인지, 정말 잘 잡히는지, 한국에서 쓰는 우리에겐 뭐가 달라지는지 차근차근 풀어 볼게요.

AI가 쓴 글 속에 숨은 '보이지 않는 도장', 텍스트 워터마크
AI가 쓴 글 속에 숨은 ‘보이지 않는 도장’, 텍스트 워터마크

한 줄 요약부터

궁금한 것 짧은 답
무엇이 생기나요? 챗GPT·코덱스가 쓴 글에 사람 눈엔 안 보이는 ‘통계적 신호’가 들어가요.
기술 이름은? 텍스트그레인(textGrain)
어디서 먼저? EU의 모든 요금제 챗GPT·코덱스, 앞으로 몇 주에 걸쳐
한국은요? 출시 시점엔 전 세계 기본 적용을 하지 않는다고 밝혔어요.
왜 하나요? EU AI법이 AI가 만든 콘텐츠를 기계가 알아볼 수 있게 표시하라고 요구하거든요.

글자에 도장을 어떻게 찍어요?

사진이라면 구석에 로고를 넣으면 되지만, 글은 그럴 수가 없죠. 그래서 텍스트그레인은 글자를 덧붙이는 게 아니라 ‘단어 고르는 습관’을 살짝 바꿉니다.

AI는 글을 쓸 때 매번 “다음에 올 단어”를 여러 후보 중에서 골라요. 예를 들어 “오늘 날씨가 ___”라면 ‘좋다’, ‘맑다’, ‘화창하다’ 같은 후보가 있겠죠. 워터마크를 켜면 이 중 특정 후보를 아주 미세하게 더 자주 고르도록 기울입니다. 문장 하나만 보면 전혀 티가 안 나지만, 긴 글 전체를 모아 보면 우연이라고 보기 어려운 패턴이 생겨요. 전용 탐지기는 바로 그 패턴을 찾아냅니다.

텍스트그레인은 단어 선택을 살짝 기울여 탐지기가 읽는 패턴을 남긴다
텍스트그레인은 단어 선택을 살짝 기울여 탐지기가 읽는 패턴을 남긴다

이 방식의 장점은 숨은 문자나 이상한 띄어쓰기가 없다는 거예요. 그래서 글을 복사해서 다른 문서에 붙여 넣어도 신호가 어느 정도 남습니다. 단어 자체에 신호가 들어 있으니까요.

그럼 정말 잘 잡힐까요?

오픈AI는 솔직하게 “완벽하지 않다”고 밝혔어요. 숫자로 보면 이렇습니다. (허위 양성률, 즉 사람이 쓴 글을 AI 글로 잘못 짚는 비율을 1%로 맞췄을 때 기준이에요.)

상황 탐지율(대략) 쉽게 말하면
200토큰 분량 글 약 80% 짧은 글은 다섯 번 중 한 번꼴로 놓쳐요.
400토큰 분량 글 약 95% 길수록 패턴이 쌓여서 잘 잡혀요.
400토큰 글, 단어 10%를 동의어로 바꿈 약 92% → 66% 조금만 고쳐도 꽤 흐려져요.
400토큰 글, 단어 25%를 바꿈 약 17% 많이 고치면 거의 안 잡혀요.
글이 길수록 잘 잡히고, 단어를 많이 고칠수록 흐려진다 (오픈AI 발표 대략치)
글이 길수록 잘 잡히고, 단어를 많이 고칠수록 흐려진다 (오픈AI 발표 대략치)

여기서 ‘토큰’은 AI가 글을 자르는 단위예요. 영어로는 대략 단어 하나보다 조금 작은 조각이라, 200토큰이면 영어 150단어 정도입니다. 수학 풀이처럼 쓸 수 있는 단어가 정해진 글, 번역된 글, 아주 짧은 글은 더 잡기 어렵다고 해요.

이런 한계 때문에 오픈AI는 탐지기를 일반인에게 바로 풀지 않고, 승인받은 연구자와 전문 기관에만 먼저 제공합니다. 탐지기는 “워터마크가 있다/없다”만 알려 주고, 누가 썼는지나 어떤 대화였는지는 알려 주지 않는다고 설명했어요.

워터마크가 알려 주는 것, 못 알려 주는 것

가장 많이 오해하는 부분이 여기예요. 워터마크는 생각보다 할 수 있는 일이 좁습니다.

이런 질문에 워터마크로는
이 글에 오픈AI 모델의 신호가 들어 있나요? 알 수 있어요 (단, 확률적으로)
사람이 얼마나 손을 봤나요? 알 수 없어요
누가 썼나요? 소유권이나 법적 책임은요? 알 수 없어요
내용이 사실인가요? 알 수 없어요

그리고 반대로, 워터마크가 안 나왔다고 사람이 쓴 글이라는 증거도 아닙니다. 글이 짧았거나, 고쳤거나, 번역했거나, 워터마크가 없는 다른 AI로 썼을 수도 있으니까요. 그러니 “탐지기 돌려 보니 AI래, 넌 베꼈어!” 같은 식으로 쓰면 안 되는 도구라는 점을 꼭 기억해 두세요.

누구에게 적용되나요?

2026년 10월 기준 텍스트 워터마크 적용 범위
2026년 10월 기준 텍스트 워터마크 적용 범위
대상 워터마크 비고
EU 챗GPT·코덱스 사용자 켜짐(순차 적용) 무료부터 유료까지 모든 요금제
전 세계 API 고객(개발자·기업) 선택(기본 꺼짐) 일부 모델부터, 원하면 켤 수 있어요
한국 등 EU 밖 챗GPT 사용자 출시 시점 기본 적용 아님 실제 사용 후기를 보고 판단하겠다는 입장
앤트로픽 클로드 켜짐 8월부터 전 세계 적용, 당시 반발도 있었어요

덧붙이면 이미지와 음성은 이미 따로 표시를 하고 있어요. 오픈AI는 이미지에 C2PA라는 출처 정보와 보이지 않는 워터마크를 넣고 있고, 이번에 텍스트까지 범위를 넓힌 셈입니다. 오픈AI는 텍스트그레인을 앞으로 오픈소스로 공개하겠다고도 했어요.

우리는 뭘 신경 쓰면 될까요?

  • 지금 당장 한국에서 쓰는 챗GPT는 그대로예요. 출시 시점엔 EU 밖 기본 적용이 아니니까, 쓰던 방식이 갑자기 바뀌진 않습니다.
  • 회사·학교 규칙은 계속 지키세요. 워터마크는 “AI를 왜, 얼마나 썼는지”를 기록해 주지 않아요. AI 사용을 밝히라는 규칙이 있다면 그건 여전히 내가 직접 챙겨야 해요.
  • ‘AI 판별기’ 결과를 맹신하지 마세요. 탐지율 표에서 봤듯이 짧거나 고친 글은 잘 안 잡히고, 안 잡혔다고 사람이 쓴 것도 아닙니다.
  • 개발자라면 API 설정을 확인해 보세요. 내 서비스가 EU 사용자에게 AI 글을 보여 준다면, 워터마크를 켤지 미리 검토해 두는 게 좋아요.

정리하면, AI 글에 찍히는 ‘보이지 않는 도장’은 이제 막 첫발을 뗀 기술이에요. 완벽한 판별기가 아니라 “출처를 알려 주는 여러 단서 중 하나”쯤으로 이해하면 딱 맞습니다. 나중에 한국에도 적용 범위가 넓어지면 다시 쉽게 풀어 드릴게요.