OpenAI, ChatGPT 글에 '보이지 않는 워터마크'… EU부터, 단어 25% 바꾸면 탐지율 17%
EU AI 법에 맞춰 ChatGPT·Codex 글에 눈에 안 보이는 표시를 넣어요. OpenAI 스스로 한계가 크다고 밝혔어요.
- OpenAI가 글 워터마크 기술 textGrain을 공개했어요. 모델이 단어를 고를 때 눈에 안 보이는 통계적 신호를 심는 방식이에요.
- 앞으로 몇 주 안에 EU 지역 ChatGPT·Codex 글에만 기본 적용하고, API는 오늘부터 전 세계에서 원하는 사람만 켤 수 있어요(기본은 꺼짐).
- 탐지기는 승인받은 연구자·전문 기관에만 열어요. 짧은 글·수정한 글은 잘 못 잡는다고 OpenAI가 직접 밝혔어요.
EU 쪽 독자·고객을 상대한다면, ChatGPT로 쓴 원고를 그대로 붙여 넣을 때 표시가 남을 수 있다는 걸 알고 있으면 돼요. 어차피 직접 다듬어 쓰는 게 품질에도 좋아요.
EU 사용자에게 AI 글을 보여 주는 서비스라면 API에서 워터마크를 켜는 옵션으로 EU AI 법의 '기계가 읽을 수 있는 표시' 의무 대응을 검토해 볼 수 있어요.
외주·학생 글을 'AI 탐지기'로 판정하려는 생각이라면 참고하세요. 표시가 안 잡혀도 사람이 쓴 증거가 아니라고 OpenAI가 못 박았어요.
당장 크리에이터가 바꿔야 할 건 없어 보여요. 다만 AI 초안을 여러 언어로 그대로 내보내는 경우라면, 사람이 한 번 손보는 과정을 유지해 두는 게 좋을 것 같아요.
무슨 일이야?
OpenAI가 10월 5일(미국 시간) EU 글 출처 표시 규칙에 대한 대응을 발표했어요. EU AI 법은 생성형 AI 회사가 만든 글을 '기계가 읽을 수 있는 방식으로' 알아볼 수 있게 하라고 요구해요. 그래서 OpenAI는 글 워터마크(눈에 안 보이는 출처 표시) 기술 textGrain을 단계적으로 켜기로 했어요.
X 게시물 보기 · https://x.com/OpenAI/status/2107164650249101695
어떻게 적용돼?
- EU의 ChatGPT·Codex 앞으로 몇 주 안에, 모든 요금제의 해당 출력 글에 워터마크가 들어가요. EU 밖에는 기본 적용하지 않아요.
- API 오늘부터 전 세계 고객이 일부 모델에서 직접 켤 수 있어요. 기본값은 꺼짐이에요.
- 탐지기 승인된 연구자·전문 기관만 신청할 수 있어요. 탐지 결과는 사용자나 대화 내용을 알려 주지 않아요.
textGrain은 모델이 단어를 고를 때 통계적 신호를 살짝 섞고, 탐지기가 그 신호를 찾는 방식이에요. OpenAI는 기술 보고서를 더 보강하고, 나중에 오픈소스로도 공개할 계획이래요.
숫자로 보면
| 조건 (오탐 1% 기준) | 탐지율 |
|---|---|
| 200토큰 글 (심리학 주제) | 약 80% |
| 400토큰 글 (심리학 주제) | 약 95% |
| 400토큰 글, 단어 10% 바꿈 | 약 92% → 66% |
| 400토큰 글, 단어 25% 바꿈 | 약 92% → 17% |
수학처럼 단어 선택 폭이 좁은 글은 탐지율이 훨씬 낮았어요. 반면 글 품질은 거의 그대로였어요. 최신 모델 Astra로 잰 GPQA Diamond 점수는 워터마크 없이 94.44%, 있을 때 93.94%였어요.
워터마크가 말해 주지 않는 것
OpenAI는 이 표시로 알 수 없는 것도 분명히 적었어요. 사람이 얼마나 손댔는지, 누구 글인지, 누가 썼는지, 내용이 맞는지는 알 수 없어요. 그리고 표시가 안 잡혔다고 사람이 쓴 글이라는 증거는 아니에요. 너무 짧거나, 고쳤거나, 번역했거나, 다른 회사 AI로 쓴 글일 수 있으니까요.
나는 어떻게 써먹지?
- EU 대상 콘텐츠 ChatGPT 글을 그대로 쓰면 표시가 남을 수 있다는 걸 알아 두세요.
- AI 판정 'AI 탐지 결과'만으로 남의 글을 단정하지 마세요. 만든 회사도 한계를 인정했어요.
- 이미지·오디오 OpenAI 이미지·오디오 확인 도구(openai.com/verify)는 지금처럼 누구나 쓸 수 있어요.
