본문으로 건너뛰기
AIREGULATION

OpenAI textGrain: EU의 ChatGPT·Codex 글에 보이지 않는 워터마크가 붙는다

10 MIN READBY JJY
#OpenAI#ChatGPT#Codex#textGrain#AI 워터마크#EU AI Act#AI 규제#콘텐츠 출처

핵심 요약

OpenAI가 2026년 10월 5일(현지 시간) 유럽연합(EU) 사용자가 ChatGPT와 Codex로 만든 텍스트에 보이지 않는 워터마크를 넣겠다고 발표했습니다. 이름은 textGrain입니다. 모든 요금제의 적용 대상 사용자에게 "앞으로 몇 주에 걸쳐" 순차 적용하고, 범위는 EU로 한정합니다. 이유는 8월 2일부터 적용된 EU AI Act의 투명성 규정입니다. AI가 만든 콘텐츠를 다른 시스템이 식별할 수 있게 표시하라는 요구에 대한 OpenAI의 답입니다.

API 쪽은 다릅니다. 전 세계 개발자가 일부 모델에서 워터마크를 켤 수 있지만 기본값은 꺼짐입니다. 탐지기도 당장은 승인된 연구자와 전문 기관에만 열립니다.

관련 글: EU AI Act 2026년 8월 완전 시행, 기업이 알아야 할 모든 것

항목내용
발표일2026년 10월 5일
기술 이름textGrain (통계적 텍스트 워터마크)
적용 대상EU 내 ChatGPT·Codex의 적용 대상 텍스트 출력, 전 요금제
적용 시점앞으로 몇 주에 걸쳐 순차 적용
API전 세계 개발자가 지원 모델에서 선택 적용 (기본값 꺼짐)
탐지기초기에는 승인된 연구자·전문 기관만 신청 가능
근거 규정EU AI Act 투명성 규정 (8월 2일 적용 시작)
기술 보고서OpenAI, 펜실베이니아대, 예일대 공동

🔍 textGrain은 어떻게 표시를 남기나

이미지 워터마크처럼 픽셀에 무언가를 숨기는 방식이 아닙니다. 언어 모델은 다음 단어를 고를 때 후보마다 확률을 매기고, 그중 하나를 일정한 무작위성으로 뽑습니다. textGrain은 이 무작위성의 일부를 비밀 키와 앞 문맥에서 만든 값으로 바꿉니다.

TechCrunch는 이를 "비밀 키가 다음 단어 후보를 정렬하고, 수백 번의 작은 쏠림이 쌓여 패턴이 된다"고 설명했습니다. 한 단어만 보면 티가 나지 않습니다. 수백 단어가 모이면 우연으로 보기 어려운 통계적 흔적이 됩니다.

탐지에 필요한 것은 텍스트와 키뿐입니다. 글을 만든 모델을 다시 돌릴 필요가 없습니다. 복사해서 다른 곳에 붙여 넣어도 단어 선택 자체에 남은 패턴이라 함께 따라갑니다. OpenAI는 이 표시가 사용자를 식별하지 않는다고 밝혔습니다.

품질 영향도 확인했다고 합니다. BleepingComputer에 따르면 OpenAI는 textGrain을 켠 상태에서 GPT-6 Astra의 벤치마크 결과가 대체로 비슷했다며, 품질에 의미 있는 영향이 없다고 설명했습니다.

📊 탐지율: 길면 잡히고, 고치면 놓친다

OpenAI가 공개한 수치는 자체 실험 결과입니다. 독립 검증은 아직 없습니다. 그래도 숫자가 말하는 방향은 분명합니다.

조건탐지율비고
200토큰 응답 (심리학 분야)약 80%오탐률 목표 1% 기준
400토큰 응답 (심리학 분야)약 95%오탐률 목표 1% 기준
400토큰, 수정 없음약 92%동의어 치환 실험의 기준값
400토큰, 단어 10% 동의어 치환약 66%
400토큰, 단어 25% 동의어 치환약 17%

길이가 첫 번째 변수입니다. 200토큰이면 대략 한국어 짧은 문단 두세 개 분량인데, 이 길이에서는 다섯 개 중 하나를 놓칩니다. 400토큰이 되면 95%까지 올라갑니다.

편집이 두 번째 변수입니다. 단어 열 개 중 한 개만 동의어로 바꿔도 탐지율이 92%에서 66%로 떨어집니다. 네 개 중 한 개를 바꾸면 17%입니다. 사람이 손으로 다듬은 글, 다른 도구로 한 번 고쳐 쓴 글은 사실상 잡히지 않는다는 뜻입니다.

분야도 영향을 줍니다. OpenAI는 수학 답안, 번역문, 짧은 글은 탐지가 더 어렵다고 밝혔습니다. 수학 풀이처럼 정답 표현이 거의 정해진 글은 모델이 단어를 고를 여지가 적고, 그만큼 패턴을 심을 공간도 줄어듭니다.

OpenAI가 스스로 적어 둔 한계

이번 발표에서 눈에 띄는 부분은 OpenAI가 한계를 먼저 길게 적었다는 점입니다. 두 매체 모두 같은 문장을 인용했습니다.

  • 워터마크가 없다고 사람이 썼다는 증거는 아닙니다. 글이 너무 짧거나, 많이 고쳤거나, 다른 회사 AI가 썼을 수 있습니다.
  • 워터마크가 있어도 누가 썼는지는 모릅니다. 계정, 프롬프트, 대화 내용은 드러나지 않습니다.
  • 사람의 기여 정도도 알 수 없습니다. OpenAI 표현으로는 "OpenAI 시스템이 글의 일부를 생성하거나 처리했다는 것은 알려 주지만, 사람의 판단·편집·창의성이 얼마나 들어갔는지는 알려 주지 않는다"입니다.

이 문장들은 교실과 채용 현장을 겨냥한 경고처럼 읽힙니다. 탐지 결과 하나로 표절이나 부정행위를 판정하지 말라는 메시지입니다. 탐지기를 일반에 열지 않고 연구자·전문 기관부터 주는 것도 같은 맥락으로 보입니다.

🌍 EU에서만 켜는 이유와 Anthropic과의 차이

근거는 EU AI Act의 투명성 규정입니다. TechCrunch에 따르면 8월 2일부터 AI가 만든 콘텐츠를 다른 시스템이 식별할 수 있도록 표시하라는 요구가 적용됐습니다. OpenAI, Anthropic, Google, Meta, Microsoft는 모두 AI 생성 콘텐츠 표시에 관한 EU 행동강령(Code of Practice)에 서명했습니다.

적용 시한에 대해서는 보도가 엇갈립니다. 기계 판독 가능한 표시 의무는 12월 2일부터라는 해석도 있고, 8월 2일 이전에 출시된 시스템에 주는 유예 기간이라는 해석도 있습니다. 어느 쪽이든 연내에 EU 사용자를 대상으로 표시를 갖춰야 한다는 점은 같습니다.

같은 규정을 두고 Anthropic은 다른 길을 갔습니다. TechCrunch는 Anthropic이 약 두 달 전 Claude 텍스트 워터마크를 EU에 한정하지 않고 전 세계에 적용하겠다고 발표했다고 전했습니다. 당시 일부 Claude 사용자는 "지시, 맥락, 결정은 내가 했고 Claude는 도구일 뿐"이라며 반발했습니다.

구분OpenAI (textGrain)Anthropic (Claude)
발표2026년 10월 5일약 두 달 전 (8월)
적용 범위EU 사용자만 (API는 전 세계 선택 적용)전 세계
기본값EU 소비자 제품은 켜짐, API는 꺼짐전 세계 적용

OpenAI의 선택은 2024년 일과 겹쳐 보입니다. 당시 Wall Street Journal은 OpenAI가 텍스트 워터마크를 이미 만들어 두고도 공개하지 않았다고 보도했습니다. 이유 중 하나는 워터마크가 없는 경쟁 서비스로 사용자가 옮겨 갈 수 있다는 우려였습니다. 이번에도 OpenAI는 출시 시점에 전 세계 기본값으로 만들지는 않는다고 밝혔습니다.

🧑‍💻 사용자별로 달라지는 것

같은 발표라도 서 있는 자리에 따라 영향이 다릅니다. 확인된 사실만 놓고 정리하면 이렇습니다.

대상바뀌는 것하지 않아도 되는 것
EU의 ChatGPT 사용자적용 대상 답변에 표시가 들어감 (전 요금제)별도 설정 없음, 화면상 차이 없음
EU의 Codex 사용자생성 텍스트에 같은 표시가 들어감사용자 식별 정보는 담기지 않음
EU 밖 ChatGPT 사용자출시 시점 기준 변화 없음전 세계 기본값은 아님
API 개발자 (전 세계)지원 모델에서 켤 수 있는 옵션이 생김기본값이 꺼짐이라 그대로 두면 변화 없음
연구자·검증 기관탐지기 접근을 신청할 수 있음일반 공개 도구는 아직 없음

Codex가 함께 들어간 이유

눈여겨볼 대목은 Codex입니다. 코드 생성 도구에 텍스트 워터마크를 넣는다는 것은 주석, 커밋 메시지, 문서처럼 Codex가 쓰는 자연어 출력도 표시 대상이라는 뜻으로 읽힙니다. 다만 "적용 대상(eligible)" 텍스트의 정확한 범위를 두 매체 모두 구체적으로 적지 않았습니다. 코드 본문에도 표시가 들어가는지는 OpenAI의 추가 설명을 기다려야 합니다.

교육 현장에 던지는 신호

학교와 대학이 가장 궁금해할 질문은 "이제 과제를 AI로 썼는지 가려낼 수 있나"일 겁니다. 답은 "아직은 아니다"에 가깝습니다. 탐지기가 일반에 열리지 않았고, OpenAI 스스로 표시가 없다는 사실이 사람의 글이라는 증거가 아니라고 못 박았습니다. 과제 한 편을 단어 몇 개만 바꿔 제출해도 탐지율이 크게 떨어진다는 수치도 함께 나왔습니다.

필자의 시각

여기부터는 개인적인 해석입니다.

가장 큰 의미는 기술보다 문서에 있다고 봅니다. 펜실베이니아대·예일대 연구진과 쓴 기술 보고서와 함께 "이 정도면 잡히고, 이렇게 고치면 놓친다"를 숫자로 공개했습니다. 단어 25%를 바꾸면 17%라는 수치는 마케팅 자료에 넣고 싶은 숫자가 아닙니다. 탐지를 판정 도구로 쓰려는 사람에게 미리 선을 그어 둔 셈입니다.

반대로 실무 효과는 제한적일 것 같습니다. 짧은 글이 많은 메신저, 사람이 손보는 보고서, 번역 결과물은 대부분 빠져나갑니다. 규정을 지키는 최소한의 장치로 보는 편이 맞습니다. 출처를 증명하는 도구로 기대하면 실망할 가능성이 큽니다.

개발자 입장에서 확인할 부분은 API 설정입니다. 지금은 기본값이 꺼짐이라 아무것도 하지 않으면 바뀌는 게 없습니다. EU 사용자를 대상으로 글을 생성해 내보내는 서비스라면, 자사 서비스가 AI Act의 표시 의무 대상인지와 이 옵션을 켜야 하는지를 법무 쪽과 한 번 맞춰 볼 시점입니다.

참고

Share
JJY
// AUTHORJJY

AI · WEB SECURITY · DEV ENV

GH

새 글 알림 받기

스팸 없이 새 포스트만 전달합니다.

// RELATED

관련 포스트