AI 콘텐츠 신뢰 · 공식 발표 분석
OpenAI textGrain: EU 워터마크 도입과 판별 한계
OpenAI는 2026년 10월 5일 textGrain 정책을 발표했습니다. EU의 ChatGPT·Codex 순차 도입과 전 세계 API의 선택 적용을 구분하고, 탐지 결과만으로 작성자나 사실 여부를 판단할 수 없는 이유를 살펴봅니다.
이 글에서 다룰 내용
textGrain 작동 원리, EU·API 제공 범위, 연구자용 탐지기, 평가 조건과 오탐, 콘텐츠 제작·검수 기록
챗GPT 워터마크, 무엇을 표시하나요?
OpenAI는 2026년 10월 5일 textGrain을 발표했습니다. 챗GPT 워터마크라는 말에서 글 위에 찍힌 로고를 떠올릴 수 있지만 이 기술은 모델의 단어 선택에 눈에 보이지 않는 통계 신호를 넣습니다. 탐지기는 그 신호를 찾아 해당 문장에 OpenAI 워터마크가 포함됐는지 평가합니다.
이를 이해할 때 중요한 질문은 “누가 쓴 글인가?”보다 “이 글에서 어떤 생성 신호를 확인할 수 있는가?”입니다. AI 글 판별 결과로 알 수 있는 범위는 제한적이라는 점을 먼저 기억해 두면 발표 내용을 오해하지 않을 수 있습니다.
EU 서비스와 전 세계 API는 적용 방식이 다릅니다
ChatGPT와 코덱스(Codex)는 EU의 적격 텍스트 출력에 워터마크를 도입할 예정입니다. 모든 플랜을 대상으로 하지만 발표 당일 일괄 적용하는 방식은 아닙니다. 발표 이후 몇 주 동안 순차 적용하며, 출시 시점의 전 세계 기본 적용도 아닙니다.
API는 일정과 범위가 다릅니다. 전 세계 API 고객은 2026년 10월 5일부터 일부 모델에서 워터마크를 선택해 사용하는 opt-in 방식으로 접근할 수 있습니다. API 기본값은 꺼짐 상태이므로, API로 생성한 모든 글에 자동으로 워터마크가 들어간다고 이해하면 안 됩니다.
OpenAI는 이번 접근을 EU AI Act에 대응하는 방안으로 설명했습니다. 이는 회사가 밝힌 도입 배경이며, 이 글에서 개별 콘텐츠의 적법성이나 법적 의무를 판단하는 것은 아닙니다.
탐지기 신청 개시와 일반 공개는 다른 단계입니다
텍스트 워터마크 탐지기 접근 신청도 발표 당일 시작됐습니다. 다만 초기 접근은 승인된 연구자와 전문기관으로 제한됩니다. 누구나 글을 붙여 넣어 확인하는 일반 사용자용 서비스가 공개된 것은 아닙니다.
이미 공개돼 있는 이미지·오디오 검증 도구와도 구분해야 합니다. 기존 verify 도구가 공개돼 있다는 사실이 이번 텍스트 탐지기의 일반 공개를 뜻하지는 않습니다. textGrain의 오픈소스 제공 역시 향후 계획이며, 이미 공개를 마쳤다는 발표는 아닙니다.
80%와 95%, 평가 조건까지 함께 읽어야 합니다
OpenAI 자체 평가에서는 오탐률 목표를 1%로 설정했을 때, 심리학 같은 콘텐츠의 200토큰 글에서 약 80%, 400토큰 글에서 약 95%의 워터마크를 탐지했습니다. 단어 선택의 여지가 적은 수학 콘텐츠에서는 탐지율이 더 낮았습니다.
여기서 수치는 영어 ELI5 평가 맥락에 속합니다. 한국어 블로그 글의 정확도나 모든 주제의 탐지 성능으로 일반화할 수 없습니다. 200토큰과 400토큰을 한국어 200자, 400자로 바꿔 읽어서도 안 됩니다.
또한 오탐률 목표 1%는 개별 글에 대한 판정이 99% 확실하다는 뜻이 아닙니다. 평가 조건에서의 오탐률과 특정 글의 작성 경위를 확정하는 일은 구분해서 봐야 합니다.
검출되지 않아도 사람이 썼다는 증거는 아닙니다
짧은 글은 탐지하기 어렵고 편집이나 번역을 거친 글은 워터마크 신호가 약해질 수 있습니다. 미지원 모델의 출력이나 워터마크 도입 이전에 생성된 글도 결과 해석에 영향을 줍니다.
워터마크 미탐지는 인간 작성의 증거가 아닙니다. 반대로 워터마크가 없는 글에서 신호가 있다고 판단하는 오탐도 가능합니다. AI 글 판별 결과 하나만으로 작성 경위를 확정하기에는 이런 한계가 남습니다.
워터마크가 설명하지 못하는 것들
워터마크는 사람이 얼마나 기여했는지 측정하지 않습니다. 사람이 초안을 검토하고 문장을 고쳤더라도, 탐지 결과만으로 판단·편집·창의성의 비중을 나눌 수는 없습니다. 소유권이나 법적 책임을 정하는 근거도 제공하지 않습니다.
작성자 계정, 프롬프트, 대화 내용을 알아내는 기능도 아닙니다. 글이 사실인지, 오해를 유발하는지, 맥락이 적절한지도 확인하지 않습니다. 생성 신호가 있다는 결과와 내용이 믿을 만하다는 평가는 별개의 문제입니다.
콘텐츠 신뢰를 위해 운영자가 남길 기록
다음은 OpenAI가 제공하는 기능 설명과 구분한 일반 콘텐츠 운영 권고입니다. 블로그를 운영한다면 원고, 참고한 출처, 수정 이력, 최종 검수 기록을 함께 보존하는 방식을 권합니다. 글의 제작 과정을 설명해야 할 때 판별 점수에만 의존하지 않도록 하기 위해서입니다.
외부 원고를 검토할 때도 점수만 보고 채택하거나 배제하기보다 출처와 사실관계, 수정 과정을 함께 살펴보는 편이 좋겠습니다. 콘텐츠 신뢰를 관리하는 기준에 “어떤 도구를 썼는가”뿐 아니라 “무엇을 확인하고 고쳤는가”를 포함하는 것입니다.
이번 발표를 읽을 때는 적용 지역과 시점, 탐지기 접근 단계, 평가 조건을 나눠 확인합니다. textGrain의 신호가 무엇을 알려주는지와 어디까지 설명하지 못하는지를 함께 보는 태도가 중요합니다.
한 줄 요약: textGrain은 제한된 생성 신호를 제공하며, AI 글 판별 결과만으로 작성자·사실성·콘텐츠 신뢰를 확정할 수는 없습니다.
참고 출처
OpenAI의 2026년 10월 5일 공식 발표를 기준으로 작성했습니다. 공식 페이지는 본문 추출과 공식 RSS로 대조했으며 직접 요청에서는 HTTP 403을 반환했습니다. 평가 수치는 OpenAI 자체 평가 범위입니다.
