OpenAI가 2026년 10월 5일 AI 생성 텍스트의 출처를 표시하는 새 적용 계획을 발표했다. 앞으로 수주에 걸쳐 유럽연합(EU)의 대상 ChatGPT·Codex 텍스트 출력에 보이지 않는 워터마크가 모든 요금제에 적용된다. API 고객은 같은 날부터 전 세계에서 일부 모델의 워터마크를 선택해 켤 수 있으며, API 출력에서는 기본값이 꺼짐이다. 클라우드 파트너를 통한 지원은 수주 뒤로 예고됐다. 출처

EU 이용자와 API 고객의 적용 방식이 다르다

EU의 대상 ChatGPT·Codex 출력에는 사용자가 별도로 설정하지 않아도 워터마크가 들어가는 방식이다. 발표는 ‘대상 출력’의 세부 모델 목록이나 계정별 적용 날짜를 공개하지 않았고, 수주에 걸친 순차 적용 범위만 밝혔다. EU 밖 ChatGPT·Codex 이용자에게 같은 자동 적용을 확대한다는 일정도 이번 공지에 포함되지 않았다. 출처

API에서는 전 세계 고객이 지원 모델을 골라 워터마크를 켜는 선택형 기능으로 시작한다. OpenAI는 일부 모델에서 제공한다고 밝혔지만, 공지 본문에는 모델별 설정 방법이 적혀 있지 않다. API 고객은 실제 계정과 문서에서 지원 모델과 활성화 옵션을 확인해야 한다. 출처

워터마크는 글의 단어 선택에 통계 신호를 남긴다

OpenAI가 textGrain이라고 부르는 기술은 사람이 볼 수 없는 통계 신호가 단어 선택에 나타나도록 생성 과정을 조정한다. 별도의 감지기는 입력된 글에 그 신호가 남아 있는지를 평가한다. OpenAI는 이 기술을 오픈소스로 공개할 계획도 밝혔다. 출처

감지기는 일반 공개 서비스로 시작하지 않는다. OpenAI는 연구자와 전문기관의 신청을 받아 사례별로 승인하며, 처음에는 승인된 이용자만 접근할 수 있다고 설명했다. 기존의 이미지·오디오 확인 도구인 openai.com/verify와 Content Provenance API는 계속 공개 상태로 운영된다. 출처

감지 수치는 글 길이와 편집 정도에 따라 달라진다

OpenAI는 오탐 목표를 1%로 설정한 평가에서 심리학 분야의 200토큰 글은 약 80%, 400토큰 글은 약 95%를 감지했다고 밝혔다. 토큰은 모델이 글을 처리할 때 나누는 단위다. 수학 분야에서는 감지 성능이 더 낮았으며, 짧은 글에서도 신호를 판별하기 어려워질 수 있다. 출처

편집은 감지율을 크게 낮췄다. 400토큰 글에서 단어의 10%를 바꿨을 때 감지율은 약 92%에서 66%로, 25%를 바꿨을 때는 17%로 내려갔다. 번역, 재작성, 글 길이와 지원 모델 여부도 결과에 영향을 줄 수 있다. 출처

검출 여부로 작성자나 진위를 판정할 수 없다

워터마크가 감지돼도 감지기는 사용자, 계정, 프롬프트, 대화 내용을 공개하지 않는다. 사람의 기여 비율, 글의 소유권이나 책임, 법적 사용 여부, 내용의 정확성도 판단하지 않는다. 결과가 양성이면 지원되는 OpenAI 모델의 출력에서 통계 신호가 발견됐다는 범위로 읽어야 한다. 출처

신호가 감지되지 않은 글도 사람이 직접 작성했다고 단정할 근거가 되지 않는다. 짧거나 편집·번역된 글, 지원되지 않는 모델의 출력, 워터마크 적용 전 텍스트, 다른 업체 모델의 결과가 포함될 수 있기 때문이다. OpenAI도 감지 결과만으로 게시자의 표시 의무나 법적 책임을 결정하지 않는다고 밝혔다. 출처