한국의 개발자·서비스 운영자는 API에서 텍스트 워터마크를 선택할 수 있지만, ChatGPT·Codex의 자동 적용은 당분간 EU에 한정됩니다. OpenAI는 2026년 10월 5일 textGrain을 발표했습니다. AI가 만든 글에 통계 신호를 넣는 기술이며, 탐지 결과만으로 글쓴이나 책임을 판정하는 기능은 아닙니다. (공식 발표)

한눈에 보기

궁금한 점 이번 발표의 핵심
무엇을 표시합니까? 모델의 단어 선택에 보이지 않는 통계 신호를 넣습니다.
한국 API에서도 쓸 수 있습니까? 전 세계 API 고객이 일부 모델에서 선택 적용할 수 있습니다. 기본값은 꺼짐입니다.
ChatGPT·Codex는 언제 적용됩니까? EU에서 모든 요금제의 적격 텍스트 출력에 향후 몇 주 동안 순차 적용할 예정입니다.
클라우드 파트너 경로는 어떻습니까? 향후 몇 주 내 지원을 추진한다고 발표했습니다.
누구나 텍스트를 검사할 수 있습니까? 초기 탐지기는 승인된 연구자·전문 기관에 사례별로 제공됩니다.
대상 모델과 비용은 어디서 봅니까? 대상 모델은 API 설정 화면에서 확인합니다. 별도 워터마크 요금은 발표·도움말에서 미확인입니다.
미검출이면 사람이 쓴 글입니까? 짧은 글·편집·번역·미지원 모델 등으로 신호를 놓칠 수 있습니다.

제공 일정과 기능은 공식 발표·도움말을, 작동 원리는 기술 보고서를 따릅니다. 아래 탐지율과 품질 비교는 OpenAI 자체 평가이며 독립 검증과 구분합니다. 확인일은 2026년 10월 6일입니다. (도움말 · 기술 보고서)

textGrain은 글에 무엇을 넣습니까?

텍스트 워터마크는 생성한 문장의 표현에 남기는 통계적 패턴입니다. 모델은 다음에 올 단어나 단어 조각, 즉 토큰을 여러 후보 중에서 고릅니다. textGrain은 비밀 키와 앞선 문맥을 이용해 이 선택에 패턴을 만들고, 탐지기는 같은 키로 우연보다 자주 나타나는 패턴인지 검사합니다. (기술 보고서)

쉽게 말하면 글 끝에 도장을 붙이는 방식이 아니라, 글을 만드는 순간 표현의 선택에 흔적을 남깁니다. 숨은 문자·공백·특이한 문장부호나 워터마크 전용 토큰을 추가하지 않는다고 도움말은 설명합니다. 따라서 문서 편집기에서 보이지 않는 글자를 지우는 기능과는 관계가 다릅니다. (작동 방식 도움말)

기술 보고서는 탐지 신호와 표현의 다양성 사이의 균형을 다룹니다. 신호를 강하게 만들면서 같은 질문에 여러 표현을 생성할 여지를 얼마나 남길지 조절하는 설계입니다. 수학적 설명은 가정을 둔 생성·탐지 절차의 근거이며, 실제 편집 과정에서의 신호 유지 여부는 별도의 검증 대상입니다. (기술 보고서)

제공 범위와 이용 조건은 한국과 EU에서 어떻게 다릅니까?

이용 경로 2026년 10월 6일 기준 제공 상태 운영자가 확인할 점
OpenAI API 전 세계 고객에게 일부 모델의 선택 적용 시작 기본 꺼짐, 모델별 지원 여부
EU ChatGPT 모든 요금제의 적격 텍스트에 향후 몇 주 내 순차 적용 예정 실제 계정의 적용 시점·출력 조건
EU Codex 같은 지역·요금제 범위로 순차 적용 예정 모든 출력이 탐지 가능한 것은 아니라는 점
한국 ChatGPT·Codex 이번 발표의 자동 적용 지역에 포함되지 않음 글로벌 기본 적용으로 오해하지 않기
클라우드 파트너 서비스 향후 몇 주 내 지원 예정 해당 파트너의 별도 지원 안내

위 지역·일정은 공식 발표의 구분입니다. OpenAI는 출시 시점에 텍스트 워터마크를 전 세계 기본값으로 만들지 않으며, 지역을 EU로 좁힌 이유를 실제 사용과 피드백에서 배울 여지를 두기 위해서라고 설명했습니다. 도움말은 EU ChatGPT 텍스트의 워터마크를 현재형으로 설명하지만, 출시 발표는 순차 적용을 예고합니다. 실제 계정별 완료 시점은 순차 적용 일정과 함께 확인할 항목입니다.

한국에서 서비스의 답변에 출처 신호를 남기려는 API 운영자는 지원 모델의 설정을 확인할 수 있습니다. 반면 한국 ChatGPT 이용자가 이번 발표만 보고 자신의 모든 답변에 워터마크가 들어갔다고 판단할 근거는 부족합니다. EU를 대상으로 서비스를 제공한다면 API 설정과 서비스의 공개 표시 방식을 각각 검토하는 편이 도입 판단에 도움이 됩니다.

API에서 켜려면 어떤 설정을 바꿉니까?

공식 도움말은 요청별 코드 파라미터 대신 조직·프로젝트 설정 경로를 안내합니다. 조직 기본값은 Organization settings → Data controls → Text provenance, 프로젝트별 재정의는 Project Settings → Text provenance입니다. Allow text watermarking을 켜고 대상 모델을 선택한 뒤 Save를 누릅니다. 지원 모델에서는 이후 텍스트 생성 중 신호를 넣으므로 응답마다 별도의 표시를 삽입하는 절차는 요구하지 않습니다. (API 설정 도움말)

대상 모델의 고정 목록은 해당 설정 화면에서 확인하도록 안내돼 있습니다. 발표의 Astra 품질 평가는 성능 자료이고, 실제 활성화 가능한 모델 목록은 설정 화면의 지원 정보입니다. 도입 시에는 사용할 프로젝트·모델의 지원 여부와 실제 저장한 설정을 함께 확인하면 적용 범위를 분명히 할 수 있습니다.

실무에서는 글을 어느 단계에서 고치는지도 중요합니다. 생성 직후 답변과 번역·요약을 거친 최종 게시문이 다르면 신호도 달라질 수 있습니다. 원문과 최종본을 구분해 관리하고, 텍스트 탐지 접근이 승인된 조직이라면 대표 편집 과정을 거친 결과를 비교하는 것이 가능한 검증 경로입니다. (변환 후 신호 안내)

비용·요금은 얼마이며 탐지기도 함께 제공됩니까?

워터마크를 켜는 데 붙는 별도 요금, 텍스트 탐지 가격, 구체적인 API 요청 설정은 발표에서 미확인입니다. 도움말에는 설정 화면의 활성화 방법이 안내돼 있고, 별도 워터마크 단가는 미공개입니다. 도입 비용을 계산할 때는 사용할 모델의 기본 이용료와 함께 워터마크 추가 과금 여부를 확인할 항목으로 남길 수 있습니다. (공식 발표 · API 설정 도움말)

생성에 워터마크를 켜는 권한과 탐지기 접근은 별개입니다. OpenAI는 10월 5일부터 신청을 받되 초기에는 승인된 연구자·전문 기관에 사례별로 제공한다고 밝혔습니다. 탐지기는 OpenAI 워터마크를 탐지했는지만 알려 주고 사용자·프롬프트·대화는 드러내지 않습니다. OpenAI는 놓친 워터마크와 거짓 양성 위험 때문에 출시 시점에는 일반 공개하지 않는다고 밝혔습니다. 고객이 붙여 넣은 글을 검사하는 서비스를 구상한다면 생성 설정 외에 탐지기 접근 승인이 도입 조건으로 남습니다. (탐지기 접근 발표)

이미지·오디오용 공개 검증 도구와 Content Provenance API는 계속 공개됩니다. 이 경로를 텍스트 탐지기의 일반 공개로 혼동하면 도입 가능 범위를 잘못 계산하게 됩니다. textGrain 오픈소스 공개도 계획으로 발표됐으며 일정은 미정입니다. 기술 보고서 역시 앞으로 몇 주 안에 세부 내용을 보강한다고 예고됐습니다. (공식 발표)

탐지율은 어느 조건에서 높고 편집하면 얼마나 달라집니까?

거짓 양성은 워터마크 없는 글을 있다고 판정하는 오류이고, 거짓 음성은 있는 신호를 놓치는 오류입니다. 거짓 양성 목표 1%는 특정 시험 조건의 기준으로, 개별 탐지 결과가 99% 확실하다는 뜻과 다릅니다.

OpenAI의 ELI5 질문 답변 평가에서 심리학 분야의 탐지율은 200토큰 약 80%, 400토큰 약 95%였습니다. 수학처럼 표현 선택이 좁은 분야는 더 낮았습니다. 별도의 영어 400토큰 편집 시험에서는 동의어로 10%를 바꾸자 약 92%에서 66%, 25%를 바꾸자 17%로 내려갔습니다. (탐지·편집 평가)

두 시험의 95%와 92%는 각각 조건이 다른 결과이므로 별도로 읽습니다. 토큰 수는 글자 수나 한국어 단어 수와 같지 않으며, 한국어 안내문·코드의 탐지율은 별도의 확인 대상입니다. 짧은 답변이나 정확한 표현이 중요한 결과를 많이 제공하는 서비스라면 긴 설명문과 구분해 샘플을 준비할 수 있습니다.

OpenAI는 시험한 SynthID 등 접근법과 비교해 textGrain이 동등하거나 높은 성능을 보였다고 주장합니다. 이는 회사의 비교 평가이며, 일상적인 재작성·번역까지 거친 글의 신뢰성과 독립 검증은 별도로 살펴볼 문제입니다. (비교 평가와 한계)

워터마크를 켜면 모델 품질이 달라집니까?

아래는 OpenAI가 최신 최상위 모델이라고 소개한 Astra를 max 설정으로 돌린 적용 전후 자체 평가입니다. 다른 모델의 품질 비교는 발표에 없습니다. Artificial Analysis 이름이 붙은 지표도 이 표에서는 OpenAI가 보고한 결과입니다. (품질 비교 원문)

평가 적용 전 적용 후
Artificial Analysis Intelligence Index 49.57점 49.76점
AutomationBench 34.09% 34.86%
DeepSWE v1.1 72.80% 71.68%
Terminal-Bench 4.0 53.90% 56.06%
Terminal-Bench Science 0.1 56.90% 60.00%
BrowseComp 87.92% 87.35%
HealthBench Professional 64.27% 64.60%
GPQA Diamond 94.44% 93.94%

점수는 위아래로 움직이며 OpenAI는 유의미한 성능 차이가 없다고 해석합니다. 이 결과는 워터마크를 켜면 성능이 향상된다는 증거와 다릅니다. 도입 판단에서는 품질 저하를 살피는 자료로 참고하고, 자신의 한국어 결과물·편집 과정에서는 별도로 품질을 확인하는 것이 실용적입니다.

EU 규정의 표시 의무를 워터마크 하나로 충족합니까?

EU 집행위 자료에 따르면 AI Act Article 50의 해당 투명성 의무는 2026년 8월 2일부터 적용됩니다. 생성형 AI 제공자의 기계 판독 가능한 표시·탐지 의무와, 공개 관심사에 관한 AI 생성·조작 텍스트를 게시하는 배포자의 표시 의무를 구분합니다. 후자는 사람의 검토와 편집 책임을 거친 게시물에 대한 예외도 설명합니다. (EU 집행위 안내)

이 행동강령 참여는 자발적이지만 관련 법적 의무까지 자발적인 것은 아닙니다. OpenAI가 API 워터마크를 기본 꺼짐으로 두고 고객이 켜게 한 것도 고객이 자신의 투명성 의무와 서비스 경험에 맞춰 정하라는 취지라고 발표는 설명합니다. EU 이용자에게 OpenAI API 기반 서비스를 제공한다면 이 설정을 켤지는 운영자가 직접 판단할 항목입니다. 보이지 않는 신호를 넣는 일과 독자에게 AI 이용을 알리는 일은 각각 다루는 문제입니다. 이 내용은 EU 규정 맥락이며 한국의 모든 ChatGPT·Codex 출력에 같은 자동 적용이 시작됐다는 뜻으로 연결되지 않습니다. (EU 집행위 안내)

탐지 결과로 글쓴이·소유권·책임을 판단할 수 있습니까?

워터마크는 OpenAI 모델이 글의 생성·처리에 관여했을 가능성을 보여 주는 제한된 신호입니다. 사람의 기여도, 소유권·책임, 정확성이나 적법성을 판정하지 않으며 사용자·조직·계정·프롬프트·대화를 식별하지 않습니다. 미검출도 인간 작성의 증거가 아닙니다. (탐지 결과의 의미)

예를 들어 사람이 쓴 초안을 AI가 다듬은 경우와 AI 초안을 사람이 크게 고친 경우는 기여 과정이 다릅니다. 탐지 여부 하나만으로 이 차이를 복원하기 어렵습니다. 서비스 운영자는 결과 화면에 “OpenAI 워터마크 신호 탐지”처럼 확인한 범위를 표시하고, “작성자 확인”이나 “내용 검증 완료”와는 구분해 설명할 수 있습니다. 이는 신호의 제한된 의미를 이용자에게 전달하기 위한 설계 제안입니다.

반응 (2026년 10월 6일 기준)

공개된 사용자 반응은 아직 확인되지 않았습니다.

참고한 자료

모두 2026년 10월 6일 확인했습니다.