OpenAI가 유럽연합에서 운영되는 ChatGPT와 Codex의 출력 텍스트에 비가시 워터마크를 삽입하기로 확정했다. 이번 조치는 지난 8월 2일 발효된 EU AI법의 투명성 의무를 충족하기 위한 것이다. 공식 블로그 발표는 월요일에 이루어졌다.
해당 기술은 눈에 띄는 기호나 메타데이터를 추가하는 방식이 아니다. 대신 모델이 단어를 선택하는 미세한 패턴을 조정하여 워터마크 정보를 텍스트 자체에 내장한다. 인간 독자는 이를 식별할 수 없지만 전용 감지기는 패턴을 포착해 AI 생성 여부를 판별한다.
복사 및 붙여넣기 과정에서도 정보가 유지되는 것이 특징이다.
적용 범위는 단계적으로 확대된다. 향후 몇 주 동안 EU 지역 내 모든 요금제 사용자에게 순차적으로 롤아웃될 예정이다. 전 세계 API 개발자들은 오늘부터 특정 모델에서 이 기능을 활성화할 수 있다.
다만 기본 설정은 꺼져 있으며 OpenAI는 출시 시점에 글로벌 기본값으로 워터마킹을 적용하지 않겠다고 명시했다.
기술적 근거는 textGrain이라는 보고서로 공개되었다. 펜실베이니아 대학교와 예일 대학교 연구진과 공동 작성한 문서다. 비밀 키를 활용해 다음 단어 예측을 정렬하는 과정을 설명하며 이러한 미세 조정이 누적되면 감지기가 텍스트와 키만으로 AI 생성 내용을 판별할 수 있게 된다.
사용자 식별이나 성능 저하 우려는 현재 제기되지 않았다. OpenAI는 워터마크가 개인 정보를 포함하지 않으며 기능 활성화 시 모델 성능에 유의미한 변화가 없음을 확인했다고 밝혔다. 하지만 완전한 보안은 보장되지 않는다.
테스트 결과 일부 단어를 동의어로 교체하면 감지율이 떨어지는 것으로 나타났다.
결국 편집을 통한 제거 가능성은 남아 있다. 이는 법적 준수와 기술적 한계 사이의 간극을 보여준다. EU 외 지역의 적용 여부와 글로벌 기본값 변경 일정은 아직 미정이다.
