오픈AI가 생성한 텍스트에 보이지 않는 워터마크를 넣는다. EU AI법이 요구하는 '기계가 읽을 수 있는 식별'을 맞추기 위해서다. 다만 회사 스스로 이 기술을 "한계가 큰 초기 단계"라고 말한다.
오픈AI가 텍스트 워터마크를 도입하는 이유
오픈AI가 10월 5일 EU AI법 대응 방안을 공개했다. EU AI법은 생성형 AI 사업자에게 생성된 텍스트를 기계가 읽을 수 있는 방식으로 식별 가능하게 만들라고 요구한다. 이미지와 음성을 알아보는 도구는 이미 있었지만, 텍스트는 사정이 까다로웠다. 단어 순서 하나만 바꿔도 흔적이 흐트러지기 때문이다.
회사가 내놓은 답은 세 갈래다. 먼저 API 고객이 오늘부터 일부 모델에서 텍스트 워터마크를 선택적으로 켤 수 있다. 기본값은 꺼짐이다. 다음으로 몇 주 안에 EU 지역의 챗GPT와 코덱스 텍스트 출력에 보이지 않는 워터마크를 붙인다. 마지막으로 워터마크 탐지기 사용 신청을 받는데, 처음에는 기술을 검증할 연구자와 전문 기관으로 대상을 좁힌다.
textGrain은 어떻게 작동하는가
기술 이름은 텍스트그레인(textGrain)이다. 모델이 단어를 고르는 과정에 보이지 않는 통계적 신호를 심고, 탐지기가 그 신호를 찾아내는 방식이다. 오픈AI는 자체 평가에서 텍스트그레인이 구글의 SynthID for text를 포함해 시험한 다른 접근을 앞서거나 비슷했다고 밝혔다.
주목할 대목은 성능 수치보다 한계를 먼저 밝힌다는 점이다. 오픈AI는 텍스트 워터마크와 탐지가 "한계가 큰 초기 기술"이라고 적었다. 이상적인 조건의 좋은 성적이 일상적인 상황의 안정적인 탐지를 보장하지는 않는다는 것이다.
회사는 이 기술을 오픈소스로 공개할 계획도 밝혔다. 다른 곳이 위에 얹어 발전시킬 수 있게 하겠다는 구상이다.
워터마크가 실제로 무엇을 알려주는가
워터마크의 의미를 정확히 잡고 가자. 탐지기가 신호를 찾으면 "이 문단에 오픈AI 모델의 워터마크가 있다"까지는 말할 수 있다. 반대로 신호가 없다고 해서 사람이 쓴 글이라고 단정할 수는 없다. 문장을 고치거나 다른 도구를 거치면 신호가 약해지거나 사라진다.
그래서 오픈AI의 표현이 중요하다. 이건 출처를 알려주는 보조 신호지, 판정 도구가 아니다. 학교나 회사에서 "AI가 쓴 글을 잡아내겠다"는 용도로 쓰기엔 아직 무리다.
API 고객과 일반 사용자에게 달라지는 것
API로 서비스를 만드는 개발자라면 선택권이 생겼다. 원하면 워터마크를 켜서 자사 출력물에 출처 신호를 붙일 수 있다. 기본값이 꺼짐이라는 건, 대부분은 당장 달라지는 게 없다는 뜻이다.
EU에 사는 챗GPT·코덱스 사용자는 조금 다르다. 몇 주 안에 텍스트 출력에 워터마크가 붙지만, 사용자는 눈으로 볼 수 없고 체감할 변화도 없다. 문장이 조금 달라질 수 있다는 정도가 전부다.
워터마크 탐지기 접근은 당분간 일반에 열리지 않는다. 연구자와 기관이 먼저 쓴다. 내가 만든 글에 워터마크가 붙었는지 직접 확인하고 싶어도, 지금은 방법이 없다.
왜 지금, 왜 EU인가
EU AI법의 투명성 의무가 배경이다. 생성형 AI 사업자는 생성물을 기계가 식별할 수 있게 하라는 요구가 이미 발효됐고, 오픈AI는 이에 맞춰 단계적으로 워터마크를 도입한다. 규제가 기술 도입의 방아쇠를 당긴 셈이다.
같은 이유로 경쟁사들도 움직이고 있다. 앤트로픽도 자사 모델 출력에 텍스트 워터마크를 적용한 것으로 알려졌다. 생성 텍스트의 출처 표시가 업계 표준으로 자리 잡아가는 흐름이다.
앞으로 지켜볼 것
관건은 실전 성능이다. 이상 조건의 80~95%와 실제 사용 환경의 탐지율은 다르다. 오픈소스 공개와 연구자 검증이 진행되면 이 격차가 드러날 것이다.
또 하나는 남용 가능성이다. 워터마크가 있다고 해서 AI 글을 완벽히 가려낼 수는 없고, 없다고 해서 사람 글로 단정할 수도 없다. 지금 단계의 텍스트 워터마크는 "무엇인지 알려주는 힌트"에 가깝지, 판결문이 아니다.






