비즈니스 및 산업

오픈AI, EU AI법 대응해 챗GPT 텍스트에 보이지 않는 워터마크 도입

오픈AI가 EU AI법의 투명성 의무에 맞춰 챗GPT와 코덱스 텍스트에 보이지 않는 워터마크를 넣는다. 기술 이름은 textGrain이며, 회사 스스로 탐지율과 한계를 함께 밝혔다.

김민준김민준
인기 지수: 1,150
짙은 남색 배경 위 흐르는 텍스트에 심어진 옅은 디지털 워터마크 패턴

오픈AI가 생성한 텍스트에 보이지 않는 워터마크를 넣는다. EU AI법이 요구하는 '기계가 읽을 수 있는 식별'을 맞추기 위해서다. 다만 회사 스스로 이 기술을 "한계가 큰 초기 단계"라고 말한다.

오픈AI가 텍스트 워터마크를 도입하는 이유

오픈AI가 10월 5일 EU AI법 대응 방안을 공개했다. EU AI법은 생성형 AI 사업자에게 생성된 텍스트를 기계가 읽을 수 있는 방식으로 식별 가능하게 만들라고 요구한다. 이미지와 음성을 알아보는 도구는 이미 있었지만, 텍스트는 사정이 까다로웠다. 단어 순서 하나만 바꿔도 흔적이 흐트러지기 때문이다.

회사가 내놓은 답은 세 갈래다. 먼저 API 고객이 오늘부터 일부 모델에서 텍스트 워터마크를 선택적으로 켤 수 있다. 기본값은 꺼짐이다. 다음으로 몇 주 안에 EU 지역의 챗GPT와 코덱스 텍스트 출력에 보이지 않는 워터마크를 붙인다. 마지막으로 워터마크 탐지기 사용 신청을 받는데, 처음에는 기술을 검증할 연구자와 전문 기관으로 대상을 좁힌다.

textGrain은 어떻게 작동하는가

기술 이름은 텍스트그레인(textGrain)이다. 모델이 단어를 고르는 과정에 보이지 않는 통계적 신호를 심고, 탐지기가 그 신호를 찾아내는 방식이다. 오픈AI는 자체 평가에서 텍스트그레인이 구글의 SynthID for text를 포함해 시험한 다른 접근을 앞서거나 비슷했다고 밝혔다.

주목할 대목은 성능 수치보다 한계를 먼저 밝힌다는 점이다. 오픈AI는 텍스트 워터마크와 탐지가 "한계가 큰 초기 기술"이라고 적었다. 이상적인 조건의 좋은 성적이 일상적인 상황의 안정적인 탐지를 보장하지는 않는다는 것이다.

회사는 이 기술을 오픈소스로 공개할 계획도 밝혔다. 다른 곳이 위에 얹어 발전시킬 수 있게 하겠다는 구상이다.

워터마크가 실제로 무엇을 알려주는가

워터마크의 의미를 정확히 잡고 가자. 탐지기가 신호를 찾으면 "이 문단에 오픈AI 모델의 워터마크가 있다"까지는 말할 수 있다. 반대로 신호가 없다고 해서 사람이 쓴 글이라고 단정할 수는 없다. 문장을 고치거나 다른 도구를 거치면 신호가 약해지거나 사라진다.

그래서 오픈AI의 표현이 중요하다. 이건 출처를 알려주는 보조 신호지, 판정 도구가 아니다. 학교나 회사에서 "AI가 쓴 글을 잡아내겠다"는 용도로 쓰기엔 아직 무리다.

API 고객과 일반 사용자에게 달라지는 것

API로 서비스를 만드는 개발자라면 선택권이 생겼다. 원하면 워터마크를 켜서 자사 출력물에 출처 신호를 붙일 수 있다. 기본값이 꺼짐이라는 건, 대부분은 당장 달라지는 게 없다는 뜻이다.

EU에 사는 챗GPT·코덱스 사용자는 조금 다르다. 몇 주 안에 텍스트 출력에 워터마크가 붙지만, 사용자는 눈으로 볼 수 없고 체감할 변화도 없다. 문장이 조금 달라질 수 있다는 정도가 전부다.

워터마크 탐지기 접근은 당분간 일반에 열리지 않는다. 연구자와 기관이 먼저 쓴다. 내가 만든 글에 워터마크가 붙었는지 직접 확인하고 싶어도, 지금은 방법이 없다.

왜 지금, 왜 EU인가

EU AI법의 투명성 의무가 배경이다. 생성형 AI 사업자는 생성물을 기계가 식별할 수 있게 하라는 요구가 이미 발효됐고, 오픈AI는 이에 맞춰 단계적으로 워터마크를 도입한다. 규제가 기술 도입의 방아쇠를 당긴 셈이다.

같은 이유로 경쟁사들도 움직이고 있다. 앤트로픽도 자사 모델 출력에 텍스트 워터마크를 적용한 것으로 알려졌다. 생성 텍스트의 출처 표시가 업계 표준으로 자리 잡아가는 흐름이다.

앞으로 지켜볼 것

관건은 실전 성능이다. 이상 조건의 80~95%와 실제 사용 환경의 탐지율은 다르다. 오픈소스 공개와 연구자 검증이 진행되면 이 격차가 드러날 것이다.

또 하나는 남용 가능성이다. 워터마크가 있다고 해서 AI 글을 완벽히 가려낼 수는 없고, 없다고 해서 사람 글로 단정할 수도 없다. 지금 단계의 텍스트 워터마크는 "무엇인지 알려주는 힌트"에 가깝지, 판결문이 아니다.

이 소식 공유하기

출처

관련 AI 뉴스

수식과 기하 도형이 정형 증명 검사기 격자로 흘러드는 일러스트, 차분한 남보라와 흰색
연구

오픈AI, 이름 없는 모델로 수학 논문 722편 공개

오픈AI가 미공개 내부 모델이 만든 수학 논문 722편을 깃허브에 공개했다. 린 형식화를 함께 올렸지만 외부 검증은 아직 이뤄지지 않았고, 모델 이름과 가격, API는 공개되지 않았다.

인기 지수: 1,500
생성된 이미지 옆에 명확히 표시된 작은 광고 패널이 붙은 깔끔한 UI
AI 제품

챗GPT 이미지 생성에 시각 광고 시험 들어간다

오픈AI가 챗GPT 이미지 생성 안에 시각 광고를 시험한다. 광고는 명확히 표시되고 생성 이미지와 분리되며, 답변에 영향을 주지 않는다고 회사는 밝혔다. 미국에서 이번 달 말 시작한다.

인기 지수: 1,100
데이터 유출 경고를 상징하는, 비어 있는 사무실 의자를 표현한 이미지
비즈니스 및 산업

오픈AI, 안전 연구원 3명 해고: 기밀 공유 논란 정리

오픈AI가 민감 정보를 다룬 방식 때문에 안전 연구원 3명을 해고했다고 확인했다. 보도에 따르면 이들은 외부 AI 안전 단체와 데이터를 공유했다. 이미 압박을 받던 회사에 겹친 한 주였다.

인기 지수: 1,150
챗GPT 닷츠(dots)란? 시키지 않아도 일하는 상시 작동 AI 에이전트
AI 제품

챗GPT 닷츠(dots)란? 시키지 않아도 일하는 상시 작동 AI 에이전트

오픈AI가 챗GPT와 슬랙, 팀즈에서 스스로 움직이는 상시 작동 에이전트 닷츠(dots)를 공개했다. 일정과 맥락을 읽고 먼저 일을 처리하지만 로그인과 결제는 여전히 사람 몫이다.

인기 지수: 1,200