Pulse 게시 ·

OpenAI 텍스트 워터마크 시험, 단어 10% 교체 시 탐지율 92%→66%

TechCrunch에 따르면 OpenAI의 textGrain 시험에서 단어 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로 낮아졌다. 회사는 짧은 글·수학 답변·번역문도 탐지가 어렵다고 설명했다. 초기 탐지기 접근은 승인된 연구자·전문 기관에만 제공하며, 워터마크 부재가 사람의 작성 사실을 입증하지는 않는다고 밝혔다.

textGrain은 모델의 단어 선택에 통계적 패턴을 남기며, 탐지기는 텍스트와 비밀 키를 이용해 이를 식별한다.

워터마크가 단어 자체에 담기므로 복사·붙여넣기 후에도 패턴이 따라간다는 회사 설명이다.

편집으로 탐지율이 낮아질 수 있으며, 보고된 92%→66% 수치는 단어 10%를 동의어로 교체한 한 시험의 결과다.

탐지기 초기 접근 제한은 신뢰성과 사용 방식을 평가하기 위한 조치라고 OpenAI는 설명했다.

EU ChatGPT·Codex에는 앞으로 몇 주간 순차 적용할 예정이며, API에서는 일부 모델에 선택적으로 켤 수 있고 기본값은 꺼짐이다.

워터마크가 잡혀도 글에 들어간 사람의 판단·편집·창작 비중까지 산정할 수는 없다.

원문

앞선 소식 보기