오픈AI EU 텍스트 워터마크, 탐지율 92%→단어 10% 바꾸면 66%

무슨 일이
오픈AI가 자체 실험에서 새 텍스트 워터마크 '텍스트그레인(textGrain)'의 탐지율을 약 92%로 제시했지만, 단어 10%를 동의어로 바꾸면 약 66%로 떨어졌다. 오픈AI는 5일(현지시간) EU 인공지능법(AI Act)의 투명성 규정을 맞추기 위해 앞으로 몇 주에 걸쳐 EU 내 챗GPT와 코덱스 출력물에 눈에 보이지 않는 워터마크를 넣겠다고 밝혔다. API 개발자는 전 세계 어디서나 일부 모델에 한해 직접 켤 수 있지만 기본값은 꺼짐이며, 출시 시점에 전 세계 기본값으로 삼지는 않는다. 탐지기는 당분간 승인된 연구자와 전문 기관에만 제공된다.
확인된 사실
- 오픈AI는 텍스트그레인이 모델의 단어 선택을 미세하게 조정해 탐지기가 읽을 수 있는 통계적 패턴을 남기며, 이 패턴은 글을 복사해 붙여 넣어도 유지된다고 밝혔다(테크크런치·엔가젯).
- 테크크런치에 따르면 오픈AI 실험에서 단어 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로 낮아졌다. 짧은 글, 수학 답안, 번역문은 탐지가 더 어렵다고 오픈AI는 밝혔다.
- 엔가젯은 짧은 텍스트의 탐지 성공률이 80% 안팎이며, 오픈AI가 다른 개발자들이 수정해 쓸 수 있도록 이 기술을 오픈소스로 공개할 계획이라고 전했다.
- 워터마크는 EU의 해당 챗GPT·코덱스 이용자에게만 기본 적용된다. API는 일부 모델에서 선택 적용하는 방식이며 기본값은 꺼짐이다(테크크런치·엔가젯).
- 오픈AI는 워터마크가 이용자를 식별하지 않고, 워터마크가 없다고 해서 "사람이 썼다는 증거는 아니다"라고 밝혔다(테크크런치). 테크크런치는 앞서 약 두 달 전 앤스로픽이 클로드 텍스트에 전 세계 대상 워터마크를 적용하겠다고 발표했다고 덧붙였다.
아직 모르는 것
- 적용 시점에 대해 두 매체의 설명이 다르다. 테크크런치는 AI Act 투명성 규정이 8월 2일 발효됐다고 했고, 엔가젯은 기존 사업자의 준수 기한이 12월 2일이라고 했다. 둘 다 법 조문을 인용하지는 않았다.
- API에서 어떤 모델이 워터마크를 지원하는지는 공개되지 않았다.
- 92%라는 수치가 오픈AI 자체 시험 밖에서도 유지되는지는 검증되지 않았다. 오픈AI도 이상적 조건에서의 성능이 일상적 탐지의 신뢰도를 보장하지는 않는다고 밝혔다.
- 탐지기가 승인된 연구자에게만 제공돼 오탐·미탐 비율을 외부에서 독립적으로 확인할 수 없다.
- EU 밖으로 확대할지는 알려지지 않았다. 테크크런치는 이용자가 워터마크를 쓰지 않는 경쟁사로 옮겨 갈 것을 우려해 오픈AI가 2024년 이전에 텍스트 워터마크 공개를 미뤘다는 월스트리트저널 보도를 전했다.
왜 중요한가
EU 규정은 AI 생성 텍스트에 기계가 읽을 수 있는 표시를 요구하지만, 오픈AI 자체 수치로도 가벼운 편집만으로 표시가 약해진다. 탐지에 기대려던 출판사, 학교, 규제 당국은 편집하지 않은 출력물에는 통하는 신호를 얻지만, 오픈AI는 이것이 사람이 썼다는 증명은 아니라고 선을 그었고 탐지기는 당분간 승인된 연구자만 쓸 수 있다.
주장
- 확인됨오픈AI는 EU 내 챗GPT와 코덱스 텍스트 출력물에 눈에 보이지 않는 텍스트그레인 워터마크를 넣을 예정이다.
- 확인됨오픈AI 실험에서 단어 10%를 동의어로 바꾸자 워터마크 탐지율이 약 92%에서 66%로 떨어졌다.
- 확인됨API 개발자에게 워터마크는 기본값이 꺼짐이며, 일부 모델에서 직접 켤 수 있다.
- 확인됨탐지기는 처음에는 승인된 연구자와 전문 기관에만 제공된다.
- 미확인짧은 텍스트의 탐지 성공률은 약 80%다.
- 미확인오픈AI는 텍스트그레인 기술을 오픈소스로 공개할 계획이다.
- 미확인EU AI Act의 투명성 규정은 8월 2일 발효됐다.
- 미확인기존 AI 사업자의 AI Act 제50조 준수 기한은 12월 2일이다.
관련 기사
이 기사를 믿어도 되는 이유
63%출처 지도 · 매체 2곳 / 기사 2건
- TechCrunch
- 기사 1techcrunch.comreport
- Engadget
- 기사 1engadget.comreport
신뢰도 점수 산정 방식
- 출처 신뢰도
- 교차 확인
- 1차 출처
- 본문 대조 검증 주장
- 반대 증거 없음
- 안정화
- 출처 표기
- AI 공개
본문 대조 검증 주장은 인용 출처 본문과 atom 단위로 일치함. 가중치는 고정, 설명 가능함.
사람 책임성
- 독립 출처 그룹 2개 / 출처 2개
- Drafted by the Newsmesis judgment agent (agent-cli); human approval required before publishing.
검증 장부 · 8
- 주장: 오픈AI는 EU 내 챗GPT와 코덱스 텍스트 출력물에 눈에 보이지 않는 텍스트그레인 워터마크를 넣을 예정이다.상태: 확인됨검증 경로검증됨검증자 검증 시스템
추출된 atom 하나 이상이 인용 출처 본문과 일치 확인됨.
- 주장: 오픈AI 실험에서 단어 10%를 동의어로 바꾸자 워터마크 탐지율이 약 92%에서 66%로 떨어졌다.상태: 확인됨검증 경로검증됨검증자 검증 시스템
추출된 atom 하나 이상이 인용 출처 본문과 일치 확인됨.
- 주장: API 개발자에게 워터마크는 기본값이 꺼짐이며, 일부 모델에서 직접 켤 수 있다.상태: 확인됨검증 경로검증됨검증자 검증 시스템
추출된 atom 하나 이상이 인용 출처 본문과 일치 확인됨.
- 주장: 탐지기는 처음에는 승인된 연구자와 전문 기관에만 제공된다.상태: 확인됨검증 경로검증됨검증자 검증 시스템
추출된 atom 하나 이상이 인용 출처 본문과 일치 확인됨.
- 주장: 짧은 텍스트의 탐지 성공률은 약 80%다.상태: 미확인검증 경로미검증검증자 검증 시스템
출처 본문 기준 atom 단위 검증 없음.
- 주장: 오픈AI는 텍스트그레인 기술을 오픈소스로 공개할 계획이다.상태: 미확인검증 경로미검증검증자 검증 시스템
출처 본문 기준 atom 단위 검증 없음.
- 주장: EU AI Act의 투명성 규정은 8월 2일 발효됐다.상태: 미확인검증 경로미검증검증자 검증 시스템
출처 본문 기준 atom 단위 검증 없음.
- 주장: 기존 AI 사업자의 AI Act 제50조 준수 기한은 12월 2일이다.상태: 미확인검증 경로미검증검증자 검증 시스템
출처 본문 기준 atom 단위 검증 없음.
업데이트 로그 · 0
AI는 가속, 승인은 사람.