오픈AI가 챗GPT 글에 눈에 안 보이는 워터마크를 넣기로 했어요. 단, 무늬가 붙는 곳은 유럽연합(EU) 안이에요.
지난 #89에서 앤트로픽이 클로드 글에 몰래 무늬를 새긴다는 소식을 전해드렸죠. 그 뒤로 오픈AI도 같은 줄에 섰어요. 계기는 EU AI법이에요. AI가 만든 글을 기계가 알아볼 수 있게 하라는 규정이 8월 2일부터 적용되고 있거든요.
제목만 보면 "이제 AI 글은 다 잡히나?" 싶은데요. 발표문을 열어 보면 칸이 꽤 좁거든요.
챗GPT 워터마크는 EU 안에서만 켜져요
앞으로 몇 주에 걸쳐 EU의 챗GPT·코덱스 이용자에게 붙어요. 무료부터 유료까지 모든 요금제가 대상이고요.
API는 전 세계에 열리지만 기본값은 꺼짐이에요. 개발자가 일부 모델에서 직접 켜야 무늬가 생기는데, 어떤 모델인지는 발표문에 이름이 없고요.
오픈AI는 "출시 시점엔 전 세계 기본값으로 만들지 않는다"고 선을 그었어요. 지역별로 먼저 써보면서 반응을 보겠다는 거죠.
그러니까 한국에서 챗GPT 앱으로 뽑은 상품 설명은 이번 적용 범위 밖이에요. 다만 EU 이용자를 접속 위치로 가르는지, 계정 국가로 가르는지는 설명이 없어요.
단어 넷 중 하나를 바꾸면 탐지율이 17%예요
무늬를 넣는 방식, 이름은 '텍스트그레인'이에요. 모델이 단어를 고를 때 비밀 키로 살짝 방향을 틀거든요. 사람 눈엔 평범한 글인데, 탐지기는 그 통계 패턴을 읽어내죠.
오픈AI가 직접 공개한 시험 결과가 꽤 솔직한데요. 400토큰짜리 영어 글로 실험했대요.
- 손대지 않은 글: 약 92% 탐지
- 단어 10%를 동의어로 바꾼 글: 66%
- 단어 25%를 바꾼 글: 17%
단어 넷 중 하나만 갈아 끼워도 열에 여덟은 못 알아본다는 뜻이에요. 탐지기 입장에선 동의어 사전이 제일 무서운 책인 셈이죠.
짧은 글이나 수학 답처럼 단어 고를 폭이 좁은 글도 덜 잡힌다고 해요.
탐지기는 연구자 손에 먼저 가요
탐지기는 일반 공개가 아니에요. 승인받은 연구자와 전문기관만 신청할 수 있고, 건마다 심사하죠. 무늬를 놓치는 경우와 사람 글을 AI 글로 잘못 짚는 경우가 둘 다 생길 수 있어서래요.
무늬가 말해주지 않는 것도 발표문에 따로 정리돼 있어요.
- 누가 썼는지는 안 드러나요. 계정·프롬프트·대화와 연결되지 않아요
- 사람이 얼마나 고쳤는지는 못 재요
- 무늬가 없다고 사람이 썼다는 증거가 되지도 않아요
참고로 #89 때 다룬 클로드 워터마크는 지역 구분 없이 전 세계에 적용됐죠. 같은 법을 보고도 두 회사가 고른 범위가 이렇게 달라요.
이번 챗GPT 워터마크는 EU에서 먼저 켜보는 시험판이에요. 한국에서 챗GPT로 상품 설명 초안 뽑는 일은 어제처럼 이어가셔도 돼요!
— 발표문 맨 아래까지 스크롤한 보라