
모델이 생성한 글에 사람 눈에 보이지 않는 통계적 표시를 심어 출처를 확인하게 만드는 기법입니다. 심는 비용은 낮고 지우는 비용도 낮아서, 탐지 결과가 법적 증거로 쓰일 수 있는 범위가 좁습니다.
용어 자세히 보기
오픈AI가 한국 시각 10월 6일 0시께 EU AI 법의 생성물 표시 의무에 맞춘 텍스트 워터마크 계획을 발표했습니다.
앞으로 몇 주 안에 EU 지역의 ChatGPT와 Codex 출력 가운데 대상이 되는 글에 보이지 않는 워터마크를 넣고, API 고객은 이날부터 전 세계에서 선택해 켤 수 있습니다(기본값은 꺼짐).
워터마크 기술 textGrain은 모델의 단어 선택에 통계 신호를 심는 방식이며, 탐지기는 승인받은 연구자와 전문 기관에 먼저 엽니다.
Choi
오픈AI 평가에서 거짓 양성률 1% 기준 탐지율은 심리학 주제 400토큰 글에서 약 95%, 200토큰 글에서 약 80%였고, 400토큰 글의 단어 10%를 동의어로 바꾸면 약 92%에서 66%로, 25%를 바꾸면 17%로 떨어졌습니다. 오픈AI는 워터마크가 탐지되지 않았다고 해서 사람이 썼다는 증거가 되지는 않는다고 밝혔습니다.
아티클6분AI
아티클AI

딥마인드가 한국 시각 10월 1일 SynthID Bio를 공개하고 논문을 네이처에 실었습니다.
단백질 서열을 만들 때 아미노산 선택을 미세하게 유도해 표시를 남기고, AlphaFold 3의 확산 신경망 일부를 미세조정해 예측한 3차원 좌표에도 표시를 남깁니다.
VEGF-A와 코로나19 스파이크 RBD, PD-L1 세 표적을 상대로 한 습식 실험에서 표시를 넣은 설계는 결합 성공률과 친화도, 서열 다양성이 표시 없는 설계와 같았습니다.
Choi
구조 워터마크는 거짓 양성 0.1% 기준에서 검출률 99.8%를 넘었습니다. 딥마인드는 DNA 합성 업체가 주문받은 서열이 안전장치를 갖춘 모델에서 나왔는지 자동으로 가려내도록 도구와 모델 자료를 함께 풀었습니다.
앤트로픽 엔지니어 Thariq가 워터마크 작동 방식을 쉽게 설명한 자료를 공개했습니다.
Claude가 생성하는 문장에 별도 표시를 붙이는 방식 대신, 다음 단어를 고를 때 사용하는 무작위 선택 규칙에 특정 패턴을 넣는 방식입니다.
Choi
표시를 문장 밖에 덧붙이지 않고 단어 선택 규칙에 패턴을 심기 때문에, 글을 읽어서는 흔적이 보이지 않습니다.
Google이 Gemini와 Flow에서 눈에 보이는 워터마크를 켜고 끌 수 있는 기능을 순차적으로 적용하고 있습니다.
Nano Banana 이미지, Omni 영상, Lyria 음악에 적용되며 법적으로 워터마크가 필요한 국가는 제외됩니다.
다만 눈에 보이는 워터마크를 꺼도 AI 생성 여부를 확인할 수 있는 SynthID와 C2PA 메타데이터는 그대로 유지됩니다.
Choi
보이는 표식을 끄게 하면서 숨은 표식은 남기는 절충입니다. 보이는 워터마크를 꺼도 SynthID와 C2PA 메타데이터가 남아, 생성 여부는 검증 도구로 확인합니다.
EU AI 법에 따른 조치지만 전 세계에 적용됩니다.
워터마크는 텍스트 자체의 일부라, 복사해서 붙여넣어도 따라가고 일부 편집을 해도 살아남습니다.
8월 2일 이후 출시된 모델부터 적용됩니다.
Sonnet 5 가격 인상을 취소한 데 이어, 이번에는 사용자 경험을 스스로 깎아내리는 발표를 했습니다.
Choi
EU AI 법이 요구하는 표시를 지역 구분 없이 적용해, 8월 2일 이후 출시 모델의 출력에는 어디서 쓰든 워터마크가 남습니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.