
요약
- 앤스로픽이 8월 14일 해설을 내고 클로드 텍스트 워터마크가 구글 딥마인드 SynthID 계열 기술임을 밝혔다. 글자를 더하는 게 아니라 단어를 고르는 방식에만 손대기 때문에 요금·속도·글 품질은 그대로다.
- 표식은 클로드가 '다르게 쓸 수도 있었던' 자리에만 남는다. 사실 문장이나 코드처럼 답이 하나뿐인 자리에는 거의 안 붙고, 사람이 쓴 글을 가볍게 다듬은 경우도 마찬가지다. 반면 번역문은 전부 대상이고 짧은 글은 검출이 어렵다.
- 유럽 AI법 제50조가 8월 2일 적용되며 약 190곳이 같은 방향으로 묶였다. 한국 AI기본법은 기계가 읽는 표시를 의무가 아닌 선택으로 뒀고, 구글은 한국·인도·베트남에 눈에 보이는 워터마크를 자동 적용한다.
먼저 결론부터 — 내 글에는 무슨 일이 생기나
앤스로픽이 켠 표식은 글자를 몰래 끼워 넣는 방식이 아니다. 클로드가 어느 단어를 써도 상관없는 자리에서만, 단어를 고르는 방식에 비밀 규칙을 심는다. 원리는 뒤에서 차근히 보기로 하고, 내 글이 어떻게 되는지부터 보자.
워터마크는 클로드가 다르게 쓸 수도 있었던 자리에만 남는다. 이 한 문장이 거의 모든 것을 설명한다. 고를 여지가 없었던 자리에는 표식을 심을 곳도 없기 때문이다.
- 초안을 통째로 맡기면 남는다. 클로드가 결정한 단어가 많을수록 표식이 붙을 자리도 많아진다.
- 내가 쓴 글을 다듬게 하면 거의 안 남는다. 단어의 대부분이 여전히 사람 것이기 때문이다.
- 번역은 전부 대상이다. 번역문은 모든 단어를 클로드가 새로 고른다.
- 사실을 적은 문장에는 희박하다. "아이작 뉴턴의 대표작은 『프린키피아 ___』"의 빈칸은 "마테마티카" 하나뿐이다. 다른 단어를 넣으면 그냥 틀린 문장이 된다.
- 코드에는 거의 안 걸린다. 정확한 출력이 필요한 자리에는 아예 적용하지 않는다. 다만 앤스로픽이 예로 든 코드 주석처럼 아무렇게나 써도 되는 자리에는 실릴 수 있다. "코드에 워터마크가 박힌다"는 말은 과장이다.
- 짧은 글에서는 못 잡는다. 선택의 횟수가 곧 신호의 양이라, 글이 길수록 확신도가 올라간다.
앤스로픽이 든 예가 이 원리를 압축한다. "2 + 2 = ___"의 답은 4 하나뿐이다. 하지만 조지 오웰의 『1984』 이야기 중이라면 5가 정답일 수도 있다. 맥락이 답을 하나로 좁히는 순간, 워터마크는 설 자리를 잃는다.
중요한 한계도 짚어 두자. 워터마크는 "클로드가 썼다"와 "클로드가 많이 고쳤다"를 구분하지 못한다. 반대로 표식이 안 나왔다고 AI를 안 썼다는 뜻도 아니다 — 다른 회사의 AI는 다른 열쇠를 쓴다. 소유권도 마찬가지다. 앤스로픽은 워터마크가 저작권이나 저작자를 말해 주지 않으며, 이용약관상 권리도 달라지지 않는다고 명시했다.
그림과 파일은 이야기가 다르다. 영문 매체 다수가 뭉갠 지점이다. .png·.jpg·.svg 파일에는 픽셀을 건드리는 워터마크가 아니라 C2PA 콘텐츠 크리덴셜, 쉽게 말해 파일 정보란에 붙는 위조 방지 전자 꼬리표가 달린다. 카메라 회사와 사진 편집 프로그램이 함께 쓰는 공개 표준이라 그림 자체는 그대로다. 다만 꼬리표인 만큼 떼어내면 그만이라는 약점을 안는다.
글자를 더하는 게 아니다 — 주사위를 바꾸는 것
AI는 다음 단어를 고를 때 여러 후보 중 하나를 확률로 뽑는다. "오늘 날씨는 춥고 ___"에 "설탕 같은"은 들어갈 수 없지만 "흐린"과 "잿빛의"는 둘 다 자연스럽다. 어느 쪽을 골라도 뜻은 달라지지 않는다. 이런 어느 쪽이든 상관없는 선택이 긴 글에는 수백 번 나온다.
워터마킹은 이 선택의 결과를 억지로 바꾸지 않는다. 바꾸는 건 **선택에 쓰는 '주사위'**다. 아무 난수나 쓰는 대신, 비밀 열쇠와 바로 앞의 몇 단어를 조합해 만든 숫자로 다음 단어를 정한다. 겉보기엔 여전히 무작위지만, 열쇠를 가진 쪽이 되짚어 보면 우연으로는 설명되지 않는 규칙성이 드러난다.
앤스로픽이 든 비유가 정확하다. 보드게임에서 주사위를 굴리는 대신 원주율(π)의 소수점 아래 숫자를 순서대로 읽어 말을 옮긴다고 하자. 게임 중에는 주사위와 구분되지 않는다. 하지만 끝난 뒤 전체 기록을 놓고 보면, π를 아는 사람은 이 게임이 π를 썼는지 계산해 낼 수 있다.
오해를 하나 짚어 두자. 이 방식은 클로드가 늘 "흐린"만 고르도록 취향을 비트는 게 아니다. 앤스로픽은 평소 쓰지 않을 어려운 동의어를 억지로 끌어오는 일도 없다고 못박았다. 후보의 순위를 흔드는 게 아니라 제비뽑기의 씨앗을 바꾸는 것이다.
바탕이 된 기술은 구글 딥마인드의 SynthID-Text다. 2024년 10월 국제 학술지 네이처에 「대규모 언어모델 출력 식별을 위한 확장 가능한 워터마킹」이라는 제목으로 실렸다. 후보 단어들을 토너먼트처럼 1대1로 붙여(기본값 30단계) 최종 승자를 남기는 토너먼트 샘플링 방식인데, 각 대결에서 누가 이기는지를 가리는 규칙에 비밀 열쇠가 숨는다. 각 단어가 뽑힐 확률을 원래대로 유지하는 설정에서는 원리상 글 품질이 떨어지지 않는다. 딥마인드는 실제 제미나이 응답 약 2,000만 건에 달린 이용자 반응을 비교해 좋아요 0.01%p, 싫어요 0.02%p 차이 — 사실상 차이 없음 — 을 보고했다. 앤스로픽도 내부 테스트에서 영향이 없었다고 밝혔다.
시중의 'AI 탐지기'와는 아예 다른 물건이다
오해가 가장 잦은 곳이다. GPTZero나 팽그램 같은 AI 탐지 서비스에는 열쇠가 없다. 그래서 글의 버릇을 본다. 앤스로픽이 직접 든 예가 재미있는데, AI 모델들은 "이건 X가 아니라 Y다"라는 구문을 유난히 좋아하고 "조용히(quietly)"라는 부사를 사람보다 훨씬 자주 쓴다.
워터마크 검출은 반대다. 문체를 보지 않고 열쇠로 계산하니 잘 쓴 글이라고 더 의심받지 않는다. 대신 열쇠를 쥔 앤스로픽만 할 수 있다. 교사도, 회사도, 글쓴이 본인도 확인할 방법이 아직 없다 — 검출 API는 "곧 제공하겠다"는 문장뿐이다.
지워지나 — 학계도 갈린다
"다른 말로 바꿔 쓰면 사라진다"는 통념은 절반만 맞다.
2023년 크리슈나 연구진은 문장을 통째로 바꿔 쓰는 전용 AI(110억 파라미터)를 동원해 대표적 탐지기의 정확도를 70.3%에서 4.6%까지 떨어뜨렸다. 반면 메릴랜드대 커첸바우어 연구진은 2023년 6월 논문(ICLR 2024)에서 정반대 결론을 냈다. 사람이 강하게 고쳐 쓴 뒤에도 평균 800토큰(AI가 글을 다루는 단위인 '단어 조각' 800개) 분량을 모아 보면 10만 번에 한 번 잘못 짚는 엄격한 기준에서도 검출된다는 것이다. 다시 쓴 글에도 원문의 단어 묶음이 조각조각 남기 때문이다.
두 결론이 갈리는 축은 글의 길이다. 짧으면 지워지고, 길면 남는다. 앤스로픽의 설명도 여기서 벗어나지 않는다 — "가벼운 편집으로는 완전히 지워지지 않지만, 모든 단어를 바꾸는 전면 재작성이면 사라진다. 물론 그렇게까지 했다면 그 글을 AI가 쓴 글이라 부를 수 있는지부터가 논쟁거리다."
더 근본적인 문제도 있다. 취리히연방공대 연구진은 2024년 API로 질문을 반복하는 것만으로 워터마크 규칙을 거꾸로 알아내 지우기와 위조를 모두 성공시켰다. 위조 쪽이 특히 고약하다 — 사람이 쓴 글에 가짜 신호를 심어 AI 작성물로 몰아가는 악용은, 못 잡는 것보다 훨씬 다루기 어렵다. GPTZero의 알렉스 추이도 *"단어 선택과 구문을 함께 공격하는 강한 패러프레이징에는 살아남지 못한다"*고 밝혔다 — 단어와 문장 구조를 동시에 갈아엎으면 못 버틴다는 뜻이다.
왜 하필 지금인가 — 4년 가까이 묵은 기술이 규제를 만났다
워터마킹은 갑자기 나온 아이디어가 아니다. 학계를 돌던 기술이 규제를 만나 한꺼번에 올라왔다.
2022년 11월. 오픈AI에 휴직 합류해 있던 이론컴퓨터과학자 스콧 애런슨이 UT 오스틴 강연에서 주 프로젝트를 공개했다. 오픈AI만 아는 비밀 규칙으로 만든 난수를 써서 단어를 뽑는다는 구상 — 지금 앤스로픽이 켠 방식의 원형이다. 그는 수백 토큰(단어 조각 수백 개) 분량이면 신호가 잡히지만 다른 AI로 다시 쓰면 무너진다는 점도 인정했다.
2023년 1월. 메릴랜드대 커첸바우어 연구진의 「대규모 언어모델을 위한 워터마크」가 그해 AI 학회 ICML의 최우수 논문상(채택 1,800여 편 중 6편)을 받았다. 단어들을 미리 두 무리로 갈라 두고 어느 쪽을 많이 썼는지로 가려내는 방식인데, 선택지가 없는 문장에는 못 싣는다는 벽도 이때 지적됐다. 앞 절에서 본 「길면 남는다」 쪽 논문을 낸 것도 같은 팀이다.
2023~2024년. 구글 딥마인드가 2023년 8월 이미지용 SynthID를, 2024년 5월 제미나이의 텍스트에 워터마킹을 적용했다. 10월에는 네이처 논문과 함께 개발자 플랫폼 허깅페이스에 누구나 가져다 쓸 수 있게 코드를 공개했다. 기술이 한 회사의 자산에서 업계 공용 부품이 된 순간이다.
그리고 오픈AI가 켜지 않은 선택. 2024년 8월 월스트리트저널은 오픈AI가 99.9% 신뢰도의 텍스트 워터마킹을 만들어 놓고 1년 가까이 출시를 미뤘다고 보도했다. 2023년 4월 내부 설문에서 **이용자 약 30%가 "오픈AI만 워터마크를 넣고 경쟁사가 안 넣으면 챗GPT를 덜 쓰겠다"**고 답한 것이 크게 작용했다. 오픈AI가 같은 날 공개적으로 든 또 하나의 이유는 더 무겁다 — 워터마킹이 영어가 모국어가 아닌 사람에게 낙인을 찍을 수 있다는 것이었다.
2026년 8월 2일. 유럽연합 AI법(EU AI Act) 제50조의 투명성 의무가 적용에 들어갔다. AI로 콘텐츠를 만드는 시스템을 제공하는 쪽은 결과물이 기계가 읽을 수 있는 형식으로 표시되도록 보장해야 한다. 앤스로픽은 2026년 7월 「AI 생성 콘텐츠 투명성 행동강령」에 서명했고, 서명한 곳은 약 190곳이다. 어기면 최대 **1,500만 유로 또는 전 세계 매출의 3%**를 문다.
가장 논쟁적인 대목이 여기서 나온다. 앤스로픽은 워터마크를 유럽이 아니라 전 세계에 켰다. 이유는 한 줄로 적혀 있다 — "아직 지역별로 범위를 나눌 견고한 방법이 없기 때문". 유럽에서 만든 규제가 그대로 세계 표준이 되는, 이른바 '브뤼셀 효과'의 교과서적 사례다.
한국은 다르다 — 워터마크는 의무가 아니다
인공지능기본법은 2026년 1월 22일 이미 시행됐다. 제31조 제2항은 생성형 AI 결과물에 그 사실을 표시하도록 하고, 시행령 제23조 제2항은 방법을 사람이 알아볼 수 있는 표시 또는 기계가 읽을 수 있는 표시 중 하나로 정했다. 둘 중 하나만 하면 된다는 뜻이다. 기계가 읽는 쪽을 택하더라도 사람에게 한 번은 안내해야 한다.
즉 한국은 워터마크를 의무화하지 않았다. 유럽과 갈리는 지점이다. 과태료(3천만원 이하)도 제31조 제1항의 사전 고지 의무 위반에 걸리는 것이지, 결과물에 표시를 안 했다고 곧바로 붙지 않는다 — 자주 오독되는 대목이다.
| 유럽연합 | 한국 | 중국 | 미국 캘리포니아 | |
|---|---|---|---|---|
| 적용일 | 2026-08-02 | 2026-01-22 | 2025-09-01 | 2026-08-02 |
| 기계가 읽는 표시 | 필수 | 선택 | 필수 | 필수 |
| 사람이 보는 라벨 | 배포자 몫 | 필수 | 필수 | 이용자 선택 |
| 쓰는 사람의 의무 | 없음 | 없음 | 있음 | 없음 |
중국만 유독 촘촘하다. 만든 회사뿐 아니라 쓰는 사람과 유통 플랫폼에도 의무를 지운다. 캘리포니아도 2027년 1월부터 플랫폼에 탐지 의무가 생긴다.
근거 법령은 유럽연합 AI법 제50조, 한국 인공지능기본법 제31조, 중국 「표시관리방법」, 캘리포니아 SB 942다. 표시 방식은 조금씩 다른데 중국은 파일 정보란에 심는 '암묵 표시', 캘리포니아는 '잠재 표시'를 지정했고, 캘리포니아의 사람이 보는 라벨에는 '기술적으로 가능한 범위에서'라는 단서가 붙는다.
같은 날, 구글은 반대로 갔다
앤스로픽의 해명이 나온 바로 그날, 구글은 정반대 발표를 했다.
조시 우드워드 구글 랩스 부사장은 8월 14일(한국시간 밤 10시 39분) 제미나이와 플로에서 눈에 보이는 워터마크를 켜고 끌 수 있는 스위치를 열었다고 밝혔다. 나노 바나나(이미지)·옴니(영상)·리리아(음악)에 모두 적용된다. 기준은 구독 등급이 아니라 법으로 워터마크 유지가 요구되는 나라인지였다.
여기서 한국이 등장한다. 구글 플로 도움말은 인도·한국·베트남 거주자에게는 눈에 보이는 워터마크가 자동 적용된다고 못박는다. 다만 실제로는 나라·요금제·계정 종류가 겹쳐 있다 — 디지털트렌즈는 이 세 나라에서도 유료 AI 울트라 구독자는 끌 수 있고, 업무·학교 계정은 설정 자체가 없다고 전했다.
더 중요한 건 우드워드가 붙인 단서다. 끌 수 있는 건 눈에 보이는 워터마크뿐이고, 보이지 않는 SynthID와 파일에 붙는 전자 꼬리표는 그대로 남는다. 구글이 표식을 붙인 콘텐츠는 2025년 5월 100억 건에서 2026년 5월 이미지·영상만 1,000억 건 이상으로 늘었다.
두 회사가 한 일은 정반대로 보이지만 방향은 같다. 사람 눈에 보이는 라벨은 걷어내고, 기계가 읽는 표식으로 옮겨 가는 것. 오픈AI도 2026년 5월 이미지에 SynthID를 도입하고 7월 말 오디오로 넓혔다 — 다만 텍스트에는 여전히 적용하지 않는다. 텍스트 워터마킹 자체는 구글이 먼저 켰으니, 앤스로픽이 처음인 것은 기술이 아니라 명분이다. 규제 준수를 이유로 내걸고 전 세계에 켠 첫 사례다.
사람들이 화난 진짜 이유
발표 방식부터가 문제였다. 앤스로픽이 이 사실을 처음 알린 곳은 뉴스 발표가 아니라 조용한 도움말 문서였다. 8월 10일 개발자 커뮤니티 해커뉴스에서 449점을 받으며 퍼졌고, 다음 날 테크크런치·포브스·유로뉴스가 받아 썼다. 그런데 그 문서는 "어떻게 표시하는지"를 설명하지 않았다. IT 칼럼니스트 존 그루버(데어링 파이어볼)는 8월 11일 「'클로드가 AI 콘텐츠를 어떻게 표시하는가'를, 어떻게 표시하는지 설명하지 않은 채 올렸다」는 제목으로 이 공백을 때렸다. 지적은 이랬다. 눈에 안 보이는 문자를 끼워 넣는 방식이라면 글자 수 제한이 있는 플랫폼에서 분량이 부풀 것이고, 단어 선택을 비트는 방식이라면 앤스로픽이 스스로 내건 "의미·품질·가독성을 바꾸지 않는다"는 약속과 모순된다는 것이다.
빈칸을 먼저 채운 건 커뮤니티였다. 개발자 존 J. 왕은 8월 12일 클로드가 쓴 글 720만 자를 훑어 눈에 안 보이는 특수문자는 섞여 있지 않다는 것을 확인하고, "비밀 열쇠로 단어 선택을 바꾸는 방식일 것"이라 추정했다. 다만 그것이 SynthID인지까지 입증하지는 못했다고 분명히 적었다 — 그 빈칸을 앤스로픽이 8월 14일에 메웠다. 새 발표가 아니라 나흘간의 역풍에 대한 사후 해명이라는 것이 이 사안의 성격이다.
반발은 두 갈래로 갈렸다. 첫째는 부정행위 적발 프레임이다. 테크크런치는 8월 12일 "직장과 수업에서 AI를 쓴 사실이 들통날까 봐 화가 난 이용자들"로 반응을 정리했다. "내가 지시하고 다듬었으니 클로드는 도구"라는 주장과 "지시만 했을 뿐 만든 건 클로드"라는 반박이 부딪혔다. 찬성 측 논거는 단순했다. "이걸 원하지 않는 유일한 이유는 남을 속이기 위해서다."
둘째가 훨씬 무겁다. 클로드를 교정 도구로 쓰던 사람들이다. 라디오 진행자 에릭 에릭슨은 *"교정을 더 잘해서 그래멀리를 버리고 클로드로 갈아탔는데, 이제 내가 쓴 글에 클로드가 했다는 워터마크가 붙는다"*고 적었다. 해커뉴스에서 널리 인용된 반응은 더 직접적이었다. "나는 자폐·ADHD에 난독증이 있다. 내 뜻이 제대로 전달되게 하는 것만도 벅찬데 이제 워터마크까지 신경 써야 하나. 사회에서 받는 수치심만으로 충분하다." 오픈AI가 2년 전 출시를 접으며 든 "비원어민 낙인" 우려와 정확히 같은 지점이다.
앤스로픽의 답은 "가벼운 교정에는 붙을 자리가 거의 없다"는 것이다. 원리는 맞다. 하지만 어디까지가 가벼운 교정인지 기준선도, 잘못 짚었을 때 이의를 제기할 절차도 공개되지 않았다. 확률로 짐작하는 신호가 그 상태로 학교와 직장에 흘러 들어가면 어떤 일이 벌어지는지는, AI 탐지기가 사람 글을 AI 글로 잘못 짚는 오탐 사태가 몇 년째 보여 준 그대로다.
에디터의 시선
이번 결정의 본질은 탐지가 아니라 책임 분배다. 앤스로픽이 얻는 건 규제 대응이고, 잃는 건 클로드를 교정 도구로 쓰던 이용자의 신뢰다. 그 사이의 빈칸 — 기준선, 이의제기, 오탐 구제 — 은 아무도 채우지 않았다. 검출 API를 언제 어떤 기준으로 내놓는지가 실질적 결말이 될 것이다.
당장 쓸 수 있는 판단은 세 가지다. ① 초안을 통째로 맡기면 표식이 남고, 사람이 쓴 글을 다듬는 용도면 거의 남지 않는다. ② 코드는 영향권 밖이다 — 주석 정도가 예외다. ③ 번역은 전부 표식 대상이니, 번역 결과를 자기 이름으로 내보내는 일이 있다면 지금 점검할 값어치가 있다.
바뀐 건 기술이 아니다. 2022년 애런슨의 제안, 2023년 오픈AI의 보류, 2026년 앤스로픽의 강행 사이에서 달라진 건 규제와 경쟁 구도다. 오픈AI는 혼자 켜면 이용자를 잃는다고 판단했고, 지금은 유럽 행동강령에 약 190곳이 같은 방향으로 묶인 국면이다. 워터마킹은 처음부터 조율의 문제였지 알고리즘의 문제가 아니었다 — 네이처 논문이 한계를 적은 대목에 "워터마킹 주체 간 협조가 전제되어야 한다"고 써 둔 그대로다.
다만 낙관은 이르다. 학계가 이미 위조와 제거를 시연해 놓은 기술을, 개인의 정직성을 판정하는 근거로 쓰기 시작하면 피해는 규칙을 지키는 쪽에 먼저 간다. 워터마크가 답해야 할 질문은 "이 글을 AI가 썼는가"가 아니라 **"이 표식으로 사람을 처벌해도 되는가"**다. 후자에 대한 답은, 앤스로픽의 해설 어디에도 아직 없다.





댓글