클로드로 맞춤법만 고쳐도 도장이 찍힙니다 — AI 워터마크 시대의 새 기준

앤트로픽이 클로드가 만든 모든 텍스트에 보이지 않는 워터마크를 넣기 시작했습니다. 문제는 이게 '누가 썼는지'가 아니라 '거쳤는지'만 표시한다는 거예요. 맞춤법 교정도 똑같이 찍힙니다. 뭐가 달라졌고 어떻게 대응하면 되는지 정리했어요.

지난주엔 온통 가격 얘기뿐이었는데, 이번 주는 분위기가 확 달라졌습니다. 제 노트북이 밤마다 긁어오는 영상 목록을 훑는데, 1위가 이거였어요. “미국인들이 AI에 등을 돌렸다.” 22만 회.

돈 얘기하다가 갑자기 신뢰 얘기로 넘어간 한 주였습니다.

세 줄 요약

  • 클로드가 만든 모든 텍스트에 보이지 않는 워터마크가 찍히기 시작했습니다. EU AI 법 대응이에요.
  • 근데 이 표식은 “AI가 썼다"가 아니라 “AI를 거쳤다"만 말합니다. 맞춤법만 고쳐도 찍혀요.
  • 반대편에선 지시를 줄일수록 결과가 좋아진다는 얘기가 나왔습니다. 프롬프트 상식이 뒤집히는 중입니다.

클로드가 쓴 글엔 도장이 찍힙니다

앤트로픽이 8월 2일부터 클로드가 생성하는 텍스트와 파일에 워터마크를 넣기 시작했습니다. EU AI 법의 투명성 의무에 맞춘 조치예요.

두 가지 방식이 같이 갑니다. 텍스트에는 눈에 안 보이는 통계적 표식이, 파일에는 C2PA라는 출처 메타데이터 서명이 붙습니다.

원리가 좀 재밌습니다.

출력 단어 확률을 살짝 편향시켜 통계적 흔적을 남기고, 그 흔적을 되짚어 검출하는 워터마크 구조

AI가 다음 단어를 고를 때 특정 후보들의 확률을 아주 살짝 높입니다. 사람이 읽으면 전혀 티가 안 나는데, 문장이 길어지면 그 편향이 통계로 잡혀요. 2023년 ICML에 발표된 “A Watermark for Large Language Models” 논문이 제시한 방식이고, 이번에 도입된 것도 이 계열입니다.

그러니까 문장 품질은 그대로 두고 흔적만 남기는 겁니다. 꽤 영리하죠.

문제는 ‘썼다’와 ‘거쳤다’를 구분 안 한다는 겁니다

여기가 진짜 중요한 대목입니다.

맞춤법 교정부터 통째 생성까지 — 워터마크는 이 넷을 구분하지 않는다

내가 직접 쓴 글을 클로드에 넣고 맞춤법만 고쳐도 워터마크가 붙습니다. 번역도, 요약도 마찬가지고요. 표식은 “이 텍스트가 AI를 거쳤다"만 말할 뿐, 누가 썼는지는 말해주지 않습니다.

학교나 회사처럼 AI 사용 여부가 민감한 곳에서는 이게 곤란해질 수 있어요. 초안을 통째로 뽑은 사람과 오타만 고친 사람이 같은 표식을 달게 되니까요.

그래서 나한테는? 제출용 문서라면 어디까지 AI를 거쳤는지 미리 밝혀두는 편이 안전합니다. 나중에 표식이 검출됐을 때 해명하는 것보다, 처음부터 “번역에만 썼다"고 적어두는 쪽이 훨씬 낫습니다.

그리고 예상대로, 워터마크 제거 도구가 이미 깃허브에 올라오고 있습니다. 창과 방패가 시작된 거죠. 다만 이걸 굳이 뚫으려 애쓰기보다는 밝히고 쓰는 쪽이 결국 편할 겁니다.

한 가지 더. 클로드처럼 상용 모델을 쓸 때만 해당됩니다. 내 노트북에서 돌리는 오픈모델에는 이런 표식이 없어요. 민감한 문서를 다룬다면 이것도 선택지입니다.

대중은 이미 등을 돌리는 중입니다

이번 주 최다 조회 영상이 “미국인들이 AI에 등을 돌렸다"였습니다. 22만 회면 이 분야에서 압도적인 숫자예요.

내용은 무겁습니다. 일자리 감소, 데이터센터의 전력·물 소비, 저작권 침해. AI 채택률은 오르는데 신뢰도는 계속 떨어지고 있다는 겁니다.

비슷한 결의 영상도 있었어요. “잠깐, 챗GPT한테 물어볼게"라는 제목인데, AI에 의존하면서 생기는 비판적 사고 저하를 다룹니다. 심리학에서 인지 오프로딩이라 부르는 현상이죠. 계산기를 쓰면 암산 능력이 떨어지는 것과 같은 원리인데, 이번엔 대상이 판단력이라 얘기가 다릅니다.

여기에 감시 우려까지 겹쳤습니다. 챗GPT 데스크톱 앱에 컴퓨터 활동 기록 기능이 붙었거든요. 내가 뭘 하는지 학습해서 반복 작업을 대신해주는 건데, 뒤집으면 화면을 계속 들여다본다는 뜻이기도 합니다. 한 팟캐스트 패널들은 업무 전용 컴퓨터에서만 켜라고 권하더군요. 저도 같은 생각입니다.

이번 주에 건진 것들

AI 사용 범위를 먼저 적어두기. 제출용 문서라면 맨 아래에 “번역·교정에 AI 사용"처럼 한 줄 남기세요. 워터마크가 붙는 시대엔 이게 가장 싼 보험입니다.

민감한 문서는 로컬 모델로. 워터마크도 안 붙고 데이터도 안 나갑니다.

컴퓨터 기록 기능은 기기를 분리해서. 켜려면 업무 전용 기기에서만. 개인 기기에는 켜지 마세요.

클로드 코드에 /design이 생겼습니다. 코드를 짜기 전에 디자인 시안을 뽑고 고른 다음 넘어가는 흐름이에요. 만들어놓고 “이거 아닌데” 하며 갈아엎는 일이 줄어듭니다.

프로젝트 폴더에 문서 세 개 두기. 한 영상에서 소개한 방식인데 꽤 쓸 만합니다. 작업 방식을 적은 문서, 지금 중요한 게 뭔지 적은 문서, 결과물 판단 기준을 적은 문서. 이렇게 세 개를 두면 AI가 맥락을 알아서 잡습니다.

하나만 남긴다면 — 지시를 줄이세요

여기부턴 이번 주 뉴스가 아니라 오래 갈 얘기입니다.

클로드 코드 개발자가 이런 말을 했다고 합니다. 시스템 프롬프트의 80%를 지웠더니 결과가 더 좋아졌다고요.

과잉 지시 대신 목표와 검증 기준만 주는 방식

모델이 똑똑해질수록 세세한 단계 지시가 오히려 발목을 잡는다는 겁니다. 업계에선 이걸 호블링이라고 부르더군요. 말 그대로 발을 묶는다는 뜻이죠.

그럼 뭘 줘야 하냐면 두 가지입니다.

  1. 무엇을 달성해야 하는지 (어떻게 하라가 아니라)
  2. 다 됐다는 걸 어떻게 증명할지

지난주에 나온 Ramp 사례도 정확히 같은 얘기였습니다. “어떻게 하라” 대신 “뭘 달성하라"만 지시해서 CI 시간을 3분의 1로 줄였다고 했죠. 두 주 연속 같은 결론이 나온 셈입니다.

솔직히 저도 반대로 해왔습니다. 결과가 시원찮으면 지시를 더 붙이는 식이었는데, 이번 주 내용을 보고 프롬프트를 한 번 걷어내 봐야겠다 싶더군요.

짚고 넘어갈 것

이번 주 제목들이 좀 셌습니다. “GPT-6 아스트라가 클로드를 박살냈다” 같은 것들요.

내용을 보면 아스트라가 미해결 수학 문제 10개를 풀었고, Lean 4라는 증명 검증기로 기계 검증까지 됐다는 겁니다. 이건 진짜 대단한 성과예요.

다만 같은 주에 클로드도 리만 가설에서 진전을 냈습니다. 조건을 만족하는 영(zero)의 비율 하한을 사람이 세운 41.6%에서 67.2%까지 올렸다고 하죠. 가설 자체를 푼 건 아니지만 의미 있는 개선입니다.

그러니까 “박살냈다"는 제목보다는 양쪽 다 수학에서 진전을 내고 있다가 사실에 가깝습니다. 그리고 아스트라는 소비자용 제품이 아니라 연구 시스템으로 보인다는 게 영상들의 공통 관측이었어요. 당장 우리가 쓸 수 있는 물건이 아닙니다.

가격 인하도 계속됐습니다. OpenAI가 최대 80%를 내렸고, 무료 게이트웨이 얘기도 또 나왔어요. 지난주 흐름이 그대로 이어지는 중입니다.

나머지는 짧게

  • 구글 픽셀 11 / 워치 5 공개. 온디바이스 AI와 오프라인 제미나이, 혈압·인슐린 저항성 추세 감지가 붙었습니다.
  • 제미나이에 이미지 워터마크 제거 기능이 생겼습니다. 한쪽은 넣고 한쪽은 빼는 묘한 그림이에요.
  • 미니맥스 H3가 오픈소스 영상 생성에서 좋은 평을 받았습니다. 로컬로 돌릴 수 있다는 게 강점이고요.
  • 무제한이 사라지는 중입니다. 수노를 비롯해 “무제한” 내걸던 AI 서비스들이 하나둘 사용량 제한을 겁니다.
  • 클로드 페이블 5.1 출시가 임박했다는 유출이 돌았습니다.

이번 주엔 이거 하나만

AI를 쓴 문서에 한 줄만 남겨보세요. “이 글은 번역과 교정에 AI를 썼습니다” 정도면 충분합니다.

워터마크가 기본이 된 이상, 숨기는 쪽은 계속 피곤해집니다. 먼저 밝히면 그냥 끝나는 일이고요. 저도 이 블로그에 그 한 줄을 넣을지 고민 중입니다.

여러분은 어디까지가 “내 글"이라고 생각하세요? 맞춤법 교정까지는 괜찮고 초안 생성부터는 아닌 걸까요. 저도 아직 선을 못 그었습니다.


매주 유튜브 AI 영상 수십 편을 훑어서, 흐름이 되는 것만 골라 “내 작업에 뭐가 달라지나"로 옮기고 연구 근거랑 과장 필터를 붙입니다. 이번 편은 2026년 8월 12~19일 조회수 상위 영상을 봤어요. 성능·수치는 각 영상에서 주장된 값이라 직접 검증하진 못했고, 그래서 반론이 있으면 같이 적었습니다. 워터마크 원리로 인용한 ICML 2023 논문과 C2PA·EU AI Act는 공개된 자료예요.

출처 영상