핵심 요약
- 구글 SynthID 등 최근 테크 기업들의 AI 워터마크는 사람 눈이나 귀에 보이지 않는 미세 신호로 유저 DB ID 등 개인정보를 숨길 수 있어 단순 표식이 아닌 추적기에 가깝다는 주장이 제기되었습니다.
- 이미지(136비트 삽입 가능)뿐만 아니라 압축에 견디는 오디오 파형, 단어 선택 패턴을 조작한 텍스트까지 광범위하게 추적 페이로드를 인코딩할 수 있습니다.
- 작성자는 사용자가 확인 및 수정할 수 있는 일반 메타데이터(EXIF 등)와 달리 통제권이 없으므로 '워터마크' 대신 '스파이마크'로 불러 프라이버시 위협을 경계해야 한다고 강조했습니다.
요약 '워터마크(Watermark)'는 본래 저작권을 표기하거나 진위를 가리기 위해 눈에 띄게 표시하던 표식이지만, 최근 빅테크 기업들이 AI 생성물에 도입하고 있는 기술은 단순 식별을 넘어섰다는 경고가 나왔습니다. 이를 두고 저자는 사용자가 인지하지 못한 채 추적당한다는 의미에서 '스파이마크(Spymark)'라는 새로운 명칭을 붙여야 한다고 주장합니다.
구글의 신스아이디(SynthID)가 대표적인 예로 꼽힙니다. 신스아이디는 인간의 눈이나 귀로는 전혀 감지할 수 없는 미세한 신호를 이미지, 오디오, 텍스트, 비디오에 심어놓습니다. 구글의 논문에 따르면 신스아이디 이미지 변종(SynthID-O)은 512x512 픽셀 크기의 이미지 안에 무려 136비트 분량의 페이로드를 숨길 수 있습니다. 이는 64비트짜리 고유 유저 식별자(ID)와 오류 보정용 72비트를 담기에 충분한 용량으로, 사실상 해당 파일에 유저의 DB 식별자, IP 주소, 생년월일, 주소지 등 개인 신원 정보가 직결될 수 있음을 뜻합니다.
이러한 기술은 이미지뿐만 아니라 다른 미디어에도 광범위하게 적용되고 있습니다. 오디오의 경우 파형이나 주파수 대역을 미세하게 왜곡해 사람 귀에는 들리지 않는 암호화된 식별자를 삽입하며, 압축이나 재인코딩을 거쳐도 지워지지 않도록 설계됩니다. 심지어 텍스트에서도 특정 단어 선택의 통계적 패턴을 비트값으로 환산해 비밀리에 유저 ID를 심는 것이 가능합니다.
저자는 사용자가 직접 확인하고 삭제할 수 있는 사진의 EXIF나 MP3의 ID3 같은 기존 표준 메타데이터와 달리, 스파이마크는 사용자의 통제권 밖에서 동의 없이 심어지는 감시 수단에 가깝다고 지적합니다. 1980년대 프린터가 출력물에 비밀리에 찍어내던 추적용 노란 점처럼, 단순한 '워터마크'라는 친숙한 단어로 포장할 것이 아니라 '스파이마크'라 명명해 프라이버시 침해 위험성을 직관적으로 알려야 한다는 주장입니다.
Sponsored · 광고