핵심 요약
- 앤트로픽의 AI 연구원 제이콥 콕슨이 지분 베스팅을 두 달 앞두고 초지능 위험성을 경고하며 전격 퇴사했습니다.
- 앤트로픽 내부 정렬 팀 리드까지 10년 내 AI로 인한 인류 멸망 확률이 10% 이상이라며 폭로 내용을 인정해 논란이 커졌습니다.
- 거액의 보상과 안주 대신 책임을 선택하고 나쁜 일을 거부한 내부고발자들의 태도가 기술 업계에 큰 울림을 주고 있습니다.
요약 OpenAI와 Anthropic(앤트로픽)에서 지난 3년간 사전학습(pretraining) 연구를 담당해 온 엔지니어 제이콥 콕슨(Jacob Coxon)이 최근 앤트로픽 퇴사를 선언하며 올린 글이 실리콘밸리와 인터넷을 뜨겁게 달궜습니다.
콕슨은 유명 스타 과학자나 박사 학위 보유자도 아니며, 27세에 앤트로픽의 '안전'에 대한 명성을 믿고 합류했던 평범한 개발자였습니다. 그러나 그는 주식 지분(equity)의 베스팅(권리 부여) 시점을 불과 두 달 남겨두고 이를 포기한 채 회사를 박차고 나왔습니다. 그는 SNS에 "양사 모두 무책임하게 행동하고 있다. 통제 불능의 초지능 개발을 향해 직진하며 우리 삶을 담보로 도박을 벌이고 있다"고 폭로했습니다. 또한 내부 개발자들은 인공지능이 10년 내 인류를 멸망시킬 수도 있다고 진심으로 믿고 있는 상태라고 밝혔습니다.
실제로 앤트로픽의 정렬(alignment) 팀 리드인 에반 허빙거(Evan Hubinger) 역시 "제이콥의 말이 맞다. 우리도 진심으로 AI가 인류를 전멸시킬 가능성을 우려하고 있으며, 나 개인적으로는 10년 내 그 확률이 10% 이상이라고 본다. 회사가 최선을 다하고는 있으나 아직 초지능 정렬 문제를 해결할 구체적인 계획은 없다"며 콕슨의 주장을 인정했습니다.
글쓴이는 이를 2021년 페이스북의 인스타그램 유해성 보고서를 폭로하고 의회에서 증언했던 내부고발자 프랜시스 하우겐에 비유했습니다. 또한 이는 단순한 빅테크의 악마화 문제가 아니라, '내가 그만두면 더 나쁜 놈이 대신할 것'이라거나 '높은 연봉 때문에 침묵하는' 기술 업계 전체의 침묵과 타협 문화(스마일링 탈진)가 낳은 비극이라고 꼬집으며, 결국 좋은 사람이라면 나쁜 일에 동조하지 않고 거부해야 한다고 강조했습니다.
Sponsored · 광고