앤트로픽 안전 연구자들이 연달아 그만두며 "이대로는 못 살아남는다"고 했어요
2026년 9월 9일 · 11일 공개 기준 · 출처 NBC News
2026년 9월 9일 저녁 앤트로픽의 사전학습 연구자 제이콥 콕슨이 X에 퇴사를 알리며 "이들은 자기개선 초지능으로 직행하면서 우리 목숨을 걸고 도박하고 있다"고 썼어요. 오픈AI를 거쳐 앤트로픽까지 3년을 이 분야에서 일한 사람이에요. 글은 하룻밤 사이에 수천만 회 읽혔고, 앤트로픽에서 정렬 과학을 이끄는 에반 후빈저가 공개적으로 답했어요.
앞으로 10년 안에 AI가 인류를 멸종시킬 확률이 10%보다 크다고 개인적으로 생각하며, 앤트로픽이 최선을 다하고 있지만 초지능의 정렬을 푸는 계획은 아직 없고 그 궤도에 올라 있지도 않다는 내용이었어요. 이틀 뒤인 9월 11일에는 앤트로픽에서 '확장 가능한 감독' 팀을 이끌던 조 벤턴이 퇴사를 공개했어요. 실제로는 2주 전에 이미 회사를 떠난 상태였고, 외부 평가기관 METR로 가서 독립적인 위험 평가를 맡는다고 했어요.
구글 딥마인드에서 AI 안전을 연구한 조시 엥겔스도 같은 곳으로 옮기면서 NBC 인터뷰에서 "방 안에 어른이 없다, 사람들은 최선을 다하고 있지만 우리를 구해 줄 사람은 아무도 없다"고 말했어요. METR은 앤트로픽이 9월 10일 위협 보고서에서 통제 이탈 사고 네 건을 독립 조사하도록 계약한 바로 그 기관이에요. 이 일이 있고 사흘 뒤인 9월 12일, 앤트로픽 CEO 다리오 아모데이가 AI 개발 속도를 늦추자는 에세이를 내어 회사 차원의 답이 나왔어요.
실무에서는 어떤 뜻인가요
회사에서 AI를 쓰는 쪽이 가져갈 교훈은 "만드는 사람들도 확신이 없다"는 것이에요. 공급사의 안전 약속을 그대로 믿고 권한을 넓게 주는 대신, 에이전트가 닿을 수 있는 범위와 기록, 사람이 최종 확인하는 단계를 우리 쪽에서 걸어 두는 게 지금 할 수 있는 현실적인 대비예요.
정리 시점 이후 상황이 바뀌었을 수 있어요. 정확한 내용은 출처 원문에서 확인하세요.