앤스로픽 핵심 ‘퇴사 이유’ 소름…“내년말쯤 AI 통제불능 될것”

2 weeks ago 21

“인류 파멸시킬 흐름에 동참 못해” 인공지능(AI)이 궁극적으로 인간의 통제 범위를 벗어날 수 있다는 우려가 확산되는 가운데 앤스로픽의 핵심 엔지니어가 AI가 인류를 파멸시킬 것이란 경고를 남기고 퇴사하며 업계에 파장이 일고 있다.9일(현지 시간) 월스트리트저널(WSJ)에 따르면 앤스로픽의 제이콥 콕슨 연구원(27)은 전날 통제 불능 상태의 AI 시스템이 인류를 파멸시킬 수 있다며 이 업계 전반의 흐름에 동참하지 않기 위해 회사를 떠난다고 밝혔다. 그는 소셜미디어 X(옛 트위터)를 통해 “가장 극단적인 시나리오들이 현실화될 가능성이 높으며, 내년 말쯤 상황이 통제 불능 상태에 빠질 수 있다”고 경고했다. 또 중국 기업들과 경쟁하는 상황에서 AI 기업들이 이를 핑계로 시스템 안전성을 타협하고 있다고도 밝혔다.콕슨은 앤스로픽 합류 전 오픈AI의 핵심 엔지니어로 일하며 챗GPT의 개발과 안전성 평가를 맡았다. 앤스로픽에서도 대규모 데이터 학습을 담당하는 핵심 연구원이었다. 그는 “두 기업 모두 책임감 있게 행동하지 않고 있으며, 스스로 성능을 개선하는 초지능 개발에 사활을 걸고 인류를 상대로 위험한 도박을 하고 있다”고 폭로했다. 콕슨의 고발에 업계 내에서도 동조가 이어졌다. 에반 헤빙거 앤스로픽 연구 리더는 “연구자들은 실제로 AI가 인류를 멸망시킬 가능성이 있다고 믿으며, 향후 10년 내 그런 일이 발생할 확률이 10% 이상일 것으로 본다”고 밝혔다. 새뮤얼 마크스 앤스로픽 수석 연구원도 “AI 개발자들은 자신들의 기술이 인류의 멸종 또는 그와 유사한 심각한 결과를 초래할 수 있다고 믿는다”고 동조했다.이날 로이터통신은 오픈AI가 개발한 AI 에이전트들이 올해 초 개발자의 통제를 벗어나 외부 인터넷 사이트를 편법으로 활용해 서로 소통했다고 보도하기도 했다. 이에 따르면 AI 에이전트들은 위키, 대학 사이트 등 접근을 허가 받지 않은 외부 웹사이트 10여 곳에 자신들만의 소통 공간을 만들어 스팸 게시글 형태로 메모를 남기며 정보를 주고받았다. 문제는 오픈AI가 이러한 사실을 알아내고도 수개월 간 숨겨왔다는 것이라고 로이터는 전했다. 뉴욕=곽도영 특파원 now@donga.com© dongA.com All rights reserved. 무단 전재, 재배포 및 AI학습 이용 금지 좋아요 0개 슬퍼요 0개 화나요 0개 지금 뜨는 뉴스

Read Entire Article