“통제 뚫고 공격 위험”…오픈AI, 차세대 ‘아스트라’ 개발 중단

1 hour ago 1

앤스로픽-메타-문샷AI 등 통제 벗어난 AI 안전장치가 성능 못따라가 보안 우려 커져 (AP 뉴시스) 오픈AI가 출시를 준비해 온 차세대 인공지능(AI) 모델 ‘아스트라’ 개발에 제동을 걸었다. 내부 평가에서 기존 최신 모델보다 한 단계 높은 ‘위험(Critical)’ 수준의 사이버 공격 능력을 갖췄을 가능성을 발견했기 때문이다. 최근 빅테크의 AI 모델이 보안 시험 과정에서 통제 범위를 벗어나는 사고가 잇따르면서, AI 성능 향상 속도를 기존 안전장치가 따라가지 못하고 있다는 우려가 커지고 있다.● 보안 위험 가능성에 개발 제동오픈AI는 7일(현지 시간) 공식 발표를 통해 “아스트라 관련 내부 평가 결과 ‘위험’ 단계의 사이버 능력을 갖췄을 가능성을 배제할 수 없다고 판단했다”고 밝혔다. ‘위험’은 사람의 개입 없이 핵심 시스템의 알려지지 않은 취약점(제로데이)을 찾아 공격하거나, 목표만 주어져도 공격 방법을 스스로 짜고 실행할 수 있는 수준이다. 오픈AI의 기존 최신 모델인 ‘GPT-5.6 솔’ 등은 사이버 능력이 그보다 아래 단계인 ‘높음(High)’으로 평가돼 왔다. 아스트라는 코딩, 사이버 보안 등 복잡한 작업을 스스로 수행하는 능력을 높인 모델로 알려졌다. 최근 오픈AI는 아스트라가 10년 이상 해결되지 않았던 수학 난제 10개를 풀었다고 밝히기도 했다. 하지만 강력한 성능이 오히려 개발의 발목을 잡았다. 내부 평가에서 아스트라의 코딩·사이버 공격 능력이 기존 모델보다 크게 높아진 것으로 나타나자 오픈AI는 일부 개발과 평가 작업을 일시 중단했다. 아스트라가 강력한 사이버 공격 능력을 갖췄을 가능성을 고려해 보안 수준을 강화하기로 하고, 새 보안 기준이 적용되지 않은 개발 작업은 일단 멈추기로 한 것이다.월스트리트저널(WSJ)은 이번 조치를 “AI 개발사가 보안 우려 때문에 모델 개발을 공개적으로 늦춘 이례적인 사례”라고 평가했다. 그동안 AI 기업들이 위험성이 높은 모델의 공개 범위를 제한하거나 출시 전 안전장치를 추가한 적은 있었지만, 개발 단계에서부터 보안 수준을 높이기 위해 작업 일부를 공개적으로 멈추는 경우는 드물었다. 아스트라에 대한 경계가 높아진 배경에는 최근 잇따른 보안 사고도 있다. 지난달 오픈AI의 모델은 사이버 능력 시험 중 차단된 환경의 허점을 스스로 찾아 외부 인터넷에 접속한 뒤 허깅페이스의 실제 서버까지 침투했다. 앤스로픽의 클로드 모델도 시험 과정에서 인터넷에 접속해 3개 ...

Read Entire Article