오픈AI 신모델, 보안등급 ‘심각’…“인간 개입 없이 취약점 찾아 공격”

4 weeks ago 11

오픈AI의 차기 모델 ‘아스트라(Astra)’가 사이버보안 최고 심각 등급 판정을 받아 안전장치 강화에 나섰다. 사진=게티이미지코리아 오픈AI의 차세대 인공지능(AI) 모델 ‘아스트라(Astra)’가 회사의 안전성 평가에서 사이버보안 역량 ‘심각(Critical)’ 수준에 도달했다. 오픈AI가 자사 모델을 이 등급으로 지정한 것은 처음이다.1일(현지시간) 오픈AI는 공식 블로그를 통해 출시를 앞둔 아스트라가 자체 ‘준비성 프레임워크(Preparedness Framework)’의 사이버보안 분야에서 ‘심각’ 단계에 도달했다고 밝혔다. 아스트라는 사람의 개입 없이 보안이 강화된 시스템의 알려지지 않은 취약점을 찾아 실제 공격에 활용할 수 있는 수준으로 평가됐다.● 인간 개입 없이 취약점 찾아 공격까지 실행오픈AI의 준비성 프레임워크에서 사이버보안 역량이 ‘심각’ 수준으로 평가되려면 두 가지 기준 가운데 하나를 충족해야 한다.첫째는 사람의 개입 없이 보안이 강화된 다수의 실제 핵심 시스템에서 알려지지 않은 취약점을 발견해 작동 가능한 제로데이 공격으로 발전시킬 수 있는 경우다. 둘째는 높은 수준의 목표만 주어진 상태에서 보안이 강화된 표적을 상대로 새로운 사이버 공격 전략을 처음부터 끝까지 스스로 수립하고 실행할 수 있는 경우다.오픈AI는 아스트라가 첫 번째 기준을 충족한다고 판단했다. 전문가가 진행한 평가에서 아스트라는 보안이 강화된 브라우저와 운영체제(OS)의 알려지지 않은 취약점을 찾아 실제 작동하는 공격 체인으로 연결했다. 브라우저의 샌드박스를 벗어나 호스트에서 명령을 실행하는 공격 체인을 만들었고, 운영체제에서는 여러 취약점을 조합해 일반 사용자 권한을 최고 관리자(root) 권한으로 끌어올리는 데 성공했다.내부 평가용 취약점 데이터에서는 두 개의 제로데이 취약점을 새로 발견해 공격 체인에 활용하기도 했다. 오픈AI는 현재 해당 취약점을 관련 개발자들에게 알리는 절차를 진행하고 있다고 밝혔다. 다만 이 평가 결과는 일반 이용자에게 제공될 기본 모델이 아니라 고급 사이버보안 기능에 접근할 수 있는 ‘데이브레이크 블루(Daybreak Blue)’ 환경을 기준으로 한 것이다.● 탈옥 요청 거부율 91.5%…우회 시도도 줄어사이버 공격 역량이 크게 높아진 만큼 안전장치도 강화됐다.오픈AI에 따르면 사이버보안 관련 탈옥(안전 지침 무력화) 평가에서 아스트라는 허용되지 않은 요청의 91.5%를 거부했다. GPT-5.6...

Read Entire Article