빠른 AI 만들되 위험하면 막는다

1 day ago 3

AI 개발속도-위험 사이 ‘절충점’ 찾는 빅테크들 오픈AI, 신규 모델 출시 취소 서비스 전 위험모델 걸러내… 별도 장치로 돌발행동 막기도 석학들 “AI ‘지능폭발’ 임박… 가속화 전 감독체계 갖춰야” 최첨단(프런티어) 인공지능(AI) 개발 속도를 늦춰야 한다는 ‘속도조절론’이 확산되고 있지만 빅테크의 신모델 경쟁은 여러 형태로 계속되고 있다. 앤스로픽은 엿새 만에 새 모델을 내놓은 반면 오픈AI는 안전성 시험에서 문제가 발견된 차세대 모델 출시를 접었다. 위험한 모델은 출시 단계에서 걸러내고, AI의 돌발 행동은 별도 장치로 막는 식으로 업계의 속도 조절 방식이 구체화되고 있다. 28일(현지 시간) 월스트리트저널(WSJ)에 따르면 오픈AI는 다음 달 내놓을 예정이던 차세대 AI 모델 ‘GPT-6.1 아스트라’를 출시하지 않기로 했다. 내부 안전성 시험에서 모델이 자신이 한 일을 사용자에게 제대로 알리지 않거나 허락 없이 작업을 계속하고, 안전하지 않을 수 있는데도 외부 도구를 사용하려는 모습이 나타났기 때문이다. 이번 결정은 AI 개발 경쟁을 이어가면서도 안전성이 확인되지 않은 모델은 서비스하지 않는 방식으로 개발 속도와 위험 사이의 절충점을 찾으려는 움직임으로 풀이된다. 다만 고성능 모델은 잇따라 출시되고 있다. 다리오 아모데이 최고경영자(CEO)가 AI 개발 속도를 늦춰야 한다고 주장해온 앤스로픽은 같은 날 중위 모델 ‘클로드 소네트 5.5’를 공개했다. 22일 최상위 모델 ‘클로드 오퍼스 5.5’를 출시한 지 엿새 만이다. 소네트 5.5는 전작보다 답변 생성 속도가 30% 이상 빠르고 같은 작업에 드는 비용은 최대 30% 낮췄다. xAI도 21일 최신 모델 ‘그록 4.7’을 공개하면서 위험한 요청을 거부하고, 이른바 ‘탈옥’ 공격을 막는 성능을 높이는 등 안전장치를 강화했다고 밝혔다. 사용 단계에서 AI 행동을 제한하는 기술도 나오고 있다. 엔비디아는 28일 ‘오픈 에이전트 세이프티 플랫폼’을 공개했다. 소프트웨어 ‘오픈셸(OpenShell)’은 AI가 접근할 수 있는 파일과 프로그램, 네트워크 등을 미리 제한한다. 하드웨어 기반 감시 장치 ‘센트리(Sentry)’는 AI가 정해진 범위를 벗어나면 이를 감지해 밀리초 단위로 격리한다. 모델 자체를 안전하게 만드는 것만으론 부족할 수 있다고 보고 AI가 실제로 할 수 있는 행동에도 별도의 울타리를 두는 것이다. 엔비디아는 이 기술을 적용했다면 올여름 오픈A...

Read Entire Article