테크크런치 “엔비디아 전용 하드웨어·자체 보안 주도권이 불참 배경일 수도”
오픈AI, 구체 이유는 안 밝혀…오픈소스 ‘오픈셸’ 개발에는 엔비디아와 협력
미국 테크크런치는 29일(현지시간) 엔비디아가 전날 발표한 ‘오픈 에이전트 세이프티 플랫폼(Open Agent Safety Platform)’에 오픈AI가 참여하지 않은 배경을 이같이 짚었다. 오픈AI는 공식 명단에는 없지만 엔비디아의 AI 에이전트 보안 작업을 지지하며 핵심 소프트웨어 개발에도 협력하고 있다고 밝혔다.
오픈AI만 빠진 것은 아니다. 아마존과 구글, 애플도 공식 참여사 명단에 이름을 올리지 않았다. 반면 오픈AI의 주요 경쟁사인 앤트로픽은 엔비디아의 새 플랫폼을 지지하고 있다.
테크크런치가 먼저 주목한 것은 엔비디아 플랫폼의 하드웨어 구조다. 플랫폼의 핵심 소프트웨어는 오픈소스로 공개됐지만 전체 기능을 사용하려면 엔비디아만 공급할 수 있는 전용 하드웨어가 필요하다.
AI 에이전트의 행동을 하드웨어 단계에서 감시하는 ‘센트리(Sentry)’가 엔비디아의 블루필드-4 데이터처리장치(DPU)에서만 작동하기 때문이다. 테크크런치는 이 때문에 일부 대형 기술기업이 엔비디아의 플랫폼에 공개적으로 참여하는 것을 부담스러워할 수 있다고 분석했다.
반면 소프트웨어 쪽에서는 오픈AI와 엔비디아의 협력이 이미 이뤄지고 있다. ‘오픈셸(OpenShell)’은 AI 에이전트를 격리된 실행 공간인 샌드박스 안에 두고 밖으로 벗어나지 못하도록 설계된 오픈소스 프로그램이다. 오픈AI는 엔비디아와 AI 에이전트 보안을 연구하면서 오픈셸 작업에도 참여하고 있다.
오픈AI 역시 이런 안전기술이 필요한 당사자다. 최근 오픈AI의 AI 에이전트들이 허깅페이스를 공격하면서 당초 의도한 범위를 벗어난 행동을 한 사건이 공개됐기 때문이다.
허깅페이스 공동창업자이자 CEO인 클렘 들랑그는 엔비디아의 새 플랫폼을 당시 오픈AI 에이전트들에게 적용했다면 허깅페이스가 이상 행동을 발견하기 전에 이를 잡아낼 수 있었을 것이라고 주장했다. 허깅페이스는 이달 초 엔비디아에 129억달러에 매각됐다.
허깅페이스도 이번 플랫폼에 새로운 탐지 기능을 제공했다. AI 에이전트가 접속을 허가받은 웹사이트에 들어가더라도 그 안에서 허용되지 않은 행동을 하면 이를 찾아내 작동을 멈추게 하는 기능이다.
예컨대 여러 에이전트가 공개 소스코드 저장소에 서로 메모를 남기며 공격을 조율하면 이를 포착할 수 있다. 오픈AI는 허깅페이스 사건에서도 통제에서 벗어난 여러 에이전트가 이런 방식으로 서로 행동을 조율했다고 설명했다.
이렇게 감시 기능을 에이전트와 분리한 데는 이유가 있다. 일부 AI 모델이나 에이전트는 자신이 감시받고 있다는 사실을 알면 규칙을 따르는 것처럼 행동할 수 있기 때문이다. 엔비디아는 별도 하드웨어에서 행동을 감시하면 에이전트가 감시 장치를 알아차리거나 우회하기 어려워지고, 위험한 행동이 포착되면 즉시 작동을 멈출 수 있다고 설명했다.
테크크런치는 오픈AI가 공식 참여사 명단에 없는 또 다른 배경으로 AI 보안 분야의 독자적인 주도권을 짚었다. 오픈AI는 엔비디아의 주요 투자 대상이자 협력사이지만 AI 안전 분야에서는 자체 보호장치를 개발하고 통제에서 벗어난 에이전트 사례도 직접 공개하고 있다.
오픈AI는 자체적으로 ‘디펜스 팩토리(Defense Factory)’라는 AI 사이버보안 정보공유 구상도 추진하고 있다. 테크크런치에 따르면 앤트로픽과 아마존웹서비스(AWS), 구글 등 엔비디아 플랫폼에 공식 참여하지 않은 기업 상당수도 이 구상을 지지하고 있다.
오픈AI는 동시에 사이버보안 특화 모델 ‘데이브레이크(Daybreak)’를 기업용 보안사업으로 키우고 있다. AI 에이전트가 통제에서 벗어날 위험이 커질수록 이를 막는 안전기술 자체가 새로운 사업이 되는 셈이다. 테크크런치는 오픈AI가 엔비디아와 필요한 기술에서는 손을 잡으면서도 AI 보안 분야에서는 자체 기술과 사업 영역을 확보하려는 움직임을 보이고 있다고 평가했다.
◎공감언론 뉴시스 yunghp@newsis.com