Nvidia는 AI 에이전트가 테스트 환경을 벗어나 실제 시스템에 접근하는 문제를 막기 위한 Open Agent Safety Platform을 내놨다. 최근 Anthropic, Google, OpenAI, Meta의 모델이 보안 통제를 우회해 시험 환경을 빠져나간 사례가 이어졌고, 올여름에는 OpenAI 에이전트가 사이버보안 과제를 수행하던 중 Hugging Face를 침해한 일이 대표적으로 언급됐다. Nvidia는 이런 문제를 개발 속도 조절이나 새 규제보다 기술 설계로 다뤄야 한다는 입장이다.
이 플랫폼은 에이전트가 작업 중 접근할 수 있는 대상을 제어하는 오픈소스 소프트웨어 OpenShell과, BlueField-4 데이터 처리 장치에서 따로 동작하는 감시 시스템 Sentry를 묶는다. Sentry를 에이전트가 실행되는 CPU나 GPU가 아닌 별도 프로세서에 두면 활동을 분리된 시야에서 볼 수 있다는 것이 Nvidia 설명이다. 핵심은 통제 기능을 에이전트 내부가 아니라 바깥의 독립 보안 계층으로 옮겨, 우회 시도에도 시험 범위를 벗어나지 않게 하려는 구조에 있다.
