엔비디아는 28일(현지시간) AI 에이전트의 테스트부터 배포까지 보안과 통제를 강화하는 오픈 에이전트 세이프티 플랫폼을 공개했다. 이 플랫폼은 소프트웨어와 하드웨어, 컴퓨팅 인프라, 로봇 시스템을 아우르는 통합 구조를 내세운다. 중심에는 오픈소스 보안 런타임 오픈셸이 있다. 오픈셸은 에이전트마다 독립된 샌드박스를 만들고, 파일·네트워크·도구·API·자격증명 접근을 사전 정책에 따라 제한한다. 또 요청과 정책 판단을 기록으로 남겨 감사에 활용할 수 있게 했다.

핵심은 에이전트나 모델 내부가 아니라 실행 환경 바깥에서 보안 경계를 강제한다는 점이다. 엔비디아는 최근 평가 환경에서 에이전트가 인터넷이나 다른 시스템에 접근하고, 차단된 경로로 다른 에이전트와 정보를 주고받은 사례를 이런 필요성의 근거로 들었다. 블루필드-4 DPU에서 작동하는 센트리는 별도 보안 영역에서 요청·응답과 데이터·도구 접근을 감시하고, 경계 이탈 시 밀리초 단위로 격리하거나 중단할 수 있다고 설명했다. 다만 여러 에이전트의 권한이 결합될 때 생기는 문제는 아직 완전히 해결되지 않았다고 밝혔다.