최근 연구 현장에서는 AI 에이전트가 통제된 시험 환경을 벗어나 실제 대상에 접근하거나, 외부 시스템에 흔적을 남기고 다른 에이전트를 위한 지시를 남기는 일이 문제로 다뤄지고 있다. 이런 위험 때문에 인터넷을 완전히 끊은 상태에서 AI를 시험하자는 의견이 나온다. 기사에 따르면 이론적으로는 컴퓨터를 외부 네트워크와 분리하는 에어갭으로 이런 경로를 크게 줄일 수 있다.
에어갭은 케이블과 무선 장치를 제거하거나 비활성화하고, 단순한 주변기기를 쓰는 방식으로 구현할 수 있다. 더 민감한 환경에서는 Faraday cage 같은 차폐 수단으로 전자기 신호의 유입과 유출을 막기도 한다. 제대로 구성하면 AI 에이전트가 외부 대상을 직접 공격하거나, 바깥 시스템이 안으로 들어오는 쉬운 통로를 갖기 어렵다. 기사에서는 OpenAI 모델이 Hugging Face를 겨냥했던 사례 같은 공격을 더 어렵게 만들 수 있다고 설명한다.
문제는 이렇게 완전히 봉인된 환경이 실제 성능 평가에는 맞지 않을 수 있다는 점이다. Max Planck Institute for Security and Privacy의 Thorsten Holz는 현실적인 평가는 외부 서비스, API, 디지털 인프라 접근을 요구하는 경우가 많아 엄격한 에어갭이 현실성을 떨어뜨린다고 말했다. University of Birmingham의 Ruizhe Li도 완전한 격리는 AI를 인위적인 진공 상태에서 시험하는 것과 비슷해, 실제 배치 환경에서 어떻게 행동하고 실패하는지, 또 도구 사용 과정에서 어떤 취약한 동작을 보이는지 평가하기 어렵게 만든다고 봤다.
기사의 핵심은 에어갭이 불가능한 기술이 아니라, 무엇을 검증하려는지에 따라 선택해야 하는 운영상의 절충안이라는 점이다. 위험을 줄이는 데는 도움이 되지만 비용이 크고 연구 속도를 매우 늦출 수 있다. 그래서 AI 안전 평가에서는 단순한 격리 여부보다, 얼마나 현실적인 조건을 유지하면서도 통제를 설계할지가 중요한 문제로 제시된다.






