퀄컴 테크놀로지스는 10일(현지시간) 스마트폰에서 에이전틱 AI를 직접 구동하기 위한 차세대 퀄컴 헥사곤 NPU를 공개했다. 에이전틱 AI는 질문에 답하는 수준을 넘어, 사용자의 상황을 이해하고 여러 애플리케이션과 도구를 오가며 작업을 수행하는 방식이다. 이에 맞춰 퀄컴은 하나의 대형 모델을 돌리는 구조보다, 작업과 상황에 따라 여러 특화 모델을 선택적으로 실행하는 방향으로 NPU의 연산과 메모리 아키텍처를 재설계했다고 설명했다.

새로운 NPU에는 트랜스포머 연산에 특화된 전용 엘리먼트 가속기와 기존보다 50% 확대된 공유 메모리 시스템이 적용됐다. 엘리먼트 가속기는 생성형 AI와 에이전틱 AI의 핵심 모델 구조인 트랜스포머 연산을 처리하도록 설계됐고, 스칼라·벡터·매트릭스 확장 기능을 결합해 대규모 AI 모델에서 반복적으로 발생하는 연산을 가속한다.

퀄컴은 이 NPU가 지속적인 AI 처리, 긴 문맥 추론, 멀티모달 모델, 동시 에이전트 실행, 낮은 지연시간을 고려해 설계됐다고 밝혔다. 스마트폰 AI가 한 번의 추론 속도만 중요한 단계에서, 여러 단계의 추론과 도구 호출을 이어가는 단계로 바뀌면서 모바일 프로세서의 구조도 달라지고 있다는 점이 이번 공개의 핵심이다.