구글은 차세대 플래그십 AI 모델 '제미나이 4 아르곤'을 일부 사이버보안 파트너에 먼저 공개하고, 추가 테스트 뒤 유료 가입자에게 접근을 넓힐 계획이라고 밝혔다. 이 모델은 소프트웨어 엔지니어링, 금융, 법률, 사이버보안처럼 긴 시간의 복잡한 작업에 맞춰 개발됐고, 최대 100만 토큰 입력과 텍스트·동영상 이해 능력, 안전성, 보안 평가 성과를 강점으로 내세웠다. 여러 벤치마크에서는 경쟁 모델을 앞섰고, 보안 관련 평가에서도 오픈AI의 '아스트라'보다 높은 결과를 기록했다고 설명했다.
다만 내부에서는 실제 업무 성능을 두고 다른 평가가 나온다. 블룸버그는 코딩 성능이 일정하지 않고 앱·웹사이트의 화면 구성과 사용자 경험을 다루는 프런트엔드 작업에서 약점이 있다는 내부 지적을 전했다. 이 때문에 평가 점수에 개발 역량이 쏠리는 '벤치맥싱' 우려도 함께 제기됐다. 구글은 코딩 성능이 떨어진다는 주장에 동의하지 않았지만, 제미나이 4의 성패는 검색의 AI 답변, 지도, 지메일, 크롬 등 핵심 서비스 전반에 연결될 수 있어 실제 사용 환경에서의 완성도가 더 중요한 기준으로 남았다.
