스페이스XAI는 21일(현지시간) 차세대 AI 모델 그록 4.7을 출시했다. 이 모델은 코딩과 지식 작업에 초점을 맞췄고, 장시간 이어지는 복잡한 작업에서의 추론 능력과 자체 검증 기능, 사이버보안 성능을 강화했다고 밝혔다. 그록 4.6보다 더 큰 기반 모델을 사용했고, 여러 시간에 걸친 어려운 작업을 위해 강화학습을 더 길게 진행했다. 생성한 답변과 작업 결과를 스스로 정밀하게 확인하고, 긴 작업 흐름을 관리하는 능력도 보강했다.

사용 환경도 넓혔다. 이날부터 커서와 xAI의 그록 빌드에서 사용할 수 있고, 그록 API와 제3자 코딩 하네스, 모델 라우터, 클라우드 플랫폼을 통해서도 제공된다. 가격은 그록 4.6과 같으며 입력 토큰 100만개당 2달러, 출력 토큰 100만개당 6달러다. 캐시 적중 토큰은 100만개당 0.50달러이고, 출력 속도가 두 배인 고속 버전은 두 배 가격이다. 컨텍스트 창은 최대 50만 토큰으로 유지됐다.

성능은 분야별로 엇갈렸다. 에이전트형 지식 작업 평가인 AA-Briefcase에서는 1657점, GDPval-AA에서는 1695점을 기록해 전작보다 올랐고, 코딩 에이전트 지수에서도 56점으로 개선됐다. 반면 다른 과제에서는 그록 4.6과 비슷한 수준이거나 일부 하락한 항목도 있었다. 또 xhigh 추론 설정에서 과제당 평균 8만1000개의 출력 토큰을 사용해, 긴 추론과 반복 검증이 성능 향상에 도움을 준 대신 비용과 처리 효율성에는 부담이 될 수 있다는 점도 드러났다.

결과적으로 아티피셜 애널리시스 지능 지수에서 46점을 기록하며 전체 7위에 머물렀다. 스페이스XAI는 신규 세이프가드 스택도 함께 강조하며 탈옥 공격과 위험 요청 거부 성능이 자체 모델 중 가장 우수하다고 설명했다. 다만 이번 4.7은 최상위 프런티어 모델과의 격차를 줄이는 단계에 가깝고, 본격적인 경쟁은 매개변수가 2조5000억개로 늘어날 예정인 그록 4.8에서 이어지게 됐다.