Anthropic이 Claude Sonnet 5.5를 공개했다. 이 모델은 현재 API, AWS, Google Cloud, Microsoft Azure에서 claude-sonnet-5-5로 제공된다. 가격은 입력 100만 토큰당 2달러, 출력 10달러로 Sonnet 5와 같고, Opus 5.5의 절반 수준이다. 출력 속도는 Sonnet 5보다 30% 이상 빨라졌고, 더 적은 토큰과 도구 호출로 작업을 끝내면서 작업당 비용도 최대 30% 낮아졌다고 설명했다. Anthropic은 낮거나 중간 수준의 추론 설정에서도 Sonnet 5의 최고 점수를 작업당 대략 10분의 1 비용으로 넘을 수 있다고 밝혔다.

성능 비교에서 Sonnet 5.5는 실제 터미널 작업을 평가하는 Terminal-Bench 4.0에서 70.6%로 Opus 5.5의 66.4%를 앞섰다. 지식 작업 지표인 GDPval-AA v2.1은 1844로 Opus 5.5의 1846과 거의 같았고, 컴퓨터 사용과 일상 작업에서도 근접한 수치를 보였다. 반면 어려운 순수 코딩 평가인 FrontierCode 1.1에서는 46.2%로 Opus 5.5의 54.4%에 못 미쳤다. 원문은 이를 근거로 Sonnet 5.5를 에이전트 반복 작업과 터미널 중심 업무의 기본 선택지로, Opus 5.5를 더 어려운 문제용 모델로 구분했다. 다만 수치는 Anthropic 설정 기준이어서 외부 검증은 더 필요하다고 덧붙였다.