9월 28, 20:06
앤스로픽, 소네트 5.5 출시…코딩 성능 오퍼스 5.5 앞서고 가격은 절반
Anthropic's Claude Sonnet 5.5 Is Out, Beats Opus 5.5 at Coding for Half the Price
Decrypt

앤스로픽은 월요일 클로드 소네트 5.5(Claude Sonnet 5.5)를 출시했다. 이 모델은 6월 출시된 소네트 5를 업그레이드한 제품이다. 앤스로픽은 소네트 5.5의 실행 속도가 소네트 5보다 30% 넘게 빠르다고 밝혔다. 앤스로픽은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 가격을 책정했다. 이는 오퍼스 5.5 가격의 절반이다. 소네트 5.5는 작업당 사용하는 토큰이 소네트 5보다 거의 3분의 1 적어 운영 비용이 더 저렴하다. Terminal-Bench 4.0에서 소네트 5.5는 70.6%를 기록했다. 오퍼스 5.5는 이 시험에서 66.4%를 기록했다. 소네트 5는 10.3%를 기록했다. Terminal-Bench 4.0은 AI 에이전트가 명령어를 독립적으로 입력해 복잡한 전문 업무를 수행할 수 있는지를 측정한다. 독립 시험기관 Artificial Analysis는 자체 시험에서 소네트 5.5에 63.6%를 부여했다. Artificial Analysis는 오퍼스 5.5에 59.6%를, OpenAI의 GPT-6 Astra에 59.1%를 부여했다. 앤스로픽은 높은 노력 설정의 소네트 5.5가 FrontierCode에서 GPT-6 Sol과 맞먹으며, 작업당 비용은 약 5분의 1이라고 밝혔다. 44개 직종의 전문 업무를 엘로 순위로 측정하는 GDPval-AA에서 소네트 5.5는 1,844점을 기록했다. 기사에서는 오퍼스 5.5의 1,846점과 사실상 동점이라고 설명했다. GPT-6 Sol은 1,487점을 기록했다. Artificial Analysis는 소네트 5.5를 오퍼스 5.5에 이어 2위로 평가했다. Artificial Analysis에 따르면 소네트 5.5는 시험한 모델 중 작업당 토큰 사용량이 가장 많았다. 최대 노력 설정에서 소네트 5.5는 시험 작업당 약 19만 3,000개의 토큰을 생성했는데, 이는 Artificial Analysis가 측정한 최대치다. 해당 설정에서 작업당 비용은 7.60달러였다. 이는 소네트 5의 작업당 비용보다 약 50% 높으며, 최대 30% 절감된다는 앤스로픽의 주장과 배치된다. 앤스로픽은 자사 앱의 기본 설정인 중간 노력 수준에서 소네트 5.5가 소네트 5의 최고 코딩 점수를 넘어서면서 비용은 10분의 1 미만이라고 밝혔다. Artificial Analysis는 높은 노력 설정이 가장 가성비가 좋다고 밝혔다. OpenAI는 지난주 GPT-6 Sol 가격을 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 인하했다. GPT-5.6 Terra의 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 12달러다. 앤스로픽은 Terra의 벤치마크 결과를 공개하지 않았다. 앤스로픽의 표는 자체 보고 자료다. Artificial Analysis는 출시 전 빌드에서 버그가 있는 버전을 시험했다. 앤스로픽은 이 버그가 점수에 미친 영향은 거의 없거나 점수를 약간 낮췄을 것으로 본다. 앤스로픽은 지속적인 판단력이 필요한 복잡한 업무에서는 오퍼스 5.5가 여전히 확실히 더 강하다고 밝혔다. 클로드 하이쿠 5.5(Claude Haiku 5.5)는 대량 처리와 비용 민감형 애플리케이션을 위해 개발됐으며, 앞으로 몇 주 안에 출시될 예정이다.
This content is an AI-generated summary/analysis for informational purposes only and does not constitute investment advice.