Anthropic이 Claude 5.5 패밀리의 두 번째 모델 Claude Sonnet 5.5를 출시했다. Opus 5.5 대비 출력 속도 30% 이상 빠르고, 같은 태스크를 더 적은 토큰으로 처리해 실질 비용이 최대 30% 낮다. 주요 벤치마크 점수는 Opus 5.5와 거의 차이가 없다.
패밀리 내 포지셔닝
Claude 5.5 라인업은 용도별로 역할이 나뉜다. Opus 5.5는 세심한 판단이 필요한 복잡한 태스크용, Sonnet 5.5는 버그 수정·문서 작성·프레젠테이션·스프레드시트처럼 범위가 명확한 일상 업무용이다. 수주 내 출시 예정인 Haiku 5.5는 고처리량·저비용 사용 사례를 겨냥한다.
▼ Claude Sonnet 5.5 vs Opus 5.5 핵심 비교
| 항목 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 출력 속도 | Opus 5.5 대비 30%+ 빠름 | 기준 |
| 태스크당 비용 | 최대 30% 낮음 | 기준 |
| 입력 토큰 (백만 기준, $) | 2 | 4 |
| 출력 토큰 (백만 기준, $) | 10 | 20 |
| 캐시 읽기 (백만 기준, $) | 0.20 | 0.20 |
| 캐시 쓰기 (백만 기준, $) | 2.50 | 5 |
토큰당 단가는 전작 Sonnet 5와 동일하다. 비용 절감은 단가 인하가 아니라 태스크당 사용 토큰 수가 줄었기 때문이다.
벤치마크: 코딩에서 가장 큰 도약
성능 향상이 가장 두드러진 영역은 코딩이다. 에이전틱 코딩 테스트 Terminal-Bench 4.0에서 Sonnet 5.5는 70.6%를 기록했다. 전작 Sonnet 5의 10.3%에서 크게 뛰었고, Opus 5.5(66.4%)를 오히려 웃돈다. 실제 Cursor 편집기 세션을 재현하는 CursorBench 4.0에서는 Sonnet 5.5가 55.5%로 Opus 5.5(57.8%)에 2점 차까지 근접했다.
▼ 주요 벤치마크 비교
| 벤치마크 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1 (점수) | 1,844 | 1,449 | 1,846 |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% |
| Chartography | 61.6% | 15.6% | 64.4% |
지식 업무 벤치마크 GDPval-AA에서 Sonnet 5.5는 1,844점으로 Opus 5.5(1,846점)와 사실상 동점이다. 비교 대상인 OpenAI GPT-6 Sol은 1,487점이다.
비용 절감이 국내 개발자에게 미치는 영향
Claude API를 활용하는 국내 스타트업과 개발자에게 태스크당 비용 30% 절감은 월 청구액에 직접 반영되는 수치다. 토큰 단가 자체는 그대로지만 같은 작업을 더 적은 토큰으로 처리하기 때문에 실사용 비용이 낮아진다. 엔터프라이즈 도입 검토 시 가격 장벽이 낮아지는 실질 요인이다.
사이버보안 강화 및 가용성
Sonnet 5.5는 전작보다 사이버보안 능력이 크게 향상됐다. Anthropic은 Sonnet 모델로는 처음으로 고위험 사이버보안 요청을 Sonnet 5로 자동 우회하는 안전장치를 도입했다. Cyber Verification Program을 통해 검증된 전문가는 단계별 접근 권한을 신청할 수 있다. 증류 공격 방어용 안전 분류기도 추가됐다.
모델 ID는 claude-sonnet-5-5이며, Amazon Web Services·Google Cloud·Microsoft Azure 등 주요 클라우드 플랫폼에서 즉시 사용 가능하다. 데이터 무보존(zero data retention) 옵션도 제공한다.








