Claude Sonnet 5.5는 일상적인 업무용 프로페셔널 작업을 위한 Anthropic의 효율성 중심 모델입니다. 2026년 9월 28일 출시되었으며, 가장 어려운 오픈 엔드 문제에서는 Opus 5.5 아래 포지션이지만 코딩, 문서 작성, 이미지 이해, 장시간 실행 작업에서 의미 있는 개선을 제공합니다. 가장 실용적인 변화는 비교적 간단합니다. Anthropic에 따르면 Sonnet 5 대비 출력 생성이 30% 이상 더 빠르며, 동일한 API 토큰 가격을 유지하고, 종종 더 적은 토큰을 사용하기 때문에 완료된 작업당 최대 30%까지 비용이 줄어들 수 있습니다.
이 모델은 모든 요청마다 Opus 비용을 지불하지 않고도, 잘 정의된 업무에 충분히 유능한 모델을 원하는 사람들을 위해 설계되었습니다. 모델 선택은 단지 최고 벤치마크 점수만이 아니라는 점이 중요합니다. 지연 시간, 재시도 횟수, 토큰 사용량, 그리고 사람의 검토가 실제 워크플로우 비용에 더 큰 영향을 줄 수 있습니다.
Claude Sonnet 5.5 한눈에 보기
| 세부 정보 | Claude Sonnet 5.5 |
|---|---|
| 출시일 | 2026년 9월 28일 |
| API 모델명 | claude-sonnet-5-5 |
| 표준 입력 가격 | 1M 토큰당 $2 |
| 표준 출력 가격 | 1M 토큰당 $10 |
| 캐시 읽기 가격 | 1M 토큰당 $0.20 |
| 캐시 쓰기 가격 | 1M 토큰당 $2.50 |
| 최적의 용도 | 범위가 명확한 코딩 및 프로페셔널 작업 |
| 사용 가능 채널 | Claude 제품, Claude Platform, AWS, Google Cloud, Microsoft Azure |
이 수치는 Anthropic의 Sonnet 5.5 발표에서 가져왔습니다. 클라우드 제공업체의 가격 및 액세스 조건은 달라질 수 있으므로, 팀은 프로덕션 비용을 추정하기 전에 실제로 사용하는 플랫폼을 확인해야 합니다.
Sonnet 5에서 무엇이 바뀌었나?
업데이트의 강점은 모델이 질문에 단순 답하는 수준이 아니라 실제로 “일을” 수행해야 하는 상황에서 드러납니다. Anthropic은 버그 수정, 다듬어진 문서, 프레젠테이션, 스프레드시트, 시각 디자인, 그리고 더 긴 작업을 강조합니다. Sonnet 5.5는 조절 가능한 노력도 지원합니다. 낮은 설정은 속도와 토큰 사용량을 우선하고, 높은 설정은 더 많은 추론과 확인을 가능하게 합니다. Claude Code와 그 앱에서는 기본값을 Medium으로 두고, Claude Platform은 기본값을 High로 설정합니다.
헤드라인으로 제시된 속도와 비용 주장은 표현을 꼼꼼히 확인할 필요가 있습니다. “30%+ 더 빠름”은 Sonnet 5 대비 출력 생성 속도를 의미합니다. “최대 30% 더 저렴”은 각 토큰에 대한 할인이라기보다 Anthropic이 관찰한 작업당 비용을 뜻합니다. 표기된 API 가격은 입력 100만 토큰당 $2, 출력 100만 토큰당 $10으로 그대로이므로, 실제 절감 효과는 새 모델이 더 짧은 답변으로 작업을 끝내는지, 재시도 횟수를 줄이는지, 또는 도구 호출을 더 적게 하는지에 달려 있습니다.

Claude Sonnet 5.5 벤치마크
Anthropic은 에이전트형 코딩과 지식 업무 전반에 걸친 여러 평가를 공개했습니다. 일부 환경에서는 Sonnet 5 대비 큰 개선을 보이고, 다른 환경에서는 Opus에 거의 근접한 결과를 보입니다.
| 벤치마크 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | 보고되지 않음 |
| FrontierCode 1.1 Main | 최대(Max) 기준 46.2% | 42.4% | 54.4% | 49.3%; Xhigh 기준 52.1% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | 보고되지 않음 |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
이 표는 유용하지만, 보편적인 순위표는 아닙니다. 노력 설정, 에이전트 운영 환경, 도구, 안전장치, 채점 방식이 모두 다릅니다. Anthropic도 더 많은 추론이 항상 결과를 개선하지는 않는다고 언급합니다. FrontierCode에서는 Max 설정의 Sonnet 5.5가 때때로 요청된 범위 밖의 변경을 만들었습니다. 가장 좋은 구성은 가장 많은 연산을 쓰는 방식이 아니라, 제어된 수정으로도 수용 가능한 결과를 만들어내는 방식입니다.
코딩과 에이전트 작업
Terminal-Bench 4.0에서 Sonnet 5.5가 기록한 70.6% 결과는 이번 릴리스에서 가장 눈에 띄는 숫자이지만, 그 주변의 워크플로우가 헤드라인보다 더 중요합니다. 개발자에게 유용한 코딩 모델은 저장소를 이해하고, 특정한 변경을 수행하며, 적절한 점검을 실행한 다음 작업을 확장하기 전에 멈출 수 있어야 합니다. 출력이 쉽게 검토 가능할 때만 속도는 가치가 있습니다.
그래서 Sonnet 5.5는 버그를 진단하는 일, 명확히 지정된 기능을 구현하는 일, 풀 리퀘스트를 검토하는 일, 알려진 컴포넌트를 리팩터링하는 일 같은 “범위가 제한된 작업”에 적합한 후보가 됩니다. 대규모 마이그레이션이나 애매한 아키텍처 결정은 여전히 Opus 5.5의 이점이 있을 수 있습니다. Anthropic은 Opus 5.5를 지속적인 판단을 위해 명시적으로 포지셔닝합니다. 따라서 공정한 평가는 실제 저장소 기반 작업을 사용하고, 정확성, 불필요한 수정 여부, 경과 시간, 총 토큰, 그리고 사람의 검토 시간까지 측정해야 합니다.
문서, 스프레드시트, 지식 업무
이번 릴리스는 소프트웨어 개발 밖에서도 똑같이 중요합니다. Anthropic은 Sonnet 5.5가 문서, 슬라이드, 스프레드시트를 만드는 데 강하다고 설명하는 한편, GDPval-AA 및 AA-Briefcase 결과는 프로페셔널 지식 작업을 반영하기 위한 것입니다. 이 점수들이 모든 보고서가 정확하다는 것을 증명하진 않지만, 명확한 소스 자료와 검증 가능한 산출물이 있는 구조화된 작업에 대해 모델을 테스트하는 데 도움이 됩니다.
실무 워크플로우는 여러 보고서, 미팅 노트, 스프레드시트로 시작할 수 있습니다. 그리고 모델에게 합의 사항과 모순을 찾아내고, 소스 참조를 포함해 수치를 추출한 뒤, 임원용 브리프 초안을 작성하도록 요청하는 식입니다. 중요한 안전장치는 검증입니다. 수치에 대한 주장은 반드시 소스와 대조해 확인해야 하며, 중요한 결론도 여전히 자격을 갖춘 사람의 검토가 필요합니다. 첫 번째 과제가 섞인 소스 자료를 정리하는 것이라면, iWeaver의 AI Summarizer가 PDF, 문서, 웹페이지, 오디오, 이미지, 비디오를 더 깊은 분석에 앞서 요약 또는 구조화된 노트로 바꾸는 데 도움을 줄 수 있습니다.
맥락 속 가격
Sonnet 5.5와 GPT-6 Sol은 입력 100만 토큰당 $2, 출력 100만 토큰당 $10이라는 동일한 표준 리스트 가격을 공유합니다. Opus 5.5는 각각 $4와 $20입니다. 이러한 수치는 Sonnet이 반복적이고 범위가 잘 정의된 작업에 매력적이게 만들지만, 토큰 레이트 비교만으로는 충분하지 않습니다. 컨텍스트 크기, 캐싱, 도구 요금, 추론 노력, 실패한 실행 횟수, 출력 길이 등 모든 요소가 최종 청구액에 영향을 줍니다.
프로덕션 평가에서는 토큰당 가격만 보지 말고, 대표적인 작업 묶음을 선정해 총 작업 비용을 기록하세요. 수정이 반복적으로 필요한 저가 모델은 예상보다 더 많은 비용이 들 수 있습니다. 반대로 고가 모델이라도 고가치 작업을 한 번에 마무리하면 더 경제적일 수 있습니다. 또한 모델 업데이트 이후에는 제공업체의 동작과 서빙 설정이 바뀔 수 있으므로, 동일한 테스트 세트를 다시 실행해야 합니다.
Claude Sonnet 5.5, 써볼 만한가요?
Sonnet 5.5는 대부분의 업무가 명확히 범위가 정해져 있고, 응답성과 예측 가능한 API 가격, 그리고 뛰어난 코딩 또는 문서 성능을 중요하게 생각한다면 테스트할 가치가 있습니다. 반대로 문제가 애매하거나, 미묘한 오류의 비용이 큰 경우, 또는 여러 단계에 걸쳐 지속적인 판단이 필요한 작업이라면 기본 선택으로 “더 명확히” 옳다고 보긴 어렵습니다. 이런 경우는 Opus 5.5의 명시된 역할에 더 가깝습니다.
가장 강한 결론은 Sonnet 5.5가 “모든 대안보다 우수하다”는 것이 아닙니다. Anthropic이 일상용과 프리미엄 티어 사이의 격차를 줄이면서도, 의미 있는 가격 차이는 유지했다는 점입니다. 벤치마크를 참고해 어떤 것이 시험해볼 가치가 있는지 결정한 다음, 여러분의 소스, 프롬프트, 검토 기준, 그리고 총 작업 비용에 따라 선택하세요. 티어를 직접 결정하려면 Claude Sonnet 5.5 vs Opus 5.5를 참고하고, 설정 아이디어는 How to Use Claude Sonnet 5.5로 이어서 확인하세요.
