요약
Claude Sonnet 5.5는 2026년 9월 28일에 출시된 Anthropic의 최신 Sonnet급 모델입니다. 코딩, 명확히 범위가 정의된 에이전트형 작업, 문서 제작, 컴퓨터 사용, 멀티모달 분석을 위해 Claude Opus 5.5를 보완하는 더 빠르고 비용이 낮은 모델로 포지셔닝됩니다.
이 모델은 표준 가격을 입력 토큰 100만 개당 $2, 출력 토큰 100万 개당 $10로 유지합니다. Anthropic는 Sonnet 5 대비 30% 이상 빠른 출력 생성과, 더 적은 토큰과 단계로 작업을 마치는 경우가 많아 작업 단위 비용이 최대 30% 낮아질 수 있다고 보고합니다.
공개된 결과에는 Terminal-Bench 4.0에서 70.6%, CursorBench 4.0에서 55.5%, GDPval-AA v2.1에서 1844, OSWorld 2.1에서 80.1%가 포함됩니다. 실질적 가치는 단일 점수에 있지 않습니다. Sonnet 5.5는 여러 전문 작업 평가에서 Opus 5.5에 근접하면서도 Sonnet급의 낮은 표준 토큰 가격을 유지합니다.
핵심 요점
- Claude Sonnet 5.5는 Claude 5.5 패밀리의 두 번째 모델로, 가장 모호하고 개방형인 과제보다는 빠른 프로덕션 작업에 최적화되어 있습니다.
- 1M 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰, 텍스트 및 이미지 입력, 적응형 사고, 도구 사용, 구조화된 응답을 지원합니다.
- 표준 Claude API 가격은 입력 $2/M, 출력 $10/M, 캐시 읽기 $0.20/M, 5분 캐시 쓰기 $2.50/M입니다.
- Anthropic는 Sonnet 5 대비 30%+ 더 빠른 출력과 코딩, 컴퓨터 사용, 차트 이해, 장기 지식 작업 전반의 강한 향상을 보고합니다.
- Claude API 모델 ID는 claude-sonnet-5-5이며, 개발자는 CometAPI의 Claude Sonnet 5.5 API로도 접근할 수 있습니다.
Claude Sonnet 5.5란?
Claude Sonnet 5.5는 Anthropic의 최신 범용 Sonnet 모델로, Claude Opus 5.5에 이어 Claude 5.5 패밀리의 두 번째 출시입니다. Anthropic는 이 모델을 플래그십을 대체하기보다는 Opus의 더 빠르고 저비용인 보완재로 포지셔닝합니다.
구분은 실용적입니다. Opus 5.5는 지속적 판단이 필요한 복잡하고 모호한 작업을 겨냥하는 반면, Sonnet 5.5는 범위가 명확한 작업, 버그 수정, 빠른 반복, 코딩, 문서 제작, 대량의 전문 워크플로에 최적화되어 있습니다.
가장 중요한 Claude Sonnet 5.5의 기능은?
이 모델은 1M 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰, 텍스트+이미지 입력, 적응형 사고, 조절 가능한 노력, 도구 사용, 구조화된 출력, 프롬프트 캐싱, 배치 처리, 그리고 Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS 전반의 지원을 결합합니다. 프로덕션 팀에 중요한 것은 단일 기능이 아니라, 빠른 생성 속도, 작업 단위 토큰 사용 감소, 그리고 여러 명확한 전문 워크로드에서 Opus에 근접한 성능의 조합입니다.
Claude Sonnet 5.5 벤치마크
Anthropic는 코딩, 장기 전문 작업, 컴퓨터 사용, 시각적 이해 전반에서 상당한 향상을 보고합니다. 아래 표는 회사가 공개한 평가 결과를 요약합니다.
| 벤치마크 및 공식 출처 | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | Xhigh에서 66.4% | 공개되지 않음 |
| FrontierCode 1.1 Main | Max에서 46.2% | 42.4% | 54.4% | Xhigh에서 49.3% / 52.1% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | 공개되지 않음 |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 도구 사용 시 64.5% | 54.9% | 67.7% | 원본 표에 보고되지 않음 |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% | 원본 표에 보고되지 않음 |
| Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
평가 조건과 주의사항: 점수는 모두 동일한 노력 설정에서 측정된 것이 아닙니다. Opus 5.5의 66.4% Terminal-Bench 결과는 Xhigh에서 보고되었습니다. Anthropic는 Sonnet 5.5가 FrontierCode에서 Max보다 Xhigh에서 더 높은 점수를 낼 수 있는데, 추가 검토 단계가 타임아웃이나 범위를 벗어난 편집을 유발할 수 있기 때문이라고 밝혔습니다. Artificial Analysis는 구조화된 출력 버그의 영향을 받는 사전 공개 Sonnet 5.5 배포에서 GDPval-AA와 AA-Briefcase를 실행했으며, Anthropic는 해당 버그가 이후 수정되었다고 말합니다. 또한 교차 벤더 GPT-6 Sol 수치 역시 2026년 9월 25일 OpenAI의 이미지 인코딩 문제 수정으로 인해 시의성이 지난 관측으로 봐야 합니다.
결과의 의미: Sonnet 5.5는 고립된 몇몇 점수에서 Sonnet 5를 앞서는 정도가 아닙니다. 코딩, 전문 작업, 컴퓨터 사용, 차트 인식에서 Opus 5.5에 한층 근접하면서도 Sonnet급 가격을 유지합니다. 또한 Anthropic는 낮음 또는 보통 노력에서 Sonnet 5.5가 일부 평가에서 Sonnet 5의 최고 점수를 대략 작업당 비용의 10분의 1 수준으로 능가할 수 있다고 보고합니다. 역량, 속도, 작업 단위 효율의 조합이 주요 경쟁 우위입니다.
Claude Sonnet 5.5는 얼마나 좋은가?
코딩
개선은 운영 측면에서도 나타납니다. Anthropic는 Sonnet 5.5가 코드베이스를 더 빠르게 이해하고, 도구 호출을 더 효율적으로 배치하며, 더 적은 단계로 작업을 수행해 작업당 비용을 낮춘다고 보고합니다. FrontierCode는 제안된 코드 변경이 병합 가능한지를 테스트하며, CursorBench는 실제 코딩 세션에서 가져온 모호한 다중 파일 작업을 사용합니다. 따라서 이 향상은 단순한 짧은 코드 생성뿐 아니라 저장소 수준의 실행과 판단을 반영합니다. 이러한 변화는 버그 수정, 코드 리뷰, 테스트 실행, 장기 코딩 에이전트에 중요합니다.

지식 작업
개선은 프로그래밍을 넘어섭니다. GDPval-AA는 44개 직종과 9개 주요 산업 전반의 실제 전문 작업을 테스트하므로, Sonnet 5.5의 1844점(대비: Sonnet 5는 1449, Opus 5.5는 1846)은 향상이 실험실 추론 테스트에 머무르지 않고 실용적 분석, 문서 제작, 의사결정 지원 작업으로 전이됨을 시사합니다.
Anthropic는 재무 분석, 문서 합성, 슬라이드 제작, 스프레드시트 작업, 차트 해석, 출처 검증, 정보 검색, 전문적 글쓰기를 모델의 개선 분야로 강조합니다.
초기 테스터들은 수치화가 어려운 개선도 보고했습니다. 더 명확한 협업, 더 자연스러운 대화형 판단, 디자인 감각의 강화 등입니다. Anthropic는 이 모델이 사용자 인터페이스에 완성도를 더하고 슬라이드 템플릿을 충분히 정확히 따라 최소한의 편집으로 데크를 만들 수 있다고 말합니다. 한 내부 운영 리뷰 테스트에서는 두 명의 전문가가 초안 1회를 수정 없이 발송 가능 판정했습니다.
보다 넓게 보면, Sonnet 5.5는 단지 더 저렴한 코딩 모델이 아니라 전문 작업 모델로 이해하는 것이 적절합니다.
컴퓨터 사용
Sonnet 5.5는 OSWorld 2.1에서 80.1%를 기록했으며, Sonnet 5는 57.0%, Opus 5.5는 81.8%입니다. OSWorld는 그래픽 컴퓨터 환경을 조작하는 능력을 평가하므로, 이 결과는 브라우저, 데스크톱 도구, 멀티모달 인터페이스 이해가 필요한 워크플로에서 큰 세대 개선과 Opus에 근접한 성능을 보여줍니다. Chartography 결과 역시 시각적 차트 인식에서 유사한 패턴을 보입니다. Sonnet 5.5는 61.6%, Sonnet 5는 15.6%입니다.
속도
Anthropic는 Sonnet 5.5가 Sonnet 5 대비 출력 생성이 30% 이상 빠르다고 보고하며, 출시 시점 기준 가장 빠른 Sonnet 모델입니다. 더 빠른 출력은 더 적은 도구 호출과 낮은 토큰 사용과 결합되어 에이전트 루프를 단축하고, 반복 코딩 중 대기 시간을 줄이며, 지원과 같은 대량 워크플로의 처리량을 개선합니다.
Claude Sonnet 5.5 비용은 얼마인가?
| 가격 및 공식 출처 | Claude Sonnet 5.5 | CometAPI: Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| 캐시 읽기 | $0.20 / 1M | $0.16 / 1M | $0.20 / 1M |
| 5분 캐시 쓰기 | $2.50 / 1M | $2 / 1M | $5 / 1M |
| 입력 토큰 | $2 / 1M | $1.60/M | $4 / 1M |
| 출력 토큰 | $10 / 1M | $8.00/M | $20 / 1M |
표준 토큰 요율에서 Sonnet 5.5는 입력과 출력 모두 Opus 5.5의 절반 비용입니다. 또한 Anthropic는 새로운 Sonnet이 동일한 작업을 완료하는 데 Sonnet 5보다 더 적은 토큰을 필요로 하는 경우가 많아 작업당 비용을 낮춘다고 말합니다.
이는 표준 Claude API 가격입니다. 클라우드 제공업체 가격, 지역 처리, 캐시 지속시간, 배치 할인, 장문맥 규칙에 따라 실효 비용은 달라질 수 있습니다.
Claude Sonnet 5.5는 어떤 안전성 변화를 도입했나?
Anthropic에 따르면 자동화된 행위 감사가 약 1,850개 시나리오를 포괄했으며, 대부분의 정렬, 오남용 저항성, 정직성 측정에서 Sonnet 5 대비 개선 또는 동등한 결과를 보였습니다.
사이버보안 안전장치
Sonnet 5.5가 전작보다 더 강한 사이버 능력을 갖추었기 때문에, Anthropic는 더 강력한 모델에 사용하는 것과 유사한 안전장치를 배치합니다. 일상적 소프트웨어 개발과 일반적인 버그 수정은 계속 지원되며, 더 고위험의 사이버보안 작업 일부는 더 안전한 모델 경로로 폴백될 수 있습니다.
생물학 안전장치
이 모델은 Sonnet 5와 동일한 생물학 안전장치를 사용합니다. 잠재적으로 해로울 수 있는 제한된 요청 집합을 목표로 하면서도 대부분의 연구, 교육, 임상 작업에는 영향을 주지 않습니다.
지식 증류 방지 보호장치
Anthropic는 Sonnet 5.5가 산업 규모의 증류 공격을 통한 추론 추출을 방지하기 위해 설계된 안전 분류기를 처음으로 탑재한 Sonnet 모델이라고 말합니다. 또한 preserved thinking을 확장하여, 사고 내용을 그것을 생성한 계정과 대화에 연동함으로써 해당 추론이 자유롭게 분리되어 다른 곳에서 재생되지 않도록 합니다. 대부분의 개발자는 이 변화를 체감하지 않겠지만, 계정 간 대화를 이동하거나 이전 시스템 메시지 상태를 변경하는 시스템은 마이그레이션 가이던스를 검토해야 합니다.
이러한 내용은 Anthropic가 보고한 안전장치에 대한 설명이며, 모든 배포에서의 안전성을 독립적으로 보장하는 것은 아닙니다. 팀은 자체 위협 모델, 정책, 고위험 워크플로에 대해 모델을 평가해야 합니다.
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
Claude Sonnet 5.5는 이 그룹에서 빠르고 효율적인 프로덕션 모델로 포지셔닝됩니다. Anthropic는 Claude Sonnet 5 대비 30% 이상 빠른 출력을 보고하면서도 동일한 표준 토큰 가격을 유지한다고 밝힙니다. Claude Opus 5.5는 더 어렵고 모호한 작업을 겨냥하며, GPT-6 Sol은 장문맥 코딩과 에이전트형 워크플로에서 가장 가까운 OpenAI 비교 대상입니다.
| 항목 | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| 포지셔닝 | 이전 Sonnet 프로덕션 모델 | 빠르고 효율적인 프로덕션 워크호스 | 고급 복합 추론 | 복잡한 코딩 및 에이전트형 워크플로 |
| 컨텍스트 윈도우 | 1M | 1M | 1M | 1.05M |
| 최대 출력 | 128K | 128K | 128K | 128K |
| 추론 제어 | 적응형 노력 | 적응형 노력 | 적응형 사고, 항상 활성화 | none, low, medium, high, xhigh, and max |
| 멀티모달 입력 | 텍스트 및 이미지 | 텍스트 및 이미지 | 텍스트 및 이미지 | 텍스트 및 이미지 |
| API 가용성 | Claude API 및 주요 클라우드 플랫폼 | Claude API 및 주요 클라우드 플랫폼 | Claude API 및 주요 클라우드 플랫폼 | Responses API 및 Chat Completions |
| 표준 입력/출력 가격 (1M당) | $2 / $10 | $2 / $10 | $4 / $20 | 입력 272K 토큰까지 $2 / $10 |
| 속도 | 기준선 | Sonnet 5 대비 30% 이상 더 빠름 | 더 어렵고 장시간 작업에 최적화 | 추론 노력 수준에 따라 다름 |
| FrontierCode 1.1 | 42.4% | Max에서 46.2% | 54.4% | Xhigh에서 49.3% / 52.1% |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| 가장 적합한 용도 | 기존 Sonnet 워크로드 | 대량 코딩 및 프로페셔널 에이전트 | 어렵고 모호하며 장시간 수행되는 작업 | OpenAI 네이티브 코딩, 에이전트, 도구, 장문맥 워크플로 |
이들 벤치마크 수치는 통제된, 영구적인 순위라기보다 교차 벤더 관측치입니다. 결과는 노력 설정과 배포 조건에 따라 달라집니다.
CometAPI를 통해 Claude Sonnet 5.5에 액세스하고 호출하려면?
Claude Sonnet 5.5는 Claude, Claude Platform, Amazon Web Services, Google Cloud, Microsoft Azure를 통해 이용할 수 있습니다. 여러 제공업체를 위한 OpenAI 호환 단일 인터페이스를 원한다면, 모델 식별자 claude-sonnet-5-5로 CometAPI의 Claude Sonnet 5.5 API를 통해 호출할 수 있습니다.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "이 코드베이스를 분석하고 영향이 가장 큰 버그 3가지를 식별해 주세요.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
프로덕션 환경에서는 API 키를 환경 변수에 저장하고, 노력 설정, 캐싱, 도구 호출, 재시도 동작, 작업 단위 토큰 사용량을 평가하세요.
Claude Sonnet 5.5의 Effort 설정이란?
Claude Sonnet 5.5는 속도와 토큰 사용량을 추론 깊이와 맞바꾸는 조절 가능한 노력 수준을 지원합니다. Anthropic는 Claude 앱과 Claude Code에서 기본값을 Medium effort로, Claude Platform에서는 High로 설정합니다.
낮은 노력 설정은 일상적이거나 구조가 높은 작업에 적합합니다. 높은 설정은 더 어려운 코딩, 분석, 에이전트형 작업에서 더 많은 추론과 점검을 가능하게 합니다. 따라서 프로덕션 예산 책정 시 토큰 가격뿐 아니라 노력, 도구 사용, 전체 작업 완료 비용을 함께 고려해야 합니다.
API: Sonnet 5와 비교해 무엇이 새로워졌나
기존 Sonnet 5 통합을 깨뜨리거나 변경할 수 있는 다섯 가지 변화가 있습니다.
- 생각 끄기 마이그레이션: thinking을 비활성화했던 통합은 **thinking: {"type": "between_tools"}**로 전환해야 합니다. 이 설정은 선행 thinking을 끄는 동시에 도구 사이 reasoning 동작은 유지합니다.
- 도구 강제 사용: 강제 도구 선택은 이제 오류를 반환합니다. 필요 시 엄격한 스키마와 함께 자동 도구 선택을 사용하세요.
- Thinking 블록 보존: thinking 블록은 모델과 대화에 연동됩니다. 변경 없이 그대로 다시 전달하고, 이전 시스템 메시지, 도구, 계정 컨텍스트를 변경한 뒤에도 재생 가능하다고 가정하지 마세요.
- 컴퓨터 사용 도구 버전: Claude API와 Google Cloud에서 이전 computer_20251124 도구는 더 이상 허용되지 않습니다. 현재 문서화된 컴퓨터 도구 세트로 마이그레이션하세요.
- Advisor 호환성: advisor 도구는 Claude Opus 4.8, Opus 4.7, Sonnet 5를 advisor로 거부합니다.
또 하나의 응답 형태 변화는 조용히 실패할 수 있습니다. 도구 호출 사이에 생성된 텍스트가 텍스트 블록 대신 thinking 블록에 나타날 수 있습니다. 진행 메시지를 스트리밍하는 애플리케이션은 블록 유형별로 응답을 처리하고 적절한 표시 모드를 설정해야 합니다. Sonnet 5.5는 또한 베타 단계의 메시지별 effort, 대화 중간 시스템 메시지, 베타 단계의 대화 중간 도구 변경, 캐시 가능한 프롬프트 최소 길이 512 토큰, 배치 처리, Files API 지원, PDF 및 비전 입력, 서버사이드/클라이언트사이드 도구를 추가합니다.
Claude 5.5 패밀리에서 Claude Sonnet 5.5의 의미
- Claude Opus 5.5: 복잡하고 고도의 판단이 필요한 장기 작업.
- Claude Sonnet 5.5: 효율적인 프로덕션, 코딩, 에이전트, 전문 작업.
- Claude Haiku 5.5: 고처리량, 비용 민감형 구성원으로 향후 출시 예정.
더 넓은 흐름은 단순히 원시 토큰 가격이나 단일 벤치마크에 집중하기보다, 성공적 작업당 비용, 추론 속도, 모델 라우팅을 중시하는 방향으로 이동하고 있습니다.
결론
Claude Sonnet 5.5는 Anthropic 프로덕션 티어에 효율성을 더한 업그레이드입니다. Sonnet 5의 $2/$10 표준 토큰 가격을 유지하면서 1M 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰, 크게 빨라진 생성 속도, 코딩·컴퓨터 사용·시각 이해·지식 작업 전반의 강한 향상을 제공합니다.
이 모델의 가장 강력한 근거는 워크로드 경제성입니다. 작업을 얼마나 안정적으로 빠르게 끝내는지, 도구 호출과 토큰을 얼마나 소모하는지, 그리고 워크플로가 얼마나 자주 Opus 5.5로 상향 전환을 필요로 하는지입니다. 팀은 이러한 요소를 자체 작업에서 검증하고, 교차 벤더 벤치마크를 영구적인 순위가 아닌 시의성 있는 관측으로 취급해야 합니다.
