Sonnet 5.5에서 주목할 만한 변화
Claude Sonnet 5.5가 출시되었습니다. 가격은 그대로인데 터미널 코딩 평가에서 Opus 5.5를 앞섰습니다. 달라진 점과 Opus 5.5와의 선택 기준, 활용법, 가격 경쟁 구도까지 정리했습니다.
Oct 02, 2026
Claude Sonnet 5.5(클로드 소네트 5.5)는 Anthropic(앤트로픽)이 2026년 9월 28일 출시한 모델입니다. 엿새 전에 나온 Opus 5.5에 이은 Claude 5.5 제품군의 두 번째 모델이고 Claude 플랫폼과 AWS, Google Cloud, Microsoft Azure에서 바로 사용할 수 있습니다.
가격은 전작 Sonnet 5와 같습니다. 입력 100만 토큰당 2달러, 출력 10달러로 Opus 5.5의 절반입니다. 그러나 성능은 Opus 5.5와 비슷합니다. 공식적인 터미널 코딩 평가에서는 Opus 5.5를 앞섰다고 발표한 바 있습니다. Anthropic은 이 모델을 범위가 분명한 일상 작업용으로, Opus 5.5를 복잡한 업무용으로 구분합니다.
이 글은 Sonnet 5.5에서 무엇이 달라졌는지, Opus 5.5와 어떻게 나눠 쓰는지, 이 출시가 시장 구도에서 무엇을 뜻하는지를 항목별로 정리합니다.

무엇이 달라졌나
이전 모델과 한 세대 이상 벌어진 성능
Sonnet 5에서 Sonnet 5.5로 넘어오며 오른 폭이 이례적으로 큽니다. 터미널에서 에이전트가 직접 작업하는 Terminal-Bench 4.0은 10.3%에서 70.6%가 됐습니다. GDPval-AA는 Elo 1449에서 1844로, 컴퓨터 사용 평가 OSWorld 2.1은 57.0%에서 80.1%로 올랐습니다. 화면 캡처만 보고 게임 포켓몬 레드를 끝까지 깬 첫 Sonnet 모델이기도 합니다.
작업당 절감된 비용적 효율
Anthropic은 출력 생성이 Sonnet 5보다 30% 이상 빠르고 작업당 비용은 최대 30% 낮다고 밝혔습니다. 단가를 내린 것이 아닙니다. 같은 일을 더 적은 토큰으로 끝내서 생기는 절감입니다. 헤지펀드 Balyasny Asset Management의 금융 과제 2,441건 평가에서는 답변 하나에 쓴 토큰이 Sonnet 5의 49만 7,000개에서 12만 1,000개로 줄었습니다. 이 수치는 한 고객사의 평가 사례이고 최대 30%는 Anthropic이 전체 테스트에서 제시한 범위입니다.
안전장치와 API 변경
Sonnet 계열에서 처음으로 사이버 보안 안전장치가 들어갔습니다. 고위험으로 분류된 요청은 전작 Sonnet 5가 대신 처리합니다. 모델의 추론 과정을 빼내 다른 모델을 학습시키는 증류 시도를 막는 분류기도 추가됐습니다.
API를 직접 쓰는 팀은 바뀐 규칙을 확인해야 합니다. 미국 개발자 매체 Developers Digest는 기존 코드에서 400 오류를 내는 변경을 다섯 가지로 정리했습니다. 사고(thinking) 비활성화 방식, 도구 강제 지정 방식, 사고 블록의 모델 간 호환, 컴퓨터 사용 도구 버전, advisor 도구 호환 범위입니다. 이 다섯 가지와 별개로 temperature 같은 샘플링 값을 기본값이 아닌 수치로 지정해도 오류가 납니다.
Sonnet 5.5의 성능: 벤치마크가 말하는 위치
아래 Sonnet 5.5 벤치마크 수치는 Anthropic 발표 기준이고 독립 평가가 아닙니다.
벤치마크 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
Terminal-Bench 4.0 (터미널 에이전트 코딩) | 70.6% | 10.3% | 66.4% |
CursorBench 4.0 (에이전트 코딩) | 55.5% | 34.1% | 57.8% |
FrontierCode 1.1 (고난도 코딩) | 52.1% | 42.4% | 54.4% |
GDPval-AA v2.1 (지식 노동, Elo) | 1844 | 1449 | 1846 |
AA-Briefcase v1.1 (지식 노동, Elo) | 1811 | 1359 | 1822 |
Humanity's Last Exam (도구 사용) | 64.5% | 54.9% | 67.7% |
OSWorld 2.1 (컴퓨터 사용) | 80.1% | 57.0% | 81.8% |
Chartography (차트 이해) | 61.6% | 15.6% | 64.4% |
8종 가운데 Terminal-Bench 4.0에서만 Opus 5.5를 4.2%p 앞섰고 나머지 7종은 Opus 5.5가 높습니다. 다만 격차가 작습니다. 지식 노동 Elo는 2점과 11점 차이이고 컴퓨터 사용은 1.7%p, 에이전트 코딩은 2.3%p 차이입니다. 절반 가격의 모델이 상위 모델의 점수를 근소한 차이로 따라온 결과입니다.
OpenAI의 같은 가격대 모델 GPT-6 Sol과 비교한 수치도 일부 공개됐습니다. Elo는 1844 대 1487, 고난도 코딩은 52.1% 대 49.3%, 차트 이해는 61.6% 대 53.6%로 Sonnet 5.5가 높습니다.

Opus 5.5와의 비교: 어디에 무엇을 쓰나
두 모델의 점수가 붙으면서 선택 기준은 작업의 성격으로 옮겨 갔습니다.
구분 | Claude Sonnet 5.5 | Claude Opus 5.5 |
입력·출력 가격 (100만 토큰) | $2·$10 | $4·$20 |
캐시 읽기 | $0.20 | $0.20 |
맞는 작업 | 범위가 분명한 기능 개발, 버그 수정, 문서·슬라이드·스프레드시트, 대량 에이전트 작업 | 끝이 열려 있는 장기 프로젝트, 판단이 계속 필요한 작업 |
앞선 평가 | 터미널 에이전트 코딩 | 고난도 코딩, 지식 노동, 도구 사용 추론 |
Anthropic의 권고는 Sonnet 5.5를 기본으로 두고 복잡한 업무에서만 Opus 5.5로 올리라는 방향입니다. Developers Digest는 기준을 하나 더 제시했습니다. Sonnet 5.5의 노력 수준을 높음까지 올려도 자체 평가를 통과하지 못하는 작업이 Opus 5.5로 옮길 대상입니다.
비용 차이는 구성에 따라 달라집니다. 새 입력 1만 토큰, 캐시 읽기 9만 토큰, 출력 4,000토큰짜리 호출 한 번이 Sonnet 5.5로는 0.078달러, Opus 5.5로는 0.138달러입니다. Sonnet 5.5가 약 43% 저렴합니다. Developers Digest는 캐시 비중이 더 큰 에이전트 루프에서는 격차가 10% 안팎까지 줄어든다고 계산했습니다. 캐시 읽기 단가가 두 모델 모두 0.20달러로 같기 때문입니다.
Sonnet 5.5 활용법
적합한 작업
요청의 범위가 분명하고 건수가 많은 일이 대상입니다. 버그 수정과 기능 단위 개발, 고객 문의 처리, 보고서·슬라이드·스프레드시트 작성, 여러 에이전트를 동시에 돌리는 대량 작업이 여기에 포합됩니다. 차트를 읽는 능력이 15.6%에서 61.6%로 올라 도표가 섞인 문서 검토에도 쓸 만해졌습니다.
초기 도입 기업의 결과
Anthropic이 발표문에 실은 고객사 수치가 용도를 구체적으로 보여 줍니다. 클라우드 문서 관리 기업 Box는 작업이 2.4배 빨라지고 총 토큰이 12% 줄었습니다. 고객 지원 소프트웨어 기업 Zendesk는 티켓 처리가 20% 빨라졌습니다. 협업 도구 기업 Atlassian은 자사 Rovo 에이전트가 최대 30% 빨라졌다고 밝혔습니다. 앱 제작 서비스 Lovable에서는 도구 호출이 33%, 셸 실행이 50% 줄었습니다. Base44는 앱 118개를 만드는 평가에서 평균 반복 횟수가 Opus 5의 7.7회에서 3.6회로 내려갔습니다.
Sonnet 5에서 전환 시 참고할 지점
Sonnet 5에서 넘어오는 팀이 손볼 곳은 세 군데입니다. 긴 작업 도중 모델이 멈추고 계속할지 묻는 일이 있어 끝날 때까지 진행하라는 지시를 시스템 프롬프트에 넣는 편이 좋습니다. 요청하지 않은 테스트나 문서를 덧붙이는 경향이 있어 선택 사항은 따로 제안만 하도록 지시합니다. 노력 수준은 Sonnet 5에서 쓰던 값을 그대로 옮기지 말고 중간부터 다시 측정합니다. 최대 노력이 늘 좋은 것도 아닙니다. 고난도 코딩 평가 점수는 최대 노력에서 46.2%로, 한 단계 아래 설정의 52.1%보다 낮았습니다.
국내 실무에서는 고객센터 문의 처리, 사내 문서와 보고서 초안, 코드 리뷰와 버그 수정처럼 지금 Opus 5.5 같은 상위 모델을 쓰고 있지만 범위가 분명한 업무가 첫 이동 후보입니다. 같은 과제를 소량 돌려 품질과 총비용을 비교해 보시기 바랍니다.

Sonnet 5.5 가격
항목 (100만 토큰당) | Sonnet 5.5 | Opus 5.5 |
입력 | $2 | $4 |
출력 | $10 | $20 |
캐시 읽기 | $0.20 | $0.20 |
캐시 쓰기 | $2.50 | $5 |
Sonnet 5.5 가격은 Sonnet 5와 다르지 않습니다. 한 달에 입력 5억·출력 1억 토큰을 쓴다고 가정하면 Sonnet 5.5는 2,000달러, Opus 5.5는 4,000달러입니다. 컨텍스트는 100만 토큰, 한 번에 낼 수 있는 출력은 12만 8,000토큰입니다. 더 저렴한 Haiku 5.5는 수 주 안에 나올 예정이라고 밝힌 바 있습니다.
Sonnet 5.5 모델의 의미와 이후의 판도
9월 한 달 동안 프론티어 모델 네 가지가 출시되었습니다. GPT-6 Astra, Opus 5.5, Sonnet 5.5, Gemini 4 Argon입니다. 그리고 Sonnet 5.5 출시로 달라진 것이 세 가지 있습니다.
같은 AI 기업 안에서 출시된 모델들임에도 등급의 경계가 흐려졌습니다. 가격이 두 배인 Opus 5.5와 점수 차이가 이 정도로 작다면 Opus를 써야 할 이유는 벤치마크 밖에서 찾아야 합니다. 얼마나 오래 스스로 판단을 이어가느냐가 그 이유로 남습니다. 상위 모델을 기본으로 쓰던 팀은 기본값을 다시 정해야 합니다.
입력 2달러, 출력 10달러가 경쟁의 중심 가격대가 됐습니다. Sonnet 5.5와 OpenAI의 GPT-6 Sol이 이 가격이고 Gemini 4 Argon의 도입가도 같습니다. 세 회사의 모델이 지금은 같은 가격에 모여 있으므로 선택은 가격표가 아니라 우리 업무에서 실측한 결과로 갈립니다.
경쟁의 단위는 단가에서 작업당 비용으로 넘어갔습니다. Opus 5.5도 Sonnet 5.5도 토큰을 덜 쓰는 것을 전면에 내세웠습니다. 표시 가격이 같아도 같은 일에 드는 돈은 모델마다 다릅니다. 도입 검토에서 봐야 할 숫자는 100만 토큰당 가격보다 과제 하나를 끝내는 데 든 총액입니다.

한계 및 유의점
벤치마크는 Anthropic 자체 발표입니다. 지식 노동 점수는 구조화 출력에 버그가 있던 출시 전 버전으로 측정했다고 Anthropic이 직접 밝혔습니다. 점수가 실제보다 낮게 나왔을 수 있다는 설명입니다. Terminal-Bench에서 Sonnet 5.5가 Opus 5.5를 앞선 결과를 두고는 개발자 커뮤니티 Hacker News에서 다른 해석이 나왔습니다. Opus 5.5 쪽이 안전장치 발동으로 다른 모델에 넘겨진 과제가 더 많았다는 지적입니다.
최대 30% 비용 절감은 조건에 따라 달라집니다. 같은 커뮤니티에서는 공개된 차트로는 절감 근거를 확인하기 어렵다는 의견이 나왔습니다. 노력 수준을 높게 잡으면 Opus 5.5와 비용이 같아지거나 더 들 수 있다는 지적도 있습니다. 한 개발자는 최대 노력에서 15분 만에 사고 토큰 12만 8,000개를 쓰고 작업이 실패한 사례를 공유했습니다.
보안 업무에는 마찰이 생길 수 있습니다. 파서 퍼징이나 오래된 C 코드 분석처럼 정당한 보안 작업이 거부됐다는 사용자 보고가 있습니다. 보안 관련 코드를 다루는 팀은 자사 과제로 먼저 확인해야 합니다. API 변경 다섯 가지는 기존 코드를 그대로 두면 오류를 냅니다. 모델 이름만 바꿔 넣는 방식의 교체는 통하지 않습니다.
자주 묻는 질문
Q1. Claude Sonnet 5.5는 무엇입니까?
스파르타빌더스 Anthropic이 2026년 9월 28일 출시한 Claude 5.5 제품군의 중간 등급 모델입니다. 국내에서는 클로드 소네트 5.5로 표기합니다. 가격은 Sonnet 5와 같고 성능은 Opus 5.5에 근접합니다.
Q2. 기존의 Sonnet 5와 무엇이 다릅니까?
스파르타빌더스 터미널 코딩 평가가 10.3%에서 70.6%로, 컴퓨터 사용 평가가 57.0%에서 80.1%로 올랐습니다. 출력은 30% 이상 빨라졌고 작업당 비용은 최대 30% 낮아졌다고 Anthropic은 밝혔습니다.
Q3. Opus 5.5 대신 써도 됩니까?
스파르타빌더스 범위가 분명한 작업이라면 Sonnet 5.5가 기본 선택입니다. 끝이 열려 있는 장기 프로젝트나 Sonnet 5.5의 높은 노력 수준으로도 평가를 통과하지 못하는 작업에만 Opus 5.5를 쓰는 구성이 권장됩니다.
Q4. 가격은 얼마입니까?
스파르타빌더스 입력 100만 토큰당 2달러, 출력 10달러, 캐시 읽기 0.20달러입니다. Sonnet 5와 같고 입력·출력 단가는 Opus 5.5의 절반입니다.
Q5. 기존 코드를 그대로 쓸 수 있습니까?
스파르타빌더스 그대로는 안 됩니다. 사고 비활성화, 도구 강제 지정, 컴퓨터 사용 도구 버전 등 다섯 가지 변경이 400 오류를 내므로 호출 코드를 먼저 고쳐야 합니다.
참고 문헌
- Anthropic, 'Introducing Claude Sonnet 5.5', 2026-09-28
- MarkTechPost, 'Anthropic Releases Claude Sonnet 5.5: 70.6% on Terminal-Bench 4.0 at the Same $2/$10 Price', 2026-09-28
- Developers Digest, 'Claude Sonnet 5.5 Developer Guide: Pricing, Benchmarks, and the Five API Changes', 2026-09
- Unite.AI, 'Anthropic Releases Claude Sonnet 5.5 at Unchanged Sonnet 5 Pricing', 2026-09
- The New Stack, 'Anthropic launches Claude Sonnet 5.5 with near-Opus performance at half the price', 2026-09
Share article