Claude Sonnet 5.5 출시: 속도 향상 및 다섯 가지 변경 사항 분석
요약
Anthropic이 Claude Sonnet 5.5를 출시하며, 지식 차단 시점이 2026년 1월에서 2026년 6월로 크게 업데이트되었습니다. 이 모델은 기존 Sonnet 5와 동일한 가격과 사양을 유지하지만, 사용자가 알아야 할 다섯 가지 주요 변경 사항들이 존재합니다. 개발자들은 Anthropic의 마이그레이션 가이드를 참고하여 새로운 버전을 적용해야 합니다.
핵심 포인트
- 지식 차단 시점이 2026년 6월로 확장되어 최신 정보 접근성이 향상됨.
- Sonnet 5.5는 Sonnet 5와 동일한 가격 및 사양을 유지하며 안정적인 사용이 가능함.
- 모델 전환 시 다섯 가지 주요 변경 사항과 마이그레이션 가이드 확인이 필수적임.
- Anthropic은 최소 1년 동안 Sonnet 5.5를 활성 상태로 유지할 것을 약속함.
-
Anthropic은 Claude Sonnet 5.5를 9월 28일에 출시했으며, 모든 요금제에서 Sonnet 5와 동일한 가격으로 책정되었습니다.
-
신뢰할 수 있는 지식 차단 시점(knowledge cutoff)이 1월에서 2026년 6월로 5개월 점프하며, 기본 노력 수준(default effort)은 높은 상태를 유지합니다.
-
기존 Sonnet 5 코드를 건드리는 다섯 가지 변경 사항과, 오류를 발생시키는 대신 조용히 지나가는 여섯 번째 변화가 있습니다.
-
Opus 5.5가 6일 앞서 출시된 것과 동일한 다섯 개 플랫폼에서 배포되었으며, Sonnet 5는 계속 사용 가능합니다.
9월 28일, Anthropic은 현재의 Sonnet 모델인 Claude Sonnet 5.5를 출시했습니다 Claude API. 이 모델은 대체하는 모델과 정확히 같은 가격으로 책정되었지만, 작동 방식이 완전히 같지는 않습니다. Sonnet 5에서 작동했던 다섯 가지 기능 중 일부는 새 모델에서 오류를 발생시키거나 형태가 바뀌었으며, 여섯 번째 변화는 아무런 경고 없이 조용히 지나갑니다. 저는 Anthropic의 자체 공지와 마이그레이션 가이드를 읽고 실제로 어떤 것들이 중요한지 파악할 수 있었습니다.
Claude Sonnet 5.5에서 변경된 사항은 무엇인가요?
모델 ID는 claude-sonnet-5-5이며, Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, 그리고 AWS의 Claude Platform 전반에 걸쳐 같은 날 라이브되었습니다. 이는 Opus 5.5가 9월 22일에 출시되었을 때와 동일한 다섯 개 플랫폼 배포를 의미하며, 특정 클라우드에서 개발하는 사용자가 이번에는 두 번째 웨이브를 기다릴 필요가 없다는 뜻입니다.
사양 시트(spec sheet)는 Sonnet 5와 대부분 변경되지 않았습니다. 컨텍스트 창은 1M 토큰을 유지하고, 최대 출력은 128K로 유지되며, Batch API는 여전히 베타 헤더를 통해 최대 300K 출력 토큰을 지원합니다.
가격 책정 역시 변동이 없었는데, 이는 일주일 전에 Opus 5.5가 직접적인 가격 인하를 경험했음을 고려할 때 가장 놀라운 세부 사항입니다. Sonnet 5.5는 입력과 출력 모두에서 Sonnet 5와 동일한 토큰당 비용을 차지하며, 이는 Opus 5.5 요금의 절반, 그리고 Fable 5.1 요금의 5분의 1에 해당합니다. 여전히 Haiku를 제외한 현 라인업 중 가장 저렴한 모델입니다.
가장 큰 변화는 신뢰할 수 있는 지식 차단일(knowledge cutoff)입니다. Sonnet 5에서는 2026년 1월이었던 것이 Sonnet 5.5에서는 2026년 6월로 변경되었으며, 이는 이미 Opus 5.5와 Fable 5.1이 가지고 있던 지식 차단일과 일치합니다. 5개월이라는 시간 간격은 메울 만한 상당한 격차이며, 이는 Sonnet 5.5가 대체하는 모델과는 올해 상반기에 발생한 어떤 것에 대해서도 실질적으로 다른 그림을 갖는다는 것을 의미합니다. 기본 노력 수준(Default effort)은 두 버전 모두 '높음(high)'으로 유지되었기 때문에, 마이그레이션할 때 다시 확인할 필요가 없는 레버리지 중 하나입니다.
서비스 종료(Retirement) 정책도 표준적인 기간을 확보했습니다. Anthropic은 Sonnet 5.5를 최소 1년 동안 활성 상태로 유지하겠다고 약속했으며, 그 시기는 2027년 9월 28일 이전이 아닙니다.
Sonnet 5 역시 당장 사라지는 것은 아닙니다. '사용 중단(deprecated)'보다는 '레거시(legacy)'로 표시되었기 때문에, 기존에 claude-sonnet-5를 호출하던 코드는 사용자가 자신의 일정에 맞춰 마이그레이션할 때까지 계속 작동합니다. 이번 주에는 아무도 강요하지 않습니다.
업그레이드 시 깨지는 다섯 가지 사항은 무엇인가?
Anthropic의 모델 페이지에는 Sonnet 5 대비 다섯 가지 변경되는 사항이 나열되어 있으며, 여기에 요청을 아예 실패시키지는 않지만 동작 방식을 바꾸는 여섯 번째 사항도 있습니다. 만약 현재 실행하는 어떤 것도 API에서 Sonnet을 호출한다면, 이 부분이 주의 깊게 읽을 가치가 있습니다.
다섯 가지와 하나. 네 가지가 아닙니다. 이는 Opus 5.5가 일주일 전에 출시했을 때보다 더 넓은 영향 범위(blast radius)입니다.
첫 번째는 '사고 과정 비활성화(disabling thinking)'를 `
세 번째로, 생각(thinking) 블록은 해당 블록을 생성한 특정 모델 및 대화에 연결됩니다. 이 블록을 재개된 대화나 다른 모델에 전달하는 것은 더 이상 신뢰할 수 없으며, 이는 모든 테스트를 통과하지만 몇 달 후 프로덕션 환경에서 조용히 오류가 발생하는 유형의 문제입니다.
네 번째로: 이전 버전인 computer_20251124 컴퓨터 사용 도구는 이번 모델을 통해 Claude API와 Google Cloud에서 더 이상 지원되지 않습니다.
다섯 번째로, Opus 5.5 출시 때 제가 확인했던 것과 비교했을 때 새로운 변경 사항입니다: 어드바이저(advisor) 도구가 이제 Claude Opus 4.8, Opus 4.7, 그리고 Sonnet 5를 어드바이저 모델로 아예 거부합니다. 만약 멀티 에이전트 설정에서 Sonnet 5.5와 이들 중 하나를 어드바이저 모델로 페어링한다면, 해당 조합은 작동을 멈춥니다. 저는 이번 출시 전에 어드바이저에 대한 특정 제한 사항을 본 적이 없습니다.
여섯 번째 변경 사항은 전혀 오류가 발생하지 않습니다. 이전에는 도구 호출 사이에 스트리밍되던 텍스트가 이제 thinking 블록 내부에 도착하며, 기본 표시 설정에서는 해당 텍스트가 클라이언트에 도달하지 않습니다. 이 텍스트를 실시간 진행률 표시기로 보여주었던 모든 UI는 도구 호출 사이사이에 조용해지며, 이를 다시 전달하는 표시 값을 설정하거나 between_tools로 전환하여 초기 생각(thinking) 과정을 포기해야 합니다.
Sonnet 5.5가 실제로 더 빠른가, 아니면 단지 더 저렴한가?
속도는 Anthropic이 내세우는 주요 메시지이며, 저는 보통 공급업체의 자체 프레이밍은 무시하는 편이지만, 이번 것은 확인해 볼 만큼 구체적입니다: Sonnet 5.5는 Sonnet 5보다 출력 생성이 30% 이상 빠르며, Anthropic에 따르면 모델이 동일한 답변에 도달하기 위해 더 적은 토큰을 필요로 하기 때문에 실제 워크로드 비용은 최대 30%까지 절감된다고 합니다. (토큰당 가격 변경 때문이 아닙니다.)
독립적인 벤치마크 추적기인 Vals Index에서 Sonnet 5.5는 테스트된 66개 모델 중 두 번째를 차지했으며, Opus 5.5보다는 훨씬 뒤처지지만 테스트당 비용은 약 63% 수준입니다. 이것이 이번 출시가 추구하는 트레이드오프(trade-off)입니다: 플래그십 모델에 가까운 지능 격차를 유지하면서도 예산 옵션처럼 가격을 책정한 것입니다.
코딩 에이전트 벤치마크인 CursorBench 4.0에서 이러한 점을 뒷받침합니다. Sonnet 5.5는 여기서 55.5%를 기록했는데, 이는 Sonnet 5의 34.1%보다 상당히 높은 수치이며, Opus 5.5 자체 점수와도 충분히 가까워서 이제 코딩 에이전트를 위해 Opus를 선택하는 이유가 단순히 '더 큰 모델'이라는 것만으로는 부족해졌습니다. 한 번의 벤치마크에서 21점이나 급등한 것은 실제 사용 환경에서는 보통 과소평가되는 수치이므로, 제가 충분한 자체 작업을 실행하여 그 격차를 신뢰할 때까지는 이를 약속이라기보다는 상한선으로 간주하겠습니다.
하지만 이것들이 Sonnet 5.5가 Anthropic이 출시하는 최고의 모델이라는 의미는 아닙니다. Fable 5.1과 Opus 5.5 모두 여전히 순수 성능 면에서는 앞서 나갑니다.
실제로 이 변화는 '대부분의 에이전트 루프에 충분히 좋은' 기준점을 일주일 전보다 더 낮은 가격대로 이동시켰다는 점입니다. 이는 실험실 외부에서 지속적으로 실행하기에는 비싼 새로운 최첨단 기술보다는 1인 스튜디오에게 훨씬 유용한 변화입니다. 저렴하면서도 거의 충분한 성능을 내는 것이, 매일 주 단위로 이용할 수 없는 더 나은 성능보다 낫습니다.
오늘 업그레이드해야 할까요? 가장 먼저 확인할 것들
만약 현재 Sonnet 5를 사용하고 있다면, 가격표가 다르게 말하더라도 이것을 '바로 대체 가능한(drop-in swap)' 업데이트라고 부르지는 않을 것입니다. 코드를 검색하여 세 가지 항목을 먼저 확인하세요: thinking: {"type": "disabled"}를 전송하는 모든 요청, tool_choice가 any 또는 특정 도구로 설정된 경우, 그리고 도구 호출 사이에 텍스트를 사용자 인터페이스로 스트리밍하는 코드를 찾으세요. 이 세 가지는 여섯 가지 변경 사항 중 네 가지를 다루며, 가장 조용히 실패할 가능성이 높은 부분들입니다.
tool_choice 관련 문제는 모델이 실제로 해당 호출을 수행해야 할 때만 나타나기 때문에 놓치기 쉽습니다. 테스트 스위트가 강제 도구 사용 경로(forced-tool-use path)를 특별히 테스트하지 않는다면, 통과하는 CI 실행 결과는 그 코드가 여전히 작동하는지에 대해 아무것도 알려주지 않습니다. 따라서 프로덕션 트래픽에 영향을 주는 어떤 곳에서 모델 ID를 변경하기 전에 의도적으로 이 경로를 건드리는 테스트 케이스를 추가할 것입니다.
어드바이저 도구(advisor tool) 제한은 모델을 어드바이저로 짝지어 사용하는 멀티 에이전트(multi-agent) 설정에서만 중요하며, 대부분의 싱글 에이전트(single-agent) 프로젝트는 이를 사용하지 않으므로, 이 부분은 마지막으로 확인해 보고 없다면 아예 건너뛰어도 됩니다.
모델 및 대화에 연결된 사고 블록(thinking blocks)은 주로 세션 전반에 걸쳐 상태를 유지하는 장기 실행 에이전트(long-running agents)에게 영향을 줍니다. 만약 사용자의 에이전트가 실행할 때마다 새로 시작한다면, 이 또한 알아채지 못할 가능성이 높습니다. 제가 실제로 기다릴 부분은 다음과 같습니다: 프로덕션 환경에서 특정 컴퓨터 사용 도구(computer use tool) 버전을 고정하는 모든 것인데, 이는 단순히 권장되지 않는 것을 넘어 이 모델에서는 computer_20251124 지원이 완전히 종료되기 때문이며, 마이그레이션 가이드 어디에도 유예 기간에 대한 언급이 없습니다.
지식 차단 시점(knowledge cutoff)의 점프는 제가 생각하기에 가격 책정보다 더 높은 우선순위에 두어야 합니다. 5개월의 간극은 Sonnet 5.5가 Sonnet 5가 전혀 알지 못하는 것들에 대해 알고 있다는 의미이며, 만약 사용자의 프롬프트가 검색(retrieval)보다는 모델 자체의 세계 지식에 의존한다면, 이는 마이그레이션 체크리스트로는 포착하기 어려운 방식으로 출력 품질을 변화시킬 가능성이 가장 높은 변경 사항입니다. 기다릴지 결정하기 전에 오늘 실제 프롬프트로 테스트해 보세요. API 표면만 테스트하지 말고.
저는 이 청크보다 일주일 전에 Claude Opus 5.5가 더 저렴하고 네 가지 주요 변경 사항과 함께 출시됨에서 Opus 5.5 자체의 주요 변경 사항 및 가격 인하에 대해 작성했고, 가장 최근 Sonnet 관련 출시는 Claude Fable 5.1 및 Mythos 5.1: 9월 1일 무엇이 바뀌었나에서 다루었습니다. 한 달 동안 세 번의 출시를 거치면서 패턴은 동일합니다: 가격이 유지되거나 하락하며, 주요 변경 사항들은 같은 몇 가지 API 표면 주변에 계속 집중되는 것입니다.
핵심 요약
Claude Sonnet 5.5는 루틴한 개선처럼 포장된 것이 아니라, 동일 가격에 제공되는 진정한 업그레이드입니다. 속도 주장은 독립적인 벤치마크를 통해 확인되었고, 지식 차단 시점(cutoff)의 점프는 실제이며, Opus 5.5가 그 전주에 더 저렴해진 동안 Sonnet은 가격을 동결했습니다. 이 모든 것이 이것을 안전한 무지성 교체(blind swap)로 만들지는 않습니다.
다섯 가지 주요 변경 사항과 한 가지 조용한 동작 변화만으로도, 이를 먼저 확인하지 않으면 프로덕션 환경에서 요청 실패를 일으키거나 작동이 멈출 수 있습니다. 제 의견은 이렇습니다: 모델 ID를 건드리기 전에 위의 세 가지 패턴을 검색(grep)하고, 어쨌든 마이그레이션 가이드에 오후 시간을 할당하며, API 표면이 호환되어 보여도 자체 프롬프트 테스트를 생략하지 마십시오. 다섯 개 플랫폼 동시 출시라는 것은 특정 클라우드가 따라잡기를 기다릴 이유가 없다는 뜻입니다. 만약 기다려야 할 이유가 있다면, 그것은 Anthropic의 배포 속도가 아니라 여러분 자신의 코드 때문일 것입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기