클로드 소넷 5 성능·가격 정리: Opus·Haiku와 뭐가 다른가

클로드 소넷 5(Claude Sonnet 5)를 API 기본 모델로 걸어두고 써도 괜찮을까요? 2026년 6월 30일에 나온 Anthropic의 새 중간 체급 모델인데, 가격은 전작보다 내려갔고 벤치마크는 대부분 올랐습니다. Opus가 더 강하다는 건 알겠는데, 비용 차이만큼 성능 차이도 나는지가 진짜 궁금한 부분이죠. 직접 확인한 내용을 정리합니다.

Sonnet 5는 어떤 모델인가

Sonnet 5의 모델 ID는 claude-sonnet-5이고, Amazon Bedrock·Google Cloud·Microsoft Foundry에서도 같은 ID로 쓸 수 있습니다. 핵심 사양을 간단히 정리하면 이렇습니다.

항목사양
컨텍스트 윈도우1,000,000 토큰 (1M) : 기본값이 곧 최대값
최대 출력128K 토큰 (Batch API는 베타로 300K)
입출력 형식텍스트 + 이미지 입력 → 텍스트 출력
ThinkingAdaptive thinking 지원, 기본 활성화 (effort: high)
지원 기능Vision, Tool use, Computer use, Browser use, PDF, Files API, Prompt caching, Batch
지식 기준일2026년 1월

한 가지 주의할 점이 있습니다. Sonnet 5에는 새 토크나이저가 적용됐는데, 같은 텍스트를 Sonnet 4.6과 비교하면 약 30% 더 많은 토큰으로 계산될 수 있습니다. 1M 컨텍스트라고 해서 이전 모델과 동일한 분량의 텍스트가 들어가는 건 아닙니다.

이전 세대와 달라진 점

Sonnet 4.6에서 가장 눈에 띄는 변화는 세 가지입니다.

  1. 컨텍스트 윈도우가 기본 1M: 이전에는 200K 기본, 1M 확장 같은 분리 구조가 있었지만 Sonnet 5는 처음부터 1M이 기본값입니다.
  2. 최대 출력 128K: 일반 요청에서도 긴 출력을 받을 수 있고, Batch API에서는 300K까지 가능합니다.
  3. Computer Use 안정 버전 지원: computer_toolset_20260801 이라는 새 안정 버전이 추가됐고, 이전 버전(computer_20251124)도 계속 쓸 수 있습니다.

클로드 소넷 5 가격: 오히려 내렸다

API 가격을 보면, Sonnet 5가 전작인 Sonnet 4.6보다 저렴합니다.

모델입력출력캐시 쓰기캐시 읽기
Sonnet 5$2 / MTok$10 / MTok$2.50 / MTok$0.20 / MTok
Sonnet 4.6$3 / MTok$15 / MTok$3.75 / MTok$0.30 / MTok
Opus 4.5$5 / MTok$25 / MTok$6.25 / MTok$0.50 / MTok
Haiku 4.5$1 / MTok$5 / MTok$1.25 / MTok$0.10 / MTok
Anthropic 공식 API 가격표 캡처

정리하면 이렇습니다.

  • Sonnet 4.6 대비 입력·출력 모두 약 33% 저렴
  • Opus 4.5 대비 입력은 2.5배, 출력은 2.5배 저렴
  • Haiku 4.5보다는 입력 2배, 출력 2배 비쌈

성능이 올라가면서 가격이 내려간 건 드문 일이라, Sonnet 4.6을 쓰고 있던 사용자라면 바꾸지 않을 이유가 별로 없습니다.

벤치마크 성능: Opus에 근접하는 구간이 있다

Anthropic이 공개한 벤치마크에서 Sonnet 5, Sonnet 4.6, Opus 4.8을 비교한 결과입니다.

벤치마크Sonnet 5Sonnet 4.6Opus 4.8
SWE-bench Pro (에이전트 코딩)63.2%58.1%69.2%
Terminal-Bench 2.1 (에이전트 코딩)80.4%67.0%82.7%
Humanity’s Last Exam (도구 없음)43.2%34.6%49.8%
Humanity’s Last Exam (도구 사용)57.4%46.8%57.9%
OSWorld-Verified (컴퓨터 사용)81.2%78.5%83.4%
GDPval-AA v2 (지식 작업)161813951615
Sonnet 5 공식 벤치마크 또는 모델 카드 캡처

몇 가지 눈에 띄는 포인트가 있습니다.

  • Sonnet 4.6 대비 모든 항목에서 확실히 올랐습니다. Terminal-Bench는 67% → 80.4%로 13%p 이상 뛰었고, Humanity’s Last Exam도 10%p 가까이 차이납니다.
  • Opus 4.8과의 격차는 생각보다 좁습니다. 특히 Humanity’s Last Exam(도구 사용)에서는 57.4% 대 57.9%로 거의 동점이고, GDPval-AA v2에서는 Sonnet 5가 1618로 Opus 4.8(1615)을 오히려 근소하게 앞섭니다.
  • 코딩 벤치마크에서는 Opus가 여전히 한 체급 위입니다. SWE-bench Pro 기준 약 6%p 차이.

직접 테스트: 코딩과 일반 업무

벤치마크 숫자만으로는 실제 사용감을 알기 어렵습니다. Claude Code와 claude.ai에서 Sonnet 5를 직접 써 봤습니다.

코딩: Claude Code에서 코드 리뷰

Claude Code v2.1.247에서 모델을 Sonnet 5로 설정하고 프로젝트 코드 리뷰를 요청했습니다. Skill(code-review)이 백그라운드 에이전트로 실행되는 방식인데, 응답 속도와 리뷰 품질 모두 실사용에 문제없는 수준이었습니다.

Sonnet 5 코딩 작업 실제 사용 화면

일반 업무: 웹 검색과 정보 정리

claude.ai에서 Sonnet 5로 웹 검색을 요청해 봤습니다. 검색 결과를 가져와서 사이트 구조와 특징을 분석한 내용을 깔끔하게 정리해 줍니다.

Sonnet 5 일반 업무(글쓰기·분석·요약) 사용 화면

체감상 Sonnet 5는 경량 저급 모델이라고 부를 수준은 아닙니다. 벤치마크에서도 확인했지만, 도구 사용이나 정보 정리 같은 실무 작업에서 Opus와의 격차가 크지 않습니다.

다만 글쓰기 품질은 벤치마크만 보면 아쉬운 면이 있습니다. 코딩이나 도구 사용 성능이 크게 오른 것에 비해, 순수한 텍스트 생성 품질에서는 개선 폭이 상대적으로 작게 느껴집니다.

토큰당 비용 효율

Sonnet 5의 비용 대비 성능을 한 번 계산해 보겠습니다.

SWE-bench Pro 기준으로 단순 비교하면:

  • Sonnet 5: 63.2% 성능, 출력 $10/MTok → 1달러당 6.32%p
  • Opus 4.8: 69.2% 성능, 출력 $25/MTok → 1달러당 2.77%p
  • Sonnet 4.6: 58.1% 성능, 출력 $15/MTok → 1달러당 3.87%p

같은 예산으로 Sonnet 5가 Opus 4.8 대비 2배 이상의 요청을 처리할 수 있다는 뜻입니다. 성능 차이가 6%p 정도인데 비용은 2.5배 차이니, 대부분의 작업에서 Sonnet 5가 가성비로는 압도적입니다.

Opus와의 차이

Opus는 Anthropic 라인업에서 가장 큰 모델입니다. 차이를 정리하면:

  • 성능: Opus 4.8이 대부분의 벤치마크에서 Sonnet 5보다 2~7%p 높습니다. 다만 지식 작업(GDPval-AA)에서는 Sonnet 5가 근소하게 앞서기도 합니다.
  • 가격: Opus 4.5 기준 입력 $5, 출력 $25. Sonnet 5의 2.5배입니다.
  • 용도: 최고 수준의 코딩 정확도나 복잡한 추론이 필요한 작업에서는 Opus가 여전히 낫습니다. 그 외에는 Sonnet 5로도 충분한 경우가 많습니다.

Opus 5 대비 Sonnet 5의 비용이 거의 절반 이하라는 점에서, 정확도 마지노선이 아닌 이상 Sonnet 5를 기본으로 쓰고 필요할 때만 Opus로 올리는 전략이 합리적입니다.

Haiku와의 차이

Haiku 4.5는 가장 빠르고 저렴한 모델입니다.

  • 가격: Haiku 4.5는 입력 $1, 출력 $5로 Sonnet 5의 절반입니다.
  • 성능: 벤치마크 공개 비교 대상에 Haiku가 빠져 있지만, 체급 자체가 다릅니다. 복잡한 추론, 긴 맥락 처리, 도구 사용에서는 Sonnet 5가 확실히 위입니다.
  • 적합한 작업: 단순 분류, 짧은 요약, 대량 처리처럼 정확도보다 속도와 비용이 중요한 작업에는 Haiku가 맞습니다.

정리하면 Haiku → Sonnet → Opus 순서로 성능과 가격이 올라가는 구조이고, Sonnet 5는 그 중간에서 가격은 Haiku 쪽에 가깝게, 성능은 Opus 쪽에 가깝게 자리 잡은 모델입니다.

Sonnet 5를 기본 모델로 써야 하는 사람

모든 사람에게 맞는 모델은 없지만, 다음 조건에 해당하면 Sonnet 5를 기본으로 두는 게 합리적입니다.

  • API를 매일 쓰는데 Opus 비용이 부담되는 경우: 성능 차이는 작고, 비용은 2.5배 차이입니다.
  • Claude Code로 코딩 작업을 많이 하는 경우: Terminal-Bench 80.4%는 실무 수준에서 충분합니다. 정말 까다로운 디버깅만 Opus로 올리면 됩니다.
  • 도구 사용·에이전트 파이프라인을 구축하는 경우: Tool use, Computer use, Browser use를 모두 지원하면서 가격이 낮으니 반복 호출 비용이 크게 줄어듭니다.
  • Sonnet 4.6을 이미 쓰고 있는 경우: 성능은 올라가고 가격은 내려갔으니 교체하지 않을 이유가 없습니다.

반대로 글쓰기 품질이 최우선이라면, Sonnet 5보다 Opus 계열을 먼저 검토하는 편이 낫습니다.

정리

Sonnet 5는 전작 대비 모든 벤치마크에서 성능이 올랐고, 가격은 33% 내려갔습니다. Opus와의 격차는 여전히 있지만 도구 사용이나 지식 작업에서는 거의 대등한 수치를 보여줍니다. 비용까지 고려하면 대부분의 API 사용자에게 기본 모델로 가장 무난한 선택입니다. Opus는 정말 필요한 순간에만 올려 쓰고, 단순 반복 작업은 Haiku로 내리는 구조가 현재로서는 가장 효율적입니다.

당신을 위한 TOP 3 글 추천

클로드 Fable 5 성능, 가격, 제한까지 직접 써본 후기 (2026)

클로드 Opus 5 성능, 가격, 토큰 사용량 정리 (Fable 5 비교)

클로드 모델 비교: Fable·Opus·Sonnet·Haiku 차이와 선택 기준

큐스페 새 글 알림 받기

필요한 AI 활용 글을 골라 이메일로 전해드립니다.

스팸 없이, 원할 때 언제든 해지할 수 있습니다.

댓글 남기기