
Claude Sonnet 5 사용 방법: 추론 노력, 비용, 제한
Claude Sonnet 5 활용: Opus 4.8 비교, 비용을 좌우하는 추론 노력 단계, 청구 인상된 토크나이저, 마이그레이션 단계를 설명합니다.
Anthropic이 2026년 6월 30일 Claude Sonnet 5를 공개했고, 직관적인 피치를 내세웠습니다. Opus 수준에 가까운 코딩과 에이전트 일에 Sonnet 가격[1]이라는 것입니다. 공식 벤치마크가 대부분을 뒷받침합니다.
Claude Sonnet 5를 잘 사용하는 방법은 주로 런칭 포스트가 강조하지 않은 두 가지입니다. 추론 노력 단계는 비용 주장을 현실로 만드는 지렛대이며, 더 조밀한 토크나이저는 같은 프롬프트가 Sonnet 4.6보다 토큰으로 약 30% 더 많아지기 때문에, 모델 문자열만 바꾸는 마이그레이션은 청구 내역을 조용히 바꾸고 출력을 자를 수 있습니다[1].
이 가이드는 벤치마크, Sonnet 5가 Opus 4.8과 동등한 지점과 뒤지는 지점, 호환되지 않는 API 변경 네 가지, 9월 인상을 포함한 가격, 그리고 누가 실제로 이를 사용해야 하는지를 다룹니다.
요약
- 지식 업무에서 Opus 수준. GDPval-AA v2 Elo는 Opus 4.8의 1615에 대해 1618로 통계적 동등[1].
- 어려운 부분에서는 여전히 뒤. SWE-bench Pro에서 63.2% 대 69.2%, USAMO 2026에서 79.5% 대 96.7%[1].
- 도입 가격은 2026년 8월 31일까지: 백만 토큰당 입력 $2 / 출력 $10, 9월 1일부터 $3 / $15로 인상[1].
- 처음으로 완전한 추론 노력 단계:
low,medium,high(기본값),xhigh,max[1]. - 토크나이저는 약 30% 더 조밀. 토큰당 가격은 변하지 않으므로 동일한 요청이 Sonnet 4.6보다 비용이 더 듭니다. 마이그레이션 전에 기준을 다시 잡으세요[1].
budget_tokens와 샘플링 파라미터는 이제 400 반환[1].
Claude Sonnet 5란
Claude Sonnet 5 (claude-sonnet-5)는 Sonnet 4.6을 대체합니다. Anthropic은 이를 가장 에이전트 지향적인 Sonnet 모델이라 부르며, 계획을 수립하고 브라우저와 터미널을 제어하며 오래 자율적으로 실행되는 능력이 최근에는 더 크고 비싼 모델이 필요했던 수준에 도달했습니다[1].
claude.ai의 Free와 Pro 사용자를 위한 기본 모델로 출시되었으며, 동시에 Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry에서 미리보기 상태입니다. 기본적으로 1M 토큰 컨텍스트 윈도우와 최대 128K 출력을 지원합니다[1].
벤치마크

| 벤치마크 | Sonnet 5 | Sonnet 4.6 | Opus 4.8 (참고) |
|---|---|---|---|
| 에이전트 코딩 (SWE-bench Pro) | 63.2% | 58.1% | 69.2% |
| 에이전트 코딩 (Terminal-Bench 2.1) | 80.4% | 67.0% | 82.7% |
| 추론 (HLE, 도구 없음) | 43.2% | 34.6% | 49.8% |
| 추론 (HLE, 도구 포함) | 57.4% | 46.8% | 57.9% |
| 컴퓨터 사용 (OSWorld-Verified) | 81.2% | 78.5% | 83.4% |
| 지식 업무 (GDPval-AA v2, Elo) | 1618 | 1395 | 1615 |
두 가지가 눈에 띕니다. Sonnet 4.6 대비 전면 승리와 실질적인 향상: Terminal-Bench가 13.4 포인트 올라가고 지식 업무 Elo가 223 상승합니다. 지식 업무에서 Sonnet 5는 명목상 Opus 4.8을 앞서갑니다(1618 대 1615), 이는 동등이며 에이전트 코딩과 컴퓨터 사용에서 플래그십의 약 2~6 포인트 이내입니다[1].
그 "몇 포인트 내, 비용의 1/3"이라는 격차가 전체 가치 제안입니다.
시스템 카드의 더 깊은 수치: 고전 500문제 SWE-bench Verified 부분집합에서 85.2%, 9개 언어의 SWE-bench Multilingual에서 78.3%, Cognition의 FrontierCode v1에서 38.8로 Sonnet 4.6의 15.1보다 2배 이상입니다. Cursor의 독립 측정은 CursorBench에서 61.2% (Sonnet 4.6은 49%, Opus 4.8은 63.8%)입니다. BrowseComp은 단일 에이전트 84.7%, 다중 에이전트 86.6%에 도달합니다[1].
하나의 솔직한 약점: USAMO 2026에서 Sonnet 5는 79.5%로 Sonnet 4.6의 55.0%보다 큰 도약이지만 Opus 4.8의 96.7%보다 훨씬 뒤집니다[1]. 무거운 형식 증명 수학은 이 모델의 일이 아닙니다.
추론 노력 단계가 비용 지렛대
Sonnet 5는 완전한 단계를 노출하는 첫 Sonnet 계층 모델입니다: low, medium, high (기본값), xhigh, max[1]. 이것은 보기만 좋은 손잡이가 아닙니다. 이것이 Opus 품질과 Sonnet 비용 주장을 현실로 만드는 것입니다.

BrowseComp 곡선이 가장 명확한 그림입니다. Sonnet 5의 정확도는 low에서 약 60%에서 max에서 약 85%로 올라가며 현저히 낮은 작업당 비용으로 Opus 4.8 수준 정확도에 도달합니다. Opus 4.8은 여전히 조금 더 높이 올라가지만 Sonnet 5는 훨씬 적은 비용으로 대부분 도달하는데, 이것이 정확히 높은 볼륨 에이전트 루프가 필요한 것입니다[1].
컴퓨터 사용은 더 진지한 이야기를 말합니다.

OSWorld-Verified에서 Opus 4.8은 모든 추론 노력 수준에서 앞섭니다. Sonnet 5는 여전히 Sonnet 4.6을 편안히 이기고 훨씬 저렴하지만, 픽셀 정확한 GUI 제어가 핵심 업무라면 플래그십이 진정한 우위를 유지합니다[1].
실용적인 규칙: 가장 어려운 장기 코딩과 에이전트 작업에는 xhigh, 대부분 업무에는 high, 지연 시간 민감하거나 간단한 작업에는 medium 또는 low. 곳곳에서 max로 기본값을 정하기보다는 경로당 조정하세요.
비용 비교 계층 대비
시스템 카드는 GPT-5.5와 Gemini 3.5 Flash에 대해 경쟁사 수치를 공개합니다. 이것은 절대 경계보다는 비용 비교 계층입니다. "절대 모든 것을 이긴다"가 아니라 "가격대의 모델을 이긴다"고 읽으세요[1].
| 평가 | Sonnet 5 | GPT-5.5 | Gemini 3.5 Flash |
|---|---|---|---|
| SWE-bench Pro | 63.2 | 58.6 | 55.1 |
| Terminal-Bench 2.1 | 80.4 | 83.4 | 76.2 |
| HLE (도구 없음) | 43.2 | 41.4 | 40.2 |
| HLE (도구 포함) | 57.4 | 52.2 | n/a |
| OSWorld-Verified | 81.2 | 78.7 | 78.4 |
| FrontierCode v1 | 38.8 | 25.5 | n/a |
| GDPval-AA v2 (Elo) | 1618 | 1509 | 1357 |
| AutomationBench | 13.5 | 12.9 | 14.5 |
| HealthBench Professional | 57.8 | 51.8 | n/a |
Sonnet 5는 GPT-5.5 대비 대부분의 일대일 비교에서 승리하고 가장 많이 인용되는 것을 잃습니다: Terminal-Bench 2.1, Codex CLI를 운전하는 GPT-5.5가 80.4 대 83.4 점수. Gemini 3.5 Flash 대비 더 광범위한 전면 승리이며 AutomationBench는 유일한 예외입니다. AutomationBench 점수는 전체적으로 낮다는 점을 주목하세요. 이것들은 포화되지 않은 벤치마크이며 해결된 것이 아닙니다[1].
Opus 4.8과 동등하거나 뒤지는 곳
동등하거나 앞서: GDPval-AA v2 지식 업무 (1618 대 1615), 주어진 작업 비용으로 비교 가능한 정확도의 BrowseComp에서 에이전트 검색, Real-World Finance v2 (1219 대 1222), AA-Briefcase 전문 업무 Elo (1393 대 1352)[1].
뒤: SWE-bench Pro (63.2 대 69.2), Terminal-Bench 2.1 (80.4 대 82.7), OSWorld (81.2 대 83.4), HLE 도구 없음 (43.2 대 49.8), CursorBench (61.2 대 63.8), Toolathlon (54.3 대 59.9), USAMO 2026 (79.5 대 96.7)[1].
패턴은 일관성 있습니다. 개방형 지식 업무와 에이전트 검색에서 Sonnet 5는 효과적으로 Opus 수준입니다. 가장 어려운 코딩, 컴퓨터 사용, 형식 수학에서 Opus 4.8은 실제이지만 작은 우위를 유지합니다. 비용이 지배적인 많은 에이전트 턴을 실행하는 업무에서 Sonnet 5는 합리적인 기본값이고 Opus는 어려운 부분을 위한 에스컬레이션 경로입니다.
Claude Sonnet 5 사용 방법: 이전 코드를 부수는 네 가지 변경
Sonnet 5는 Opus 4.7/4.8 요청 표면을 채택하므로 마이그레이션은 문자열 스왑보다 더 많습니다[1].
적응형 사고가 기본으로 켜짐. Sonnet 4.6은 요청하지 않으면 생각 없이 실행했습니다. Sonnet 5는 요청별로 작업이 보증하는 추론 양을 결정하며 기본으로 적응형으로 생각합니다. 원시 속도가 필요할 때 명시적으로 비활성화할 수 있습니다.
budget_tokens 제거됨. 수동 사고 예산은 이제 400을 반환합니다. 추론 노력 단계를 통해 깊이를 제어하세요.
샘플링 파라미터 거부됨. 기본이 아닌 temperature, top_p, top_k는 400을 반환합니다. 프롬프팅으로 조정하세요.
토크나이저는 약 30% 더 조밀. Sonnet 5는 Opus 4.7에서 도입된 토크나이저를 공유하여 같은 텍스트를 약 30% 더 많은 토큰으로 전환합니다. 토큰당 가격은 변하지 않으므로 동등한 요청이 Sonnet 4.6보다 더 비용이 들 수 있으며 이전 토크나이저에 조정된 max_tokens 제한은 이제 생각 중간에 출력을 자를 수 있습니다.
마지막 것이 값비싼 놀람입니다. 자신의 프롬프트에서 실제 지출을 다시 측정하세요. 스티커 가격이 Sonnet 4.6에서 깔끔하게 매핑된다고 가정하지 마세요.
언급할 가치가 있는 한 가지 기능 추가: Sonnet 5는 고해상도 이미지 계층을 가진 첫 Sonnet 계층 모델로, 긴 모서리에 최대 2576 픽셀과 4784 시각 토큰은 이전 1568 픽셀 제한 대비입니다. 자동으로 활성화되며 조밀한 문서, 차트, 스크린샷 이해에 중요합니다[1].
가격
| 항목 | 도입 (8월 31일까지, 2026) | 표준 (9월 1일부터, 2026) |
|---|---|---|
| 입력 | $2 / MTok | $3 / MTok |
| 출력 | $10 / MTok | $15 / MTok |
| 캐시 읽기 | ~$0.20 / MTok | ~$0.30 / MTok |
| 배치 | $1 / $5 | 표준의 50% |
Opus 4.8의 $5 / $25 대비 Sonnet 5는 도입 요율에서 대략 비용의 1/3이고 표준 요율에서 약 60%입니다[1]. 추론 다이얼과 프롬프트 캐싱을 계층하면 잘 조정된 에이전트 업무에서 격차가 넓어집니다.
두 가지 주의 사항. 더 조밀한 토크나이저는 스티커 비교를 신뢰하지 않고 실제 지출을 다시 계산해야 한다는 의미입니다. 그리고 Priority Tier는 Sonnet 5에서 이용할 수 없습니다[1].
코드가 처리해야 할 안전 동작
Sonnet 5는 실시간 사이버보안 보호 조치를 포함한 첫 Sonnet 계층 모델입니다. 금지되거나 높은 위험의 사이버 및 생물학 주제에 접근하는 요청은 거부되거나 성공 HTTP 200으로 거부 정지 이유 대신 에러로 반환될 수 있습니다[1].
보안 도구 또는 생명과학 워크플로를 구축 중이고 양성이지만 인접한 요청이 분류기를 트립할 수 있는 경우 모든 200이 사용 가능한 내용을 지니고 있다고 가정하지 않고 그 정지 이유를 명시적으로 처리하세요. Anthropic은 또한 Sonnet 4.6보다 더 낮은 환각 및 아부 비율을 보고하는데, 이는 출력이 인간 검사 없이 다운스트림에서 신뢰되는 곳에 중요합니다[1].
Claude Sonnet 5를 사용해야 하는 사람
비용이 턴당 합성되는 고볼륨 에이전트 업무를 위한 합리적인 기본값입니다: 코딩 에이전트, 브라우저 및 터미널 자동화, 검색 및 연구 루프. 배송 기능에 LLM을 포함하는 제품 빌더, 1M 윈도우와 낮은 토큰당 가격이 대량 처리를 가능하게 하는 장문 컨텍스트 문서 업무에 맞습니다.
대신 Opus 4.8 또는 Opus 5를 도달하세요. 작업이 어려운 부분: 가장 까다로운 코딩, 픽셀 정확한 컴퓨터 사용, 형식 수학, 플래그십의 소수 포인트 우위가 프리미엄을 정당화하는 경우입니다.
reAPI에서 Sonnet 계층 모델 실행
직설적으로 말씀드리자면: Claude Sonnet 5는 reAPI 게이트웨이에 오늘 없습니다. 이용 가능한 Sonnet 계층 모델은 Claude Sonnet 4.6이고 게이트웨이의 Claude 모델은 Opus 5, Opus 4.8, Opus 4.7, Sonnet 4.6, Fable 5입니다.
이것이 들리는 것보다 덜 중요한 이유는 가격이 실제로 어디에 떨어지는지입니다. Sonnet 5는 9월부터 $3 / $15로 나열됩니다. reAPI에서 Claude Opus 5는 $2.40 / $12.00 그리고 Sonnet 4.6은 동일합니다. 그래서 계층 위 모델은 Sonnet 5의 표준 리스트 가격보다 게이트웨이에서 비용이 덜 듭니다. 그리고 Opus 5는 Fable 5 비용의 절반으로 경계 지능을 전달하는 것 같습니다.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_REAPI_KEY",
base_url="https://api.reapi.ai/v1",
)
resp = client.chat.completions.create(
model="claude-opus-5",
messages=[{"role": "user", "content": "Plan and run this multi-step refactor."}],
max_tokens=16000,
stream=True,
)엔드포인트는 OpenAI 호환이고 네이티브 Anthropic /v1/messages 표면도 이용 가능합니다. 요율과 요청 형태는 reapi.ai/models에 있으며 Opus 5 참고는 reapi.ai/docs/claude-opus-5에 있습니다.
평가가 특히 Sonnet 5 가격대가 아닌 동작을 필요로 한다면 Anthropic을 통해 직접 호출하세요.
FAQ
Claude Sonnet 5가 Opus 4.8보다 낫습니까?
개방형 지식 업무와 에이전트 검색에서 효과적으로 동등하고 Sonnet 5는 GDPval-AA v2에서 약간 앞서갑니다(1618 대 1615). 가장 어려운 코딩, 컴퓨터 사용, 형식 수학에서 Opus 4.8은 작은 우위를 유지합니다[1].
Claude Sonnet 5 비용은 얼마입니까?
2026년 8월 31일까지 백만 입력 토큰당 $2, 백만 출력 토큰당 $10, 9월 1일부터 $3 / $15로 인상. 프롬프트 캐싱은 캐시된 컨텍스트 읽기를 대략 90% 자르고 배치 API는 요율을 절반으로 줄입니다[1].
xhigh 추론 노력 단계는 무엇입니까?
high와 max 사이의 추론 설정으로 장기 에이전트와 코딩 작업을 위해 조정. Sonnet 5는 완전한 단계를 지원하는 첫 Sonnet 계층 모델[1].
Sonnet 4.6에서 마이그레이션 후 비용이 올랐습니까?
토크나이저는 약 30% 더 조밀해서 같은 텍스트가 변하지 않은 토큰당 가격으로 약 30% 더 많은 토큰이 됩니다. 프롬프트를 다시 계산하고 긴 출력이 잘리지 않도록 max_tokens를 높이세요[1].
Claude Sonnet 5는 1M 토큰 컨텍스트 윈도우를 지원합니까?
네, 표준 토큰당 요율에 장문 컨텍스트 할증금 없이 기본적으로 1M이고 최대 128K 출력 토큰까지[1].
Sonnet 4.6에서 마이그레이션할 때 무엇이 부수어집니까?
budget_tokens는 400을 반환하고 기본이 아닌 샘플링 파라미터는 400을 반환하고 적응형 사고는 이제 기본이고 더 조밀한 토크나이저는 비용과 자르기 동작을 모두 바꿉니다[1].
Claude Sonnet 5는 컴퓨터를 제어할 수 있습니까?
네. 도구 사용, 웹 검색, 웹 페치, 코드 실행, 컴퓨터 사용을 지원하고 Opus 4.8의 83.4%에 대해 OSWorld-Verified에서 81.2%를 점수[1].
Claude Sonnet 5는 reAPI에서 이용 가능합니까?
현재 아닙니다. 게이트웨이는 Claude Opus 5, Opus 4.8, Opus 4.7, Sonnet 4.6, Fable 5를 지원합니다. reAPI의 Opus 5는 Sonnet 5의 표준 리스트 요율보다 토큰당 비용이 적습니다.
계층과 가격대 선택
Claude Sonnet 5는 중앙 약속을 전달합니다. 코딩과 에이전트 업무에서 도입 윈도우 동안 비용의 1/3이라면 충분히 가깝게 Opus 4.8에 착륙해 합리적인 기본값이 되고 플래그십을 어려운 부분으로 예약합니다. GPT-5.5 및 Gemini 3.5 Flash 대비 대부분의 일대일 비교에서 이기는데, Terminal-Bench, AutomationBench, 형식 수학에 정직한 예외를 가집니다.
두 가지가 산술이 실제 접촉과 생존하는지 결정합니다. 9월 가격 단계는 Opus의 1/3에서 약 60%로 이동하고 더 조밀한 토크나이저는 스티커 비교가 실제 지출을 과소 표현한다는 의미입니다. 커밋하기 전에 자신의 프롬프트에서 모두 측정하세요. 이것이 토크나이저를 청구 내역에서 발견하지 않고 Claude Sonnet 5를 사용하는 방법이고 이것이 계층 레이블이 완료된 작업당 실제로 지불하는 번호보다 덜 중요한 이유입니다.
References
- Anthropic. Introducing Claude Sonnet 5. Retrieved July 2026 from anthropic.com/news/claude-sonnet-5
- Anthropic. Models overview — specs and pricing for all current Claude models. Retrieved July 2026 from platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. Pricing — token, cache, and batch rates. Retrieved July 2026 from platform.claude.com/docs/en/about-claude/pricing
Further reading
- reAPI. How to use Claude Opus 5. reapi.ai/blog/how-to-use-claude-opus-5
- reAPI. How to use Claude Opus 4.8. reapi.ai/blog/how-to-use-claude-opus-4-8
- reAPI. Model catalog. reapi.ai/models
작성자

카테고리
xhigh 추론 노력 단계는 무엇입니까?Sonnet 4.6에서 마이그레이션 후 비용이 올랐습니까?Claude Sonnet 5는 1M 토큰 컨텍스트 윈도우를 지원합니까?Sonnet 4.6에서 마이그레이션할 때 무엇이 부수어집니까?Claude Sonnet 5는 컴퓨터를 제어할 수 있습니까?Claude Sonnet 5는 reAPI에서 이용 가능합니까?계층과 가격대 선택ReferencesFurther reading더 많은 게시물

Dreamina Seedance 2.5 프롬프트 가이드: 레퍼런스와 타이밍
공식 레퍼런스 한도와 30초 단계 구성, 타임스탬프 제어, 편집, 연장, 키프레임 템플릿으로 Seedance 2.5 프롬프트를 개선하는 방법입니다.


Higgsfield 대체제로 비교하는 AI 비디오 생성 플랫폼
AI 비디오 생성을 위한 Higgsfield 대체제를 reAPI, Atlas Cloud, fal, Replicate, Krea, Dreamina에서 비교합니다.


Claude Fable 5.1 vs Astra: 선택 가이드
Claude Fable 5.1과 GPT-6 Astra를 컨텍스트, 도구, 캐싱, 보존 기간, 작업 적합성으로 비교하고 자신의 워크로드에서 공정하게 평가하는 방법.
