
Claude Haiku 5.5 vs Claude Sonnet 5.5: 도구·사고·비용 비교
Claude Haiku 5.5와 Claude Sonnet 5.5의 도구 호출, 사고, JSON 출력, 토큰 비용을 비교합니다. reAPI에서 테스트한 범위를 확인하고, 같은 입력과 평가 기준으로 직접 사용하는 작업에서 두 모델을 평가하는 방법을 알아보세요.
Claude Haiku 5.5와 Claude Sonnet 5.5는 모두 문서에 명시된 100만 토큰의 컨텍스트 윈도와 128,000토큰의 일반 출력 한도를 갖습니다. 제어 방식은 다릅니다. Claude Haiku 5.5는 기본 effort가 medium이고 도구 강제 지정을 허용하며, Claude Sonnet 5.5는 기본 effort가 high이고 도구 자동 선택을 사용합니다[1][2].
따라서 Claude Haiku 5.5와 Claude Sonnet 5.5 비교는 실행하려는 워크플로에 맞춰 접근해야 합니다. 이 가이드는 문서에 명시된 요청 동작을 비교하고, reAPI 팀이 수행한 소규모 기능 확인을 설명하며, 실제 작업을 평가할 수 있는 방법을 제시합니다. 몇 건의 요청만으로 코딩 품질의 순위를 매기거나 응답 지연에서 우위가 있다고 주장하지 않습니다.
핵심 요약
- 두 모델 모두 텍스트와 이미지를 입력받고 텍스트를 반환하며, 문서에 명시된 컨텍스트와 일반 출력 한도가 같습니다[1][2].
- Claude Haiku 5.5는 effort가 low, medium, high일 때 사고를 끌 수 있고, 이름으로 지정한 도구를 강제 호출할 수 있습니다. 정해진 정보 추출이나 요청 분류·배정 단계에서 유용한 제어 방식의 차이입니다[3].
- Claude Sonnet 5.5는 effort가 low, medium, high일 때 도구 호출 사이 사고 모드를 제공합니다. 초기 사고를 건너뛰면서도 도구 호출 사이의 사고는 유지할 수 있습니다[4].
- 10월 9일 확인에서는 두 모델 모두 구조화된 JSON, 도구 결과를 이용한 대화 이어 가기, 문서 인용, 스트리밍, 캐시 읽기가 관찰되었습니다. API 문서에 테스트 범위가 기록되어 있습니다[5][6].
- 대표적인 요청을 기준으로 현재 Claude Haiku 5.5 가격과 Claude Sonnet 5.5 가격을 비교하세요. 공식 직접 이용 요금과 reAPI 요금은 별도 체계입니다[7].
Claude Haiku 5.5 vs Claude Sonnet 5.5: 워크플로를 바꾸는 제어 방식
모델을 바꾸면 모델 ID 외에도 달라지는 것이 있습니다. Claude Haiku 5.5와 Claude Sonnet 5.5 사이에서 마이그레이션할 때는, 기존 요청의 의미가 그대로 유지된다고 가정하기 전에 사고와 도구 선택 방식을 검토하세요.
| 문서에 명시된 항목 | Claude Haiku 5.5 | Claude Sonnet 5.5 |
|---|---|---|
| 모델 ID | claude-haiku-5-5 | claude-sonnet-5-5 |
| 컨텍스트 윈도 | 100만 토큰 | 100만 토큰 |
| 일반 요청의 출력 한도 | 사고를 포함한 128,000토큰 | 사고를 포함한 128,000토큰 |
| 기본 effort | Medium | High |
| 선택 가능한 effort | Low, medium, high, xhigh, max | Low, medium, high, xhigh, max |
| 초기 사고 건너뛰기 | effort가 low, medium 또는 high일 때 사고 비활성화 모드 | effort가 low, medium 또는 high일 때 도구 호출 사이 사고 모드 |
| 도구 강제 지정 | 지원 | 자동 선택 사용 |
| 출시일 | 2026년 10월 7일 | 2026년 9월 28일 |
이 표는 2026년 10월 9일에 확인한 Anthropic 모델 문서와 마이그레이션 문서를 요약한 것입니다[1][2][3][4]. 한도는 사양이며, 기존 테스트가 최대 크기의 대화를 실행했다는 의미는 아닙니다.
Claude Haiku 5.5와 Claude Sonnet 5.5의 컨텍스트 한도가 같다고 해서 답변 품질도 같다고 볼 수는 없습니다. 긴 요청에도 명확한 질문과 관련 근거가 필요합니다. 두 모델을 비교할 때 입력을 동일하게 유지하고, 같은 요구 사항으로 답변을 평가하세요.
Claude Haiku 5.5와 Claude Sonnet 5.5의 사고 설정
두 모델은 기본적으로 적응형 사고를 사용합니다. Claude Haiku 5.5의 네이티브 기본 effort는 medium이고, Claude Sonnet 5.5는 high입니다. 사고는 출력 한도를 사용하므로, max_tokens 예산이 아주 작으면 보이는 답변을 위한 여유가 거의 없을 수 있습니다[3][4].
Claude Haiku 5.5와 Claude Sonnet 5.5를 평가할 때는 각 모델의 기본 설정을 비교할지, 같은 effort 설정을 적용할지 결정하세요. 두 방식은 서로 다른 실험입니다. 선택한 방식을 결과와 함께 기록해 두면, 나중에 프롬프트나 effort를 바꿨을 때 원인을 알 수 없는 품질 저하로 오해하지 않을 수 있습니다.
Claude Haiku 5.5의 문서에 명시된 thinking.type: "disabled"는 effort가 low, medium, high일 때 사용할 수 있습니다. Claude Sonnet 5.5는 같은 단계에서 대신 thinking.type: "between_tools"를 사용합니다. 후자는 초기 응답 전 사고를 건너뛰면서 도구 호출 사이의 사고는 허용합니다. 사고를 전반적으로 끄는 스위치는 아닙니다[3][4].
첫 동작이 조회여야 한다면 이 차이가 중요합니다. 애플리케이션이 어떤 데이터를 조회할지 이미 알고 있고, 결과가 도착한 뒤에만 모델의 추론이 필요할 수 있습니다. 대화 응답 하나로 전체 워크플로를 대신 평가하지 말고, 해당 순서를 직접 테스트하세요.
Claude Haiku 5.5와 Claude Sonnet 5.5의 도구 호출·구조화된 결과
Claude Haiku 5.5는 도구 중 하나를 반드시 선택하는 방식과 이름으로 지정한 도구를 강제 호출하는 방식을 모두 지원합니다. Claude Sonnet 5.5의 마이그레이션 가이드는 자동 선택 또는 도구를 사용하지 않는 방식을 안내합니다. 기존에 수행한 이름 지정 도구 테스트에서는 Claude Sonnet 5.5가 업스트림 오류를 반환했습니다[3][4][6].
이는 Claude Haiku 5.5와 Claude Sonnet 5.5를 연동할 때의 구체적인 차이입니다. 분류 함수 하나를 갖는 합성 고객지원 워크플로를 예로 들어 보겠습니다. 모든 요청이 반드시 해당 함수 호출을 생성해야 한다면, Claude Haiku 5.5의 강제 선택을 평가해 볼 수 있습니다. 애플리케이션에 분류 결과 데이터만 필요하다면, 분류를 도구로 다루기보다 구조화된 JSON이 더 단순하게 맞을 수 있습니다.
두 모델 모두 output_config.format을 통한 구조화된 JSON을 지원합니다. 스키마는 출력의 형태를 제어하고, 도구 정의는 애플리케이션이 실행할 수 있는 함수를 설명합니다. 어느 쪽을 사용해도 업무상 사실을 확인해야 합니다. 형식이 올바른 날짜라도 실제 날짜는 틀릴 수 있습니다[8].
Claude Haiku 5.5와 Claude Sonnet 5.5의 도구 기능을 비교할 때, 도구 실행은 애플리케이션에서 담당하세요. 일치하는 도구 사용 ID와 함께 결과를 반환하고, 서명된 사고 블록을 포함한 assistant 콘텐츠 전체를 유지하세요. 이전 응답을 보이는 텍스트만으로 합치면 대화를 원래 상태대로 이어 가는 데 필요한 정보가 사라집니다[3][4].
reAPI 확인에서 실제로 관찰된 결과
reAPI 팀은 2026년 10월 9일에 두 모델을 대상으로 범위를 제한한 직접 요청 40건을 수행했습니다. 합성 텍스트와 도구 테스트 데이터를 사용했으며, 고객 데이터나 실제 도구 작업은 포함하지 않았습니다. 이는 프로토콜과 기능 확인이며, 코딩 벤치마크나 부하 테스트가 아닙니다. 개별 모델 문서에 관찰된 기능과 테스트하지 않은 범위가 설명되어 있습니다[5][6].
| 확인 항목 | 두 모델에서 관찰된 결과 |
|---|---|
| 기본 텍스트와 시스템 지침 | 예상한 합성 표식 반환 |
| 스트리밍 | 네이티브 메시지 및 콘텐츠 이벤트 반환 |
| 구조화된 JSON | 일반 텍스트를 요구하는 상충된 프롬프트보다 요청한 스키마가 우선 적용됨 |
| 엄격한 스키마를 적용한 클라이언트 도구 | 예상한 도구 이름과 구조화된 입력 반환 |
| 도구 결과를 이용한 대화 이어 가기 | 다음 응답에서 제공된 합성 도구 결과를 사용함 |
| 중지 시퀀스 | 중지 사유가 일치하고 표식 뒤의 텍스트는 반환되지 않음 |
| 텍스트 문서 인용 | 답변에 인용 블록 포함 |
| 프롬프트 캐시 | 캐시 생성 카운터에 이어 캐시 읽기 카운터가 확인됨 |
Claude Haiku 5.5와 Claude Sonnet 5.5를 비교할 때 이 확인 결과는 애플리케이션 기능을 평가하기 위한 유용한 출발점이 됩니다. 어느 모델이 더 나은 패치를 만드는지, 큰 PDF 처리에 얼마나 걸리는지, 프로덕션의 동시 요청 환경에서 어떻게 동작하는지는 알려 주지 않습니다.
공식 effort 값 다섯 가지는 모두 수락되었습니다. 수락 여부만으로 상대적인 추론 깊이를 추정하지 않았습니다. 마찬가지로 응답에 사고 블록이 없다고 해서 모델 내부 계산의 모든 세부 사항을 알 수는 없습니다.
알 수 없는 확장 필드를 포함한 네이티브 매개변수는 reAPI를 통해 그대로 전달됩니다. 업스트림이 어떤 설정을 무시하더라도 HTTP 200은 정상적으로 수락된 응답입니다. 따라서 Claude Haiku 5.5와 Claude Sonnet 5.5를 테스트하려면 관찰 가능한 결과가 필요합니다. 캐시 카운터, 요청한 출력 구조, 중지 사유, 다음 답변에 영향을 주는 도구 결과 등이 해당합니다. 매개변수 수락과 실제 동작 확인은 별개의 사실입니다[5][6].
Claude Haiku 5.5와 Claude Sonnet 5.5의 비용은 요청에 따라 달라집니다
Claude Haiku 5.5와 Claude Sonnet 5.5의 비용을 비교하려면 입력 크기, 생성된 출력, 캐시 사용을 알아야 합니다. 두 모델 페이지의 현재 단가로 시작한 뒤, 실제 작업을 대표하는 작은 표본을 실행하고 실제 사용량을 확인하세요. 보이는 답변의 길이만 곱해 계산하지 마세요. 사고도 출력 사용량에 포함됩니다[3][4].
Anthropic의 직접 이용 요금에서 Claude Haiku 5.5는 프롬프트가 100,000토큰을 초과하면 단가가 바뀌며, 이 임계값에는 캐시된 입력도 포함됩니다. Claude Sonnet 5.5의 문서에 명시된 100만 토큰 윈도에는 현재 직접 이용 요금에서 같은 장문 컨텍스트 할증이 없습니다. 이 조건은 Anthropic의 요금 체계에 해당합니다. 다른 서비스의 견적에 그대로 적용하지 마세요[7].
요청이 변하지 않는 접두부를 반복해서 공유한다면 캐싱을 평가해 볼 만합니다. 두 모델 모두 문서에 명시된 캐시 가능한 접두부의 최소 길이는 512토큰이며, 5분과 1시간의 캐시 유지 시간을 지원합니다. 수락된 요청에 캐시 설정이 들어 있다고 해서 적중의 증거가 되는 것은 아닙니다. 생성 및 읽기 카운터를 확인하세요[9].
Claude Haiku 5.5와 Claude Sonnet 5.5를 비교할 때 캐시 조건도 비슷하게 맞추세요. 한 모델에서는 캐시가 이미 생성된 반복 프롬프트를 사용하고 다른 모델에서는 새 프롬프트를 사용하면 비용 비교를 해석하기 어렵습니다. 첫 요청을 측정하는지 반복 사용을 측정하는지 기록하고, 표본 하나를 계정 전체의 절감 효과로 설명하지 마세요.
실제 의사결정에 맞춰 작은 평가 설계하기
다른 모델의 의견에 의존하지 않고 채점할 수 있는 작업을 사용하세요. 정보 추출에서는 값이 알려진 필드와 의도적으로 누락한 정보가 담긴 원본 메모를 준비하세요. 코드 리뷰에서는 실패하는 테스트가 있는 결함을 사용하세요. 리서치 브리프에서는 답변에 남겨야 하는 미해결 질문이 최소 하나 포함된 자료 모음을 준비하세요.
실패 기준이 명확하면 Claude Haiku 5.5와 Claude Sonnet 5.5를 더 쉽게 평가할 수 있습니다. 추출 답변이 누락된 날짜를 만들어 내면 실패입니다. 제안된 패치가 관련 없는 동작을 바꾸면 실패입니다. 리서치 답변의 인용 구절이 주장을 뒷받침하지 못하면 실패입니다. 이는 권장 평가 규칙이며, 두 모델에서 관찰된 성능에 대한 주장이 아닙니다.
같은 입력, 기록된 effort, 출력 예산으로 Claude Haiku 5.5와 Claude Sonnet 5.5를 실행하세요. 반환된 콘텐츠, 사용량, 중지 사유를 보관하세요. 도구를 추가한다면 전체 루프를 테스트하세요. 올바른 첫 호출은 한 단계일 뿐이며, 쓸모 있는 결과는 애플리케이션이 데이터를 반환한 뒤에 나옵니다.
전송 형식을 일관되게 유지하려면 Claude Haiku 5.5 Messages 예제와 Claude Sonnet 5.5 Messages 예제를 사용하세요. Claude 컨텍스트 가이드에서 추가 배경을 확인할 수 있습니다. 버전별 한도는 정확한 모델의 문서를 확인하세요.
Claude Haiku 5.5 vs Claude Sonnet 5.5 자주 묻는 질문
Claude Haiku 5.5가 Claude Sonnet 5.5보다 더 좋은가요?
이번 확인으로 어느 모델이 모든 상황에서 우위라고 결론 내릴 수는 없습니다. Claude Haiku 5.5는 도구 강제 지정과 사고 비활성화 모드를 제공하고, Claude Sonnet 5.5는 기본 effort와 도구 호출 사이 동작이 다릅니다. 선택하기 전에 실제 작업의 요구 사항과 결과를 대조하세요[3][4].
Claude Haiku 5.5와 Claude Sonnet 5.5의 컨텍스트 윈도는 같은가요?
네. 두 모델 모두 문서에 100만 토큰의 컨텍스트와 사고를 포함한 128,000토큰의 일반 출력 한도가 명시되어 있습니다. 한도가 같다고 해서 긴 입력에서의 정보 검색이나 추론 품질도 같다고 입증되는 것은 아닙니다[1][2].
코딩에는 어느 모델을 써야 하나요?
통과 기준이 알려진 테스트가 있는 변경 사항으로 두 모델을 평가하세요. 기존 Claude Haiku 5.5와 Claude Sonnet 5.5 확인은 API 기능을 테스트한 것이며 코딩 품질을 테스트한 것은 아닙니다. Claude Sonnet 5.5 페이지에 코드 리뷰를 시작할 수 있는 프롬프트가 있습니다. 프로젝트의 모듈과 제약 조건에 맞게 조정하세요.
Claude Haiku 5.5와 Claude Sonnet 5.5 모두 구조화된 JSON을 지원하나요?
네. 두 모델 모두 JSON 스키마를 사용하는 output_config.format을 지원합니다. 소규모 테스트에서는 일반 텍스트를 요구하는 상충된 지침이 있어도 스키마에 맞는 출력이 관찰되었습니다. 누락된 값과 도메인별 검증 규칙을 포함해, 실제 스키마는 별도로 평가하세요[5][6].
JSON 출력과 문서 인용을 함께 사용할 수 있나요?
Anthropic 문서에 따르면 같은 요청에서 인용과 구조화된 JSON을 함께 사용할 수 없습니다. 출처 검토가 중요하면 인용이 포함된 서술형 답변을, 애플리케이션에 필드가 필요하면 구조화된 JSON을 선택하세요. 두 결과가 모두 필요하면 별도의 검증 단계를 설계하세요[8].
Claude 구독과 reAPI 호출은 함께 과금되나요?
아니요. reAPI 키로 보내는 호출은 reAPI 계정의 과금 체계를 따릅니다. 현재 토큰 단가는 모델 페이지에서 확인하세요. 별도의 Claude 구독은 해당 요청 비용을 충당하지 않습니다[5][6].
확인 가능한 결과로 선택하기
범위가 정해진 정보 추출 작업, 재현 가능한 코드 문제, 근거 자료가 있는 의사결정으로 Claude Haiku 5.5와 Claude Sonnet 5.5 비교를 시작하세요. 프롬프트와 평가 기준을 고정한 뒤, 설정을 바꾸기 전에 정확성과 실제 사용량을 확인하세요.
문서에 명시된 제어 방식은 Claude Haiku 5.5와 Claude Sonnet 5.5 중 후보를 고르는 데 도움이 됩니다. 적합한지는 전체 워크플로로 확인할 수 있습니다. Claude Haiku 5.5 또는 Claude Sonnet 5.5 페이지를 열어 대표적인 작업을 실행해 보고, 연동할 준비가 되면 연결된 Messages 예제를 사용하세요.
참고 자료
- Anthropic. Claude Haiku 5.5 개요. 2026년 10월 9일 확인: platform.claude.com/docs/en/models/haiku-5-5/overview.
- Anthropic. Claude Sonnet 5.5 개요. 2026년 10월 9일 확인: platform.claude.com/docs/en/models/sonnet-5-5/overview.
- Anthropic. Claude Haiku 5.5 마이그레이션 가이드. 2026년 10월 9일 확인: platform.claude.com/docs/en/models/haiku-5-5/migration-guide.
- Anthropic. Claude Sonnet 5.5 마이그레이션 가이드. 2026년 10월 9일 확인: platform.claude.com/docs/en/models/sonnet-5-5/migration-guide.
- reAPI. Claude Haiku 5.5 API 문서와 관찰된 기능. 2026년 10월 9일. reapi.ai/docs/claude-haiku-5-5.
- reAPI. Claude Sonnet 5.5 API 문서와 관찰된 기능. 2026년 10월 9일. reapi.ai/docs/claude-sonnet-5-5.
- Anthropic. 요금. 2026년 10월 9일 확인: platform.claude.com/docs/en/about-claude/pricing.
- Anthropic. 구조화된 출력. 2026년 10월 9일 확인: platform.claude.com/docs/en/build-with-claude/structured-outputs.
- Anthropic. 프롬프트 캐싱. 2026년 10월 9일 확인: platform.claude.com/docs/en/build-with-claude/prompt-caching.
작성자

카테고리
더 많은 게시물

GPT-6 Sol vs Astra: 가격, 점수, 어떤 effort를 고를까
GPT-6 Sol vs Astra: Sol의 토큰당 가격은 Astra의 5분의 1입니다. 공개 점수, effort를 맞춘 비교 결과, 그리고 GPT-6.1 Sol을 따로 봐야 하는 이유를 정리했습니다.


믿기지 않는다: Kimi K3 — 28조 개 파라미터를 4GB GPU에서 실행
Kimi K3이 정말 4GB GPU에서 실행될까? 1.4TB 가중치 계산, 레이어 오프로딩의 변화, 현재 도구 지원, 실용적인 API 경로를 설명합니다.


Seedance 2.5 API 가격 2026: 네 플랫폼 비교
2026년 8월 확인한 네 플랫폼의 Seedance 2.5 API 실시간 가격 비교, 요금율 1.8배 차이, 레퍼런스 영상 과금 규칙, 실제 사례 3가지.
