
Claude Fable 5.1이 더 싼가? 캐시 비용 계산
Claude Fable 5.1은 기본 요금 $10/$50을 유지하지만 캐시 읽기를 $0.25로 인하합니다. 실제 작업 비용을 계산하고 구독 요금제 혼동을 피하세요.
Claude Fable 5.1은 Claude Fable 5의 헤드라인 API 요금에서 더 싸지 않습니다. 둘 다 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50입니다. 절감은 더 좁고 잠재적으로 상당합니다. Fable 5.1 캐시 읽기는 토큰 100만 개당 $0.25이며, Fable 5의 $1에서 인하되었습니다. 캐시 쓰기 비용은 두 모델에서 동일합니다.[1]
이것이 모든 작업에서 더 낮은 청구서를 보장하지는 않습니다. 캐시 히트가 적거나 출력이 더 길거나 도구 차례가 많거나 노력 수준이 높은 작업은 마이그레이션 후에도 동일하거나 더 높은 비용이 될 수 있습니다. 또한 Claude 구독 사용 미터가 75% 감소한다는 의미도 아닙니다. 구독 허용치와 API 토큰 청구서는 서로 다른 청구 시스템입니다. 계획 중인 경로에 대해 현재 Claude Fable 5.1 모델 페이지를 사용한 다음, 스프레드시트에 복사한 업스트림 헤드라인이 아닌 해당 경로의 실제 사용 기록으로 계산하세요.
빠른 답변
- Fable 5.1은 Fable 5의 $10/MTok 입력 및 $50/MTok 출력 요금을 유지합니다.[1]
- 측정 가능한 할인은 캐시 읽기입니다. $1/MTok 대신 $0.25/MTok입니다. 캐시 쓰기 가격은 변경되지 않습니다.
- 따라서 500K 토큰 캐시 히트는 출력, 도구, 재시도 및 거부된 작업이 계산되기 전에 $0.375를 절감합니다.
- 해당 API 할인을 Claude 플랜 허용치 청구로 변환하지 마세요. 구독 미터와 API 청구서는 별개입니다.[4]
"더 싼"은 네 가지 다른 숫자를 나타낼 수 있습니다
대부분의 이 릴리스에 대한 주장은 최소 두 개 이상을 섞습니다.
| 숫자 | 측정 대상 | 캐시 요금 인하가 변경할 수 있는가? |
|---|---|---|
| API 표시 가격 | 각 토큰 범주에 대한 공급업체 요금 | 예, 하지만 캐시 읽기 범주만 변경되었습니다 |
| 요청 비용 | 토큰 수량에 적용 가능한 요금을 곱한 값 | 예, 캐시 읽기 토큰 비율에 비례합니다 |
| 완료된 작업당 비용 | 하나의 수락된 결과에 필요한 모든 요청, 재시도, 도구 및 실패한 시도 | 가능합니다. 동작과 출력 길이도 중요합니다 |
| 구독 사용 미터 | Claude 및 Claude Code 플랜 내 허용치 또는 사용 크레딧 | 단순 $0.75-per-MTok 변환을 통해서는 아닙니다 |
처음 두 개는 API 사용 객체 및 요금 카드에서 직접 계산할 수 있습니다. 세 번째는 애플리케이션 수준 작업 ID와 수락 규칙이 필요합니다. 네 번째는 관련 Claude 플랜의 공식 규칙이 필요합니다.
누군가 "Fable 5.1은 75% 더 싸다"고 하면, 어느 줄을 뜻하는지 물어보세요. 캐시 읽기 단위 요금만 75% 하락했습니다.
요금 카드, 나란히
아래의 모든 가격은 2026년 9월 7일 기준 Anthropic API 표시 가격 (미국 달러, 토큰 100만 개당)입니다.[1]
| 토큰 범주 | Claude Fable 5 | Claude Fable 5.1 | 변화 |
|---|---|---|---|
| 기본 입력 | $10.00 | $10.00 | 없음 |
| 5분 캐시 쓰기 | $12.50 | $12.50 | 없음 |
| 1시간 캐시 쓰기 | $20.00 | $20.00 | 없음 |
| 캐시 히트 또는 새로고침 | $1.00 | $0.25 | −75% |
| 출력 | $50.00 | $50.00 | 없음 |
| 배치 입력 | $5.00 | $5.00 | 없음 |
| 배치 출력 | $25.00 | $25.00 | 없음 |
캐시 읽기 승수는 Fable 5.1에서 기본 입력의 0.025배이며, Fable 5의 일반적인 0.1 승수와 비교됩니다. 5분 쓰기는 기본 입력의 1.25배입니다. 1시간 쓰기는 기본 입력의 2배입니다. Anthropic은 이러한 캐시 승수가 배치 및 데이터 거주와 같은 다른 승수와 스택할 수 있다고 말합니다.[1]
예를 들어, US 전용 추론을 요청하면 지원되는 최근 Claude 모델의 입력, 출력, 캐시 쓰기 및 캐시 읽기에 1.1 승수가 추가됩니다. 파트너 운영 클라우드 서비스는 자체 지역 가격 책정이 있습니다. 비용 워크시트는 따라서 모델 이름만이 아닌 제공자와 추론 영역을 기록해야 합니다.[1]
비용 보고서에 포함되어야 하는 공식
각 토큰 수를 백만 단위로 측정하세요:
U = 캐시되지 않은 입력 토큰 / 1,000,000
W5 = 5분 캐시에 작성된 토큰 / 1,000,000
W60 = 1시간 캐시에 작성된 토큰 / 1,000,000
R = 캐시 읽기 토큰 / 1,000,000
O = 출력 토큰 / 1,000,000직접 표시 요금으로 Fable 5.1 요청은:
request_cost_5_1 = 10U + 12.5W5 + 20W60 + 0.25R + 50OFable 5의 경우, 캐시 읽기 항만 변경됩니다:
request_cost_5 = 10U + 12.5W5 + 20W60 + 1.00R + 50O토큰 수량이 동일하게 유지되면, 절감은 따라서:
saving = 0.75R평문으로, 토큰 100만 개마다 캐시 읽기는 $0.75를 절감합니다. 공식은 의도적으로 조건부입니다. 모델 동작은 U, R 및 O와 작업을 완료하는 데 필요한 요청 수를 변경할 수 있습니다.
500K 캐시된 접두사를 가진 작업 세션
가상의 10개 요청 코딩 세션을 생각해보세요. 각 요청은 동일한 500,000 토큰 저장소 접두사를 보고, 20,000개의 캐시되지 않은 입력 토큰을 추가하며, 5,000개의 출력 토큰을 생성합니다. 첫 번째 요청이 5분 캐시 항목을 생성하고 다음 9개가 이를 히트합니다. 이는 가격 책정 설명이지, 측정된 모델 벤치마크가 아닙니다.
첫 번째 요청: 동일한 비용
500K 캐시 쓰기 = 0.5 × $12.50 = $6.25
20K 신규 입력 = 0.02 × $10 = $0.20
5K 출력 = 0.005 × $50 = $0.25
첫 번째 요청 $6.70두 버전 모두 쓰기, 캐시되지 않은 입력 및 출력 요금이 일치하므로 $6.70입니다.
각 나중의 캐시 히트
| 항목 | Fable 5 | Fable 5.1 |
|---|---|---|
| 500K 캐시 읽기 | $0.500 | $0.125 |
| 20K 캐시되지 않은 입력 | $0.200 | $0.200 |
| 5K 출력 | $0.250 | $0.250 |
| 요청 합계 | $0.950 | $0.575 |
9개의 히트 전체에서:
Fable 5 합계 = $6.70 + (9 × $0.950) = $15.250
Fable 5.1 합계 = $6.70 + (9 × $0.575) = $11.875
절감 $3.375이 구성 세션의 경우 감소는 약 22.1%이지만, 캐시 읽기 요금은 75% 하락했습니다. 변경되지 않은 캐시 쓰기, 신규 입력 및 출력이 절감을 희석합니다. 캐시 읽기의 더 큰 비중이 있는 세션은 더 큰 백분율을 절감할 것입니다. 캐시 히트가 없는 세션은 동일한 토큰 수로 아무것도 절감하지 않습니다.
캐시 쓰기는 언제 수익성이 있는가?
캐싱을 일반 입력으로 동일한 토큰을 반복적으로 전송하는 것과 비교하세요.
5분 Fable 5.1 캐시의 경우, 첫 쓰기는 정상 입력 요금의 1.25배이고 한 번의 히트는 0.025배입니다. 초기 요청과 한 번의 재사용에서, 안정적인 접두사는 캐시되지 않은 2.0 단위 대신 1.25 + 0.025 = 1.275 입력 요금 단위입니다. 한 번의 캐시 읽기 후에 수익성이 있습니다.
1시간 항목의 경우, 첫 쓰기는 2.0 단위입니다. 한 번의 읽기를 추가하면 2.025로 나타나며, 캐시되지 않은 두 번 전송보다 약간 더 많습니다. 두 번째 읽기를 추가하면 2.05로 나타나며, 캐시되지 않은 3.0과 비교됩니다. Anthropic의 가격 책정 가이드는 따라서 5분 기간이 한 번의 캐시 읽기 후에, 1시간 기간이 2번 후에 수익성이 있다고 말합니다.[1]
이 계산은 히트를 가정합니다. 변경하는 접두사는 예상 읽기를 새 쓰기로 바꿀 수 있습니다. 안정적인 콘텐츠를 먼저 배치하고, 변동하는 지침을 나중에 배치하며, 프롬프트가 캐시되었다고 가정하지 않고 캐시 생성과 읽기 수를 모니터링하세요. Fable 5.1 API 설명서는 경로별 요청 형태를 다루고 있습니다. 청구 확인은 여전히 반환된 사용 필드와 청구서에서 나옵니다.
더 싼 캐시가 더 비싼 작업을 생성할 수 있는 이유
캐시 가격은 다중 요청 작업의 한 항입니다. 마이그레이션 후 다음 이동 원인을 추적하세요:
출력 길이
출력은 게시된 요금에서 기본 입력보다 토큰당 5배 더 비쌉니다. 추가 10,000개의 출력 토큰은 $0.50의 비용입니다. 이전 예제에서 이는 500K 캐시 읽기 절감 $0.375 이상입니다. 출력 제한을 설정하고 길이를 보상하기보다는 유용한 완성을 등급을 매기세요.
도구 차례
Anthropic은 Fable 5.1이 Fable 5가 독립적인 호출을 배치할 수도 있는 상황에서 차례당 하나의 도구 호출을 발행할 수 있음을 지적합니다. 추가 라운드 트립은 캐시된 컨텍스트를 저렴하게 재생할 수 있지만, 새로운 지침, 도구 결과, 출력 및 지연 시간도 추가할 수 있습니다.[3] 전체 루프를 세세요.
노력
Fable 5.1은 5개의 노력 수준을 지원하며 high 기본값을 설정합니다. xhigh 또는 max로 옮겨진 이전 설정에서 작업은 캐싱 개선 여부와 상관없이 더 많은 추론 및 시간을 소비할 수 있습니다. 모델 이름을 유일한 변수로 처리하기보다는 수락된 결과에 대한 설정을 비교하세요.[3]
캐시 무효화
캐시된 접두사, 도구 정의 또는 대화 기록을 변경하면 재사용을 줄일 수 있습니다. Fable 5.1은 또한 보존된 사고를 그것을 생성한 접두사에 바인딩합니다. 부주의한 이력 편집은 추론을 떨어뜨리고 작업을 다시 시작할 수 있습니다. Fable 5.1 마이그레이션 체크리스트는 이러한 호환성 규칙을 다룹니다.
실패 및 거부된 실행
더 낮은 요청당 비용은 더 많은 실행이 인간의 수정이 필요한 경우 도움이 되지 않습니다. 수락된 작업을 정의하세요(테스트 통과, 스키마 유효, 소스 지원, 금지된 파일 미변경). 그리고 원시 요청이 아닌 수락된 작업으로 총 지출을 나누세요.
cost_per_accepted_task = total_cost_for_task_cohort / accepted_tasksAnthropic의 25% 및 45% 추정을 읽는 방법
Anthropic은 Fable 5.1이 일반적인 토큰 청구 워크로드에서 Fable 5보다 약 25% 적게 비용이 들며 매우 에이전트 작업에서 약 45%까지 절감할 수 있다고 말합니다.[2] 출시 설명은 비교가 기본 노력에서 2026년 8월 4주 사용을 사용했음을 설명합니다. "일반적인" 혼합은 Claude Enterprise, Claude Code 및 API 트래픽을 다루는 동안 에이전트 혼합은 컨텍스트가 무겁고 도구가 무거웠습니다.
이러한 수치는 청구서 모델에 대한 유용한 계획 이전이지, 대체물이 아닙니다. 캐시 읽기 공유가 낮을 수 있습니다. 새 모델은 다른 차례 수를 가질 수 있습니다. 게이트웨이는 또한 Anthropic의 직접 API와 다른 요금 카드를 가질 수 있습니다. 예상이 예산 제안에 나타날 때마다 레이블을 지정하세요.
API 계산이 하락하지만 Claude Code 사용 미터가 하락하지 않는 경우, 캐시 동작을 조사하기 전에 이들을 별개의 청구 시스템으로 비교하세요. 미터는 계획 허용치 또는 사용 신용 규칙을 적용할 수 있으며, 직접 API 토큰 청구서를 노출하지 않을 수 있습니다.
API 청구는 Claude 구독 미터가 아닙니다
Anthropic의 도움말 센터는 Fable 5 및 Fable 5.1이 유료 Claude 플랜에서 동일하게 작동한다고 말합니다.[4]
- Max 플랜, 프리미엄 팀 좌석 및 레거시 좌석 기반 Enterprise 플랜의 프리미엄 좌석에서 Fable 사용은 주간 사용 제한의 최대 50% 포함됩니다. Fable 제한 후 사용자는 모델을 전환하거나 사용 신용으로 계속할 수 있습니다.
- Pro 플랜 및 표준 팀 좌석에서 Fable 5 및 5.1은 플랜의 포함된 사용이 아닌 사용 신용을 사용합니다.
- 좌석 기반 Enterprise 플랜의 표준 좌석은 조직 활성화 사용 신용이 필요합니다.
- 사용 기반 Enterprise 및 Claude API는 표준 API 요금으로 청구됩니다.
초기 프로모션은 일부 Fable 5 사용을 주간 제한 내에서 허용하고, 2026년 7월 19일에 종료되었으며, Fable 5.1에는 절대 적용되지 않았습니다. 이전 게시물과 스크린샷은 더 이상 적용되지 않는 규칙을 설명할 수 있습니다.[4]
실제 구별은 간단합니다. API 청구서는 요금 카드로 곱해질 수 있는 토큰 범주를 노출합니다. Claude 또는 Claude Code 플랜 미터는 플랜 정책 및 사용 할당을 나타냅니다. Anthropic이 해당 계정 및 표면에 대한 정확한 변환을 게시하지 않는 한 하나를 다른 것에서 역공학화하지 마세요.
FAQ
Claude Fable 5.1이 Fable 5보다 75% 더 싸다?
캐시 읽기 단위 요금만 75% 낮습니다. 기본 입력, 캐시 쓰기 및 출력은 동일한 요금을 유지합니다. 총 절감은 모든 변경되지 않은 항목과 모델 동작의 모든 변경을 설명한 후 캐시 읽기 감소와 같습니다.
프롬프트 캐싱을 사용하지 않으면 돈을 절감할 수 있나?
토큰 수가 같을 때 게시된 요금 변경에서 아닙니다. Fable 5.1은 출력 길이, 도구 차례, 노력, 재시도 또는 수락률을 통해 여전히 작업 비용을 변경할 수 있지만, 이들은 목록 가격 감소가 아닌 워크로드 결과입니다.
자동 프롬프트 캐싱이 무료인가?
아닙니다. 캐시 생성, 캐시 읽기 및 일반 입력에는 별도의 요금이 있습니다. 자동 캐싱은 중단점이 관리되는 방식을 변경합니다. 캐시 쓰기 요금을 제거하지는 않습니다.[1]
캐시 새로고침이 낮은 Fable 5.1 요금을 사용하나?
Anthropic의 표는 캐시 히트와 새로고침을 Fable 5.1에 대해 토큰당 100만 개당 $0.25로 그룹화합니다. 요청 수에서 새로고침을 추정하기보다는 응답 및 청구 보고서의 관련 사용 필드를 확인하세요.
배치가 Fable 5.1을 절반 가격으로 만드나?
Anthropic은 두 Fable 버전에 대해 배치 입력 및 출력을 표준 요금보다 50% 아래로 나열합니다. 캐시 및 다른 승수는 스택할 수 있으므로 전체 혼합 청구서를 2로 나누기보다는 각 토큰 범주를 계산하세요.[1]
전환 후 Claude Code 사용이 감소하지 않은 이유는?
플랜 미터는 단순히 API 캐시 읽기 항목이 아닙니다. 먼저 세션이 포함된 플랜 허용치 또는 사용 신용을 사용했는지 확인한 다음, 유사한 세션을 비교하세요. 또한 출력, 노력, 도구 차례, 캐시 히트 및 프롬프트 접두사가 안정적으로 유지되었는지 확인하세요.
기본값을 전환하기 전에 실행할 청구서 테스트
최소 한 개의 일반적인 청구 주기를 내보내고 애플리케이션 작업 ID별로 요청을 그룹화하세요. 각 모델에 대해, 캐시되지 않은 입력, 5분 쓰기, 1시간 쓰기, 캐시 읽기, 출력, 재시도 및 수락된 작업을 합산하세요. 이전 토큰 수량을 새 요금 카드로 다시 가격을 매기는 것이 캐시 할인을 격리하기 위해 동일하게 합니다. 그런 다음 해당 추정값과 실제 Fable 5.1 수량을 비교하여 동작 변경을 노출하세요.
다시 가격이 매겨진 추정이 더 낮지만 관찰된 작업 비용이 더 높으면, 캐시 할인은 작동하고 있습니다. 워크로드 형태가 변경되었습니다. 그 찾기는 "더 싼가"에 대해 주장하는 것보다 훨씬 더 실행 가능합니다. 출력 성장, 손실된 캐시 히트, 추가 차례 또는 실패한 작업을 직접 가리킵니다.
References
- Anthropic, API pricing, accessed September 7, 2026.
- Anthropic, Introducing Claude Fable 5.1 and Mythos 5.1, September 1, 2026.
- Anthropic, Migrating to Claude Fable 5.1 and Claude Mythos 5.1, accessed September 7, 2026.
- Anthropic Help Center, Claude Fable models on your plan, accessed September 7, 2026.
작성자

카테고리
더 많은 게시물

코딩과 쓰기: 최고의 Claude 모델 선택 가이드
Claude 모델별 코딩 벤치마크 비교: Fable 5는 SWE-Bench Pro 1위이지만 Opus 5는 터미널 작업과 지식 작업에서 우수하고 가격은 3분의 1입니다.


Seedance 2.5 현황: API, 가격, 제한
Seedance 2.5는 현재 이용할 수 있습니다. reAPI 모델 ID, 480p/720p 가격, 30초 출력, 참조 한도와 소스 비디오 과금을 정리합니다.


Hailuo AI 가격 비교 2026: 다른 동영상 AI와의 요금 비교
Hailuo AI의 MiniMax H3을 Seedance 2.5, Kling 3.0, Veo 3.1과 비교합니다. 초당 가격, 동영상 길이, 음성, 레퍼런스 입력의 차이를 설명합니다.
