
Gemini 4 Argon 가격과 실제 비용
Gemini 4 Argon 가격: 출시가 $2/$10, 표준가 $4/$20, 캐시 입력, GPT-6 Astra·Opus 5.5 대비 실제 작업 비용까지.
Gemini 4 Argon 가격에는 숫자가 두 개 있는데, 대부분의 보도는 첫 번째만 인용합니다. Google은 이 모델을 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10의 출시 기념 가격으로 내놓았고, 캐시된 입력은 일반 입력보다 95% 저렴합니다[1]. 같은 발표문의 각주에는 "after the introductory period expires, the price of $4 per 1M input tokens and $20 per 1M output tokens will apply"(출시 기념 기간이 끝나면 입력 1M 토큰당 $4, 출력 1M 토큰당 $20의 가격이 적용됩니다)라고 적혀 있습니다[1]. 출시 기념 기간이 얼마나 지속되는지는 밝히지 않았습니다.
따라서 Gemini 4 Argon을 기준으로 세우는 예산에는 두 가격을 모두 반영해야 합니다. 이 글은 전체 가격표를 정리하고, 실제 작업 형태 네 가지로 계산해 본 뒤, Google 자체 벤치마크 표에 있는 세 모델 중 두 모델인 GPT-6 Astra, Claude Opus 5.5와 비용을 비교합니다.
TL;DR
- 출시 기념 가격: 입력 1M 토큰당 $2, 출력 1M 토큰당 $10, 캐시 입력은 입력 가격에서 95% 할인된 1M당 $0.10[1].
- 기념 기간 이후 표준 가격: 1M 토큰당 입력 $4, 출력 $20. 이 단계의 캐시 입력 가격은 공개되지 않았습니다[1].
- GPT-6 Astra와 비교: Astra의 정가는 1M 토큰당 입력 $10, 출력 $50이며, 입력이 272K 토큰을 넘으면 더 높은 요율이 적용됩니다[2]. Argon의 출시 기념 가격은 그 5분의 1입니다.
- Claude Opus 5.5와 비교: Opus 5.5의 정가는 입력 $4, 출력 $20으로[3], Argon의 표준 가격과 정확히 같습니다.
- 무료 등급도, 개발자 접근도 아직 없음: 첫 개발자 배포 대상은 "paid API customers"(유료 API 고객)이며, Google은 날짜를 밝히지 않았습니다[1].
Gemini 4 Argon 전체 가격표
Google이 Gemini 4 Argon 가격에 대해 공개한 내용은 표 하나에 모두 들어갑니다. "미공개"로 표시된 칸은 0이 아니라 Google이 밝히지 않은 항목입니다.
| 항목 | 출시 기념 가격 | 표준 가격(기념 기간 이후) |
|---|---|---|
| 입력, 1M 토큰당 | $2.00 | $4.00 |
| 출력, 1M 토큰당 | $10.00 | $20.00 |
| 캐시 입력, 1M 토큰당 | $0.10 (입력가 대비 95% 할인) | 미공개 |
| 긴 컨텍스트 할증 | 미공개 | 미공개 |
| 배치 할인 | 미공개 | 미공개 |
| 출시 기념 기간 길이 | 미공개 |
출처: Google 발표문과 그 각주[1].
눈에 띄는 점이 두 가지 있습니다. 첫째, 출력 가격이 입력 가격의 5배로, GPT-6 Astra와 Claude Opus 5.5가 쓰는 비율과 같습니다[2][3]. 둘째, 캐시 할인 폭이 큽니다. 100만 토큰당 $0.10이면, 에이전트가 턴마다 캐시된 대형 코드베이스를 다시 읽는 비용은 새로 읽을 때의 20분의 1입니다.
Gemini 4 Argon에서 100만 토큰은 얼마인가요?
토큰이 어느 방향이냐에 따라 다릅니다. 입력 100만 토큰은 출시 기념 가격으로 $2, 그 이후 $4입니다. 출력 100만 토큰은 출시 기념 가격으로 $10, 그 이후 $20입니다[1].
Argon에서는 다른 모델보다 출력 쪽이 더 중요합니다. Argon은 실제로 한 번의 응답에서 100만 토큰을 생성할 수 있기 때문입니다. Google은 출력 한도를 64K에서 100만 토큰으로 늘렸습니다[1]. GPT-6 Astra는 출력 128,000 토큰에서 멈추고[2], Claude Opus 5.5는 표준 동기 API에서 128K, 베타 헤더를 붙인 Batch API에서는 300K까지입니다[4]. 따라서 한도를 꽉 채운 Argon 응답 하나는 출력 비용만 출시 기념 가격으로 $10, 표준 가격으로 $20입니다.
실제 작업 비용: Argon vs GPT-6 Astra vs Claude Opus 5.5
정가만 보면 작업의 형태가 가려지므로, 작업 형태 네 가지를 직접 계산했습니다. 모든 수치는 각 제공사가 공개한 표준 API 정가 기준의 단일 요청이며, 배치 할인은 반영하지 않았습니다. Astra는 프롬프트가 입력 272K 토큰을 넘으면 입력 요율이 2배, 출력 요율이 1.5배가 되며[2], 해당하는 경우 이 규칙을 적용했습니다.
| 작업 | Argon 출시 기념가 | Argon 표준가 | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|---|---|
| 코드 리뷰: 입력 100K, 출력 20K | $0.40 | $0.80 | $0.80 | $2.00 |
| 에이전트 턴: 신규 100K + 캐시 400K 입력, 출력 50K | $0.74 | 미공개 | $1.48 | $6.55 |
| 긴 보고서: 입력 200K, 출력 600K | $6.40 | $12.80 | 한 번의 응답으로 불가 | 한 번의 응답으로 불가 |
| 최대 출력: 입력 100K, 출력 1M | $10.20 | $20.40 | 한 번의 응답으로 불가 | 한 번의 응답으로 불가 |
에이전트 행 계산법: Argon 출시 기념가는 100만 토큰당 기준으로 100K × $2 + 400K × $0.10 + 50K × $10입니다. Opus 5.5는 $0.20 캐시 적중 요율을 적용했습니다[3]. Astra는 500K 토큰 프롬프트가 272K를 넘으므로 100만 토큰당 입력 $20, 캐시 입력 $2, 출력 $75가 됩니다[2]. 이 표는 모든 제공사가 별도로 청구하는 캐시 쓰기 일회성 비용을 반영하지 않았습니다.
패턴은 단순합니다. 출시 기념 가격에서 Gemini 4 Argon은 일반 요청 기준으로 Claude Opus 5.5의 절반, GPT-6 Astra의 5분의 1 가격입니다. 기념 기간이 끝나면 Argon과 Opus 5.5의 토큰당 가격은 같아지고, Astra는 여전히 2.5배 비쌉니다. 아래 두 행은 가격 비교가 아닙니다. 한 번의 호출로 그만큼의 텍스트를 반환할 수 있는 모델은 Argon뿐입니다.
출시 기념 가격이 끝나는 시점
Google은 $4와 $20 요율이 "after the introductory period expires"(출시 기념 기간이 끝난 뒤) 적용된다고만 밝혔습니다[1]. 날짜는 없고 개발자 API도 아직 열리지 않았으므로, 대부분의 개발자가 요청을 보내기 전에 출시 기념 기간의 일부가 지나갈 수도 있습니다.
계획은 표준 가격으로 세우세요. $2와 $10에서만 성립하는 워크로드는 아무도 발표하지 않은 날짜에 무너지는 워크로드입니다. $4와 $20에서도 성립한다면, 출시 기념 기간은 덤으로 얻는 할인입니다.
100만 토큰 출력 예산의 실제 의미
긴 출력은 Gemini 4 Argon 가격이 흥미로워지는 지점이자, 예상치 못한 비용이 나올 수 있는 지점입니다. Google은 Argon이 "generate hundreds of thousands of tokens in a single trajectory"(하나의 작업 흐름에서 수십만 토큰을 생성)할 수 있다고 말합니다[1]. 이 기능 덕분에 Argon 에이전트가 libgav1의 SIMD 코드 32K 줄을 다시 작성하고, 800K+ 줄 규모의 커널 마이그레이션을 진행할 수 있었습니다[1].
이는 동시에, 지켜보지 않은 요청 하나가 표준 가격으로 $20를 쓸 수 있다는 뜻이기도 합니다. 다음 세 가지 습관으로 비용을 관리하세요:
- 모든 요청에 최대 출력 예산을 설정하세요. 1M 한도는 기본값이 아니라 여유분으로 다루세요.
- 변하지 않는 컨텍스트는 캐시하세요. 매 턴 다시 읽는 저장소나 문서 묶음은 $2의 신규 입력이 아니라 100만 토큰당 $0.10의 캐시에 두어야 합니다.
- 출력은 토큰이 아니라 작업 단위로 측정하세요. 긴 응답 한 번으로 끝내는 모델은 토큰 단가가 더 높더라도, 짧은 재시도를 다섯 번 해야 하는 모델보다 저렴할 수 있습니다.
reAPI에서의 위치
Google이 개발자 접근을 열지 않았기 때문에 Gemini 4 Argon은 아직 reAPI에서 사용할 수 없습니다[1]. reAPI에 출시되면 Gemini 4 Argon 모델 페이지에 reAPI 가격을 게시하겠습니다.
지금 바로 개발을 시작하고 싶다면 Claude Opus 5.5를 reAPI에서 사용할 수 있으며, Anthropic 자체 플랫폼의 정가는 Argon 표준 가격과 같은 토큰당 가격입니다[3]. 현재 reAPI 요율은 각 모델 페이지에 있습니다. 출력 상한이 비용에 왜 중요한지는 LLM 최대 출력 토큰 가이드를 참고하세요.
FAQ
Gemini 4 Argon 가격은 얼마인가요?
출시 시점에는 입력 1M 토큰당 $2, 출력 1M 토큰당 $10이며, 캐시 입력은 1M당 $0.10입니다. 출시 기념 기간 이후에는 1M 토큰당 입력 $4, 출력 $20입니다[1].
Gemini 4 Argon은 무료인가요?
아니요. Google은 유료 가격만 발표했으며, 첫 개발자 접근은 유료 API 고객에게 돌아갑니다[1].
Gemini 4 Argon 출시 기념 가격은 언제까지인가요?
Google은 밝히지 않았습니다. 발표문은 출시 기념 기간이 끝나면 표준 가격이 적용된다고만 적고 있습니다[1].
Gemini 4 Argon은 GPT-6 Astra보다 저렴한가요?
정가 기준으로는 그렇습니다. Astra는 1M 토큰당 입력 $10, 출력 $50으로[2], Argon 출시 기념 가격의 5배, 표준 가격의 2.5배입니다.
Gemini 4 Argon은 Claude Opus 5.5보다 저렴한가요?
출시 기념 기간에는 절반 가격으로 저렴합니다. 그 이후에는 둘 다 1M 토큰당 입력 $4, 출력 $20입니다[1][3].
Gemini 4 Argon을 쓰려면 Google AI Ultra 구독이 필요한가요?
토큰 단위로 과금되는 API에는 필요하지 않습니다. Google AI Ultra는 Google이 첫 소비자 접근 대상으로 지목한 소비자 요금제입니다[1].
Gemini 4 Argon 요금은 어떻게 추정하나요?
입력 토큰에는 입력 요율을, 캐시 입력 토큰에는 캐시 요율을, 출력 토큰에는 출력 요율을 각각 100만 토큰당 기준으로 곱하세요. 출시 기념 기간의 종료일이 공개되지 않았으므로, 같은 숫자를 표준 가격으로도 계산해 두세요.
Gemini 4 Argon 예산 세우기
헤드라인은 사실입니다. $2와 $10이라면 Gemini 4 Argon은 Google 자체 비교표의 모든 모델보다 저렴합니다. 하지만 이는 대부분의 개발자가 아직 호출할 수 없는 모델의 프로모션 가격이고, 종료일을 공개한 사람도 없습니다. 비즈니스 케이스는 $4와 $20으로 세우세요. 그러면 Argon은 Claude Opus 5.5와 같은 수준이고 GPT-6 Astra보다는 훨씬 저렴하며, 출시 기념 기간은 추가 이익으로 계산하면 됩니다.
더 큰 가격 이야기는 출력 길이입니다. 이 비교에서 한 번의 응답으로 100만 출력 토큰을 청구할 수 있는 모델은 달리 없습니다. 그래서 Gemini 4 Argon 가격은 성능이 가장 뛰어난 지점에서 가장 저렴하고, 긴 실행을 방치했을 때 가장 비쌉니다.
참고 자료
- Google. Gemini 4 Argon: our next era of frontier intelligence. 2026년 10월 확인, 출처: blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon
- OpenAI. GPT-6 Astra model page. 2026년 10월 확인, 출처: developers.openai.com/api/docs/models/gpt-6-astra
- Anthropic. Pricing. 2026년 10월 확인, 출처: platform.claude.com/docs/en/about-claude/pricing
- Anthropic. Models overview. 2026년 10월 확인, 출처: platform.claude.com/docs/en/about-claude/models/overview
작성자

카테고리
더 많은 게시물

LLM API가 실제로 주장한 모델을 제공하는지 확인하기
언어 모델은 완전히 무작위 숫자를 선택할 수 없습니다. 이 약점은 안정적인 지문이 되어 API 엔드포인트가 주장한 모델을 실제로 제공하는지 검증할 수 있습니다.


NSFW 비디오 API 가이드: Seedream, Seedance, Wan, H3
Seedream 5.0 Pro로 성인용 키프레임을 승인한 후 Seedance, Wan, H3로 애니메이션하고 동의 확인을 추가하여 안정적인 NSFW 비디오 API 워크플로를 구축합니다.


휴대폰 카메라 모션 참조로 AI 영상 카메라 움직임을 제어하는 방법
휴대폰으로 자연스러운 카메라 움직임을 기록하고 깔끔한 모션 참조로 변환한 뒤, 3D 애니메이션을 배우지 않고 AI 영상 모델에 카메라 움직임을 지시합니다.
