
OpenAI
GPT-5.4
시작가 $1.00 1M 토큰당
Gemini 3.6 Flash는 Google의 최신 Stable 등급 Gemini 3 모델로, 에이전트 작업과 멀티모달 작업에서 속도와 지능의 균형을 맞추도록 설계됐습니다. Gemini 3.6 Flash는 텍스트·이미지·동영상·오디오·PDF를 1,048,576 토큰 컨텍스트 창에 함께 읽어들이고 최대 65,536 토큰을 돌려주며, 사고·함수 호출·Google 검색 그라운딩을 모두 지원합니다. reAPI에서는 Gemini 3.6 Flash의 입력과 출력 단가가 Google이 공개한 Standard 요율보다 20% 낮습니다.
이 모델로 구축하고 배포할 수 있는 실제 워크플로우와 프로덕션 활용 사례입니다.

PDF는 Gemini 3.6 Flash의 일급 입력이며 직접 관리해야 하는 전처리 단계가 아닙니다. 1,048,576 토큰 컨텍스트 창과 함께라면 계약서 묶음, 연구 자료, 1년치 보고서를 한 번의 호출에 넣고 상호 참조된 결과를 받을 수 있습니다. Gemini 3.6 Flash는 같은 메시지에 이미지·동영상·오디오도 받으므로 문서 검토에 첨부된 스크린샷과 녹음을 포함할 수 있습니다. 실질적인 이득은 작은 컨텍스트를 우회하려고만 존재했던 검색 계층을 더 이상 유지하지 않아도 된다는 점입니다.
API 문서 읽기
Gemini 3.6 Flash는 함수 호출·코드 실행·파일 검색을 지원하며, Google은 computer use를 프리뷰 지원으로 표기합니다. 검색 그라운딩과 Google 지도 그라운딩이 모두 지원되므로 Gemini 3.6 Flash는 학습 데이터만이 아니라 현재 출처를 근거로 답할 수 있고, URL context로 특정 페이지를 직접 지정할 수도 있습니다. 사고도 지원되며, 이것이 도구 호출 사이에 여러 단계 계획을 이어가게 하는 요소입니다. 이 조합 덕분에 Gemini 3.6 Flash는 단순한 텍스트 생성기가 아니라 에이전트의 추론 코어로 쓸 수 있습니다.

대부분의 생성 워크로드에서 비용은 출력 토큰이 지배하며, 사고 토큰은 출력으로 계산됩니다. Gemini 3.6 Flash는 입력 단가가 동일한 상태에서 공개된 출력 단가가 Gemini 3.5 Flash보다 낮고, reAPI에서는 두 항목 모두 Google이 공개한 Standard 요율보다 20% 낮습니다. 하루 종일 돌아가는 요약 클러스터, 분류 파이프라인, 에이전트 루프에서는 이것이 월 청구액을 움직이는 숫자입니다. 그러면서도 Gemini 3.6 Flash는 같은 100만 토큰 창을 유지하므로, 저렴하다는 것이 작아진다는 뜻은 아닙니다.
크레딧 기반 — 1 크레딧 = 0.001 USD. 성공한 생성에 대해서만 비용을 지불합니다.
| 카테고리 | 단위 | 가격 |
|---|---|---|
| 토큰 과금 | ||
| 입력 | 1M tokens | $1.2 |
| 출력 | 1M tokens | $6 |
Google은 Gemini 3.6 Flash의 Standard 입력·출력 요율을 공개합니다. reAPI에서 Gemini 3.6 Flash는 그 80%로 과금되어 입력과 출력 모두 일괄 20% 할인이며, 아래에 깔린 구독도 최소 약정도 없습니다. 게이트웨이 잔액에서 미국 달러로 사용량만큼 차감됩니다.
Gemini 3.6 Flash는 OpenAI 호환 `/v1/chat/completions` 엔드포인트로 제공됩니다. 코드가 이미 그 형태를 사용한다면 Gemini 3.6 Flash 도입은 베이스 URL, 키, 모델 문자열 교체로 끝납니다. Google 자체 요청 형식을 선호한다면 게이트웨이가 이 모델에 대해 네이티브 Gemini 엔드포인트 종류도 함께 제공합니다.
Gemini 3.6 Flash를 호출하는 그 api.reapi.ai 키로 GPT와 Claude 계열도 호출합니다. 품질 비교를 위한 모델 교체나 특정 공급자 상태가 나쁠 때의 우회는 모델 문자열 변경으로 끝나며, 두 번째 통합·두 번째 청구서·두 번째 자격 증명이 필요하지 않습니다.
이 비교의 정직한 결론은 짧습니다. Google이 공개하는 모든 항목에서 Gemini 3.6 Flash와 Gemini 3.5 Flash는 같은 표면을 가집니다. 상한도, 입력도, 기능 목록도, 소비 옵션도 같습니다. Gemini 3.6 Flash는 기능 향상이 아니라 가격과 포지셔닝의 변화입니다. 따라서 둘 중에서 고른다면 실제 판단 근거는 출력 요율과 최신성입니다.
이 비교는 작성 시점에 Google 자체 모델 페이지와 요금 페이지에 명시된 동작을 반영합니다. 요율은 금액이 아니라 관계로 서술했으며, Gemini 3.6 Flash의 실시간 숫자는 위 요금 표에 있습니다.
api.reapi.ai에 가입해 콘솔에서 API 키를 생성하세요. 그 하나의 키로 Gemini 3.6 Flash와 게이트웨이의 다른 모델에 도달하며, 단일 잔액에서 과금됩니다.
열기베이스 URL을 api.reapi.ai로, 키를 방금 만든 것으로 설정하세요. OpenAI Chat Completions를 쓰는 클라이언트라면 그대로 동작하며, Gemini 3.6 Flash에 도달하려고 SDK를 바꿀 필요가 없습니다.
열기model 필드를 `gemini-3.6-flash`로 두고 messages를 보내세요. 대화형이라면 스트리밍을 켜고, Gemini 3.6 Flash가 65,536 토큰 출력 상한을 더 쓰게 하려면 max tokens를 올리세요.
열기이 모델에 대한 일반적인 질문입니다.