Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 초당

GLM-5.2 — 1M 무손실 컨텍스트, 오픈 웨이트 코딩 플래그십

GLM-5.2는 장기 호흡 작업의 시대를 위해 만들어진 Z.AI의 플래그십 기반 모델입니다. GLM-5.2는 Z.AI가 견고하고 무손실이라고 표현하는 1M 토큰 컨텍스트 윈도를 읽고, 최대 128K 토큰을 되돌려 쓰며, 기본으로 사고하면서도 사고를 끌 수 있고, GLM 계열의 다른 모델에는 없는 추론 노력 제어를 제공합니다. reAPI에서 GLM-5.2는 입력과 출력 모두 Z.AI 공개 단가보다 약 3분의 1 낮게 과금됩니다.

모델 특징
사고 모드 · 추론 노력 다이얼 · JSON 출력
적합한 용도
이중언어 zh / en 작업, 도구 에이전트
입력
Chat 메시지 (OpenAI 호환)
출력
텍스트, 선택적 스트리밍
GLM-5.2modelglm-5.2

GLM-5.2 플레이그라운드

채팅 모델은 api.reapi.ai 게이트웨이에서 실행되며 자체 콘솔과 자체 키를 가집니다. 콘솔을 열면 OpenAI 호환 Chat Completions 표면으로 GLM-5.2을 실행할 수 있습니다.

GLM-5.2 API란?

GLM-5.2는 장기 호흡 작업의 시대를 위해 만들어진 Z.AI의 플래그십 기반 모델로, reAPI에서는 OpenAI 호환 /v1/chat/completions 엔드포인트로 제공됩니다. Z.AI가 견고하고 무손실이라고 표현하는 1M 토큰 컨텍스트 윈도를 읽고 최대 128K 토큰을 되돌려 쓰며, 기본으로 사고하면서도 사고를 끌 수 있고, GLM 계열에서 유일하게 추론 노력 제어를 받아들이는 모델입니다. 과금은 1M 토큰당이며 입력과 출력이 각각 책정됩니다.

이 모델로 만들 수 있는 것

이 모델로 구축하고 배포할 수 있는 실제 워크플로우와 프로덕션 활용 사례입니다.

리포지토리 전체에서 아키텍처 맵을 만들어 내는 GLM-5.2

발췌 모음이 아니라 프로젝트 전체를 넘기기

Z.AI가 가장 먼저 내세우는 사례이고, 이 컨텍스트 윈도가 존재하는 이유입니다. GLM-5.2는 작업이 이어지는 동안 모듈 경계, 아키텍처 제약, API 계약, 디렉터리 구조, 앞서 내린 결정을 계속 시야에 둡니다. 긴 작업의 후반부가 마치 도입부를 읽지 않은 사람의 손길처럼 보이는 일을 막는 것이 바로 이것입니다. Z.AI의 표현은 그대로 인용할 만합니다. 모델이 단지 더 많은 컨텍스트를 읽는 것이 아니라, 초반에 형성한 엔지니어링 판단을 이후 실행으로 가져간다는 것입니다. 자기 코드베이스에서 확인하려면 무엇이든 바꾸게 하기 전에 GLM-5.2에 기술 감사를 먼저 요청하세요 — 아키텍처 맵, 모듈 책임, API 계약, 데이터 흐름, 호출 체인, 기술 부채입니다.

API 문서 읽기
여러 파일에 걸친 단계적 리팩터를 진행하는 GLM-5.2

제대로 마무리되는 장기 호흡 리팩터링

Z.AI는 GLM-5.2가 파일을 넘나드는 다단계 장기 작업에서 더 안정적이라고 설명합니다. 먼저 목표를 쪼개고 의존성과 위험을 파악한 뒤 단계별로 구현하고 검증하고 닫습니다. 문서가 지목한 적합 사례는 모듈 분리, API 마이그레이션, 디렉터리 재구성, SDK 적응, 언어를 넘나드는 리팩터링입니다 — 어느 하나의 수정이 어려워서 실패하는 게 아니라 마흔 번째 단계가 세 번째 단계와 모순되어 실패하는 종류의 일들이죠. 작업 경계를 정하고 무엇이 바뀌면 안 되는지 밝힌 다음, 편집을 시작하기 전에 GLM-5.2에게 실행 계획과 영향 범위, 위험 경계, 검증 방법을 받아 두세요.

build와 lint, 테스트를 돌리고 결과를 보고하는 GLM-5.2

오래 돌려도 실제로 지켜지는 엔지니어링 규약

자율 코딩 에이전트의 실패 방식은 나쁜 코드가 아니라 범위 이탈입니다. 의존성 하나 더, 조용히 바뀐 API 계약, 건너뛴 테스트, 요청하지 않은 커밋. Z.AI는 GLM-5.2의 개선점으로 바로 이 제약들 — 코드 스타일, 아키텍처 경계, 의존성 규칙, 빌드 절차, 테스트 요구사항, 커밋 경계 — 에서의 일관성을 들며, 특히 긴 컨텍스트와 여러 라운드 조건에서라고 명시합니다. 실제 lint 규칙과 빌드 명령, 테스트 요구사항, 금지 사항을 GLM-5.2에 넘기고 진짜 작업을 준 다음, 보고 내용을 그것들과 맞춰 보세요.

가격

크레딧 기반 — 1 크레딧 = 0.001 USD. 성공한 생성에 대해서만 비용을 지불합니다.

첫 테스트 비용
$0.9900 credits

최저 등급 1회 생성(1M tokens).

테스트 예산 가이드
크레딧 충전
$10
약 11회 테스트
$50
약 55회 테스트
$100
약 111회 테스트
모델카테고리가격
토큰 과금입력
$0.9
1M tokens
출력
$3
1M tokens

reApi를 선택해야 하는 이유

공개 단가보다 약 3분의 1 낮게

Z.AI는 GLM-5.2의 입력과 출력에 대해 100만 토큰당 단가를 공개합니다. reAPI에서 GLM-5.2는 둘 다 그보다 약 3분의 1 낮습니다. 아래에 깔린 구독도 없고 최소 약정도 없으며, 게이트웨이 잔액에서 USD로 사용한 만큼 결제됩니다. 정확한 수치는 이 페이지의 가격표에 있습니다.

OpenAI 호환, 그대로 교체

GLM-5.2는 표준 `/v1/chat/completions` 엔드포인트로 제공됩니다. 코드가 이미 그 형식을 말하고 있다면 GLM-5.2 도입은 base URL과 키, model 문자열의 문제입니다. base URL을 게이트웨이로 돌리면 같은 SDK가 그대로 동작합니다. SDK 교체도, 벤더 전용 클라이언트도 필요 없습니다.

GLM, Claude, GPT, Gemini를 키 하나로

GLM-5.2를 호출하는 그 api.reapi.ai 키로 Claude와 GPT, Gemini 계열도 호출합니다. 에이전트에서 저렴한 대다수 턴은 GLM-5.2로 보내고 정말 어려운 것만 닫힌 프런티어 모델로 올리는 일이 model 문자열 변경으로 끝나며, 두 번째 통합과 두 번째 청구서, 두 번째 자격 증명 세트가 필요하지 않습니다.

GLM-5.2 대 Kimi K3

이 둘은 같은 질문에 대한 오픈 웨이트의 대답입니다. 100만 토큰 컨텍스트, 장기 호흡 코딩 지향, 그리고 가중치를 감추지 않고 공개하는 것. reAPI에서는 GLM-5.2가 큰 차이로 더 저렴하고 통합도 더 관대합니다 — 사고는 선택이고 샘플링 파라미터는 실제로 작동하며 이전 추론은 보존을 요청하지 않으면 기록에서 빠집니다. Kimi K3가 내놓는 답은 모달리티와 더 엄격한 계약입니다. 형태로 먼저 고르고, 그다음에 가격을 보세요.

역량
reAPI의 GLM-5.2
Kimi K3
가중치와 포지셔닝
공개 — Z.AI는 코딩과 장기 호흡 과제 벤치마크에서 가장 강한 오픈소스 모델로 보고
공개 — 3조 파라미터 급의 첫 모델
컨텍스트와 출력 한도
무손실이라고 표현되는 1M 토큰 컨텍스트. 최대 출력 128K
1M 토큰 컨텍스트. 출력 기본값은 더 낮지만 윈도 전체까지 올릴 수 있음
사고
기본으로 켜져 있고 끌 수 있음. 켜져 있을 때는 요청마다 모델이 생각할지 판단
항상 켜져 있고 끌 수 없음
노력 제어
일곱 개 값을 받지만 실제 동작은 세 가지로 수렴하고 기본값은 가장 깊은 단계
진짜 세 단계이고 기본값도 가장 깊은 단계
샘플링 파라미터
temperature와 top_p 모두 조정 가능. temperature 상한은 1.0
둘 다 고정 — 보내면 오류
입력 모달리티
텍스트 전용 — 비전은 라인업의 별도 모델
텍스트, 이미지, 영상

비교는 작성 시점에 각 벤더가 스스로 문서화한 동작을 반영합니다. 단가는 금액이 아니라 관계로 서술했으며, GLM-5.2의 실제 수치는 위 가격표에 있습니다.

세 단계로 GLM-5.2 출시

  1. step 01

    api.reapi.ai에서 계정과 키 만들기

    api.reapi.ai에서 가입하고 콘솔을 열어 API 키를 생성합니다. 이 키 하나로 GLM-5.2와 게이트웨이의 다른 모든 모델에 도달하며, 과금은 단일 잔액에서 이루어집니다.

    열기
  2. step 02

    클라이언트를 게이트웨이로 돌리기

    base URL을 api.reapi.ai로, 키를 방금 만든 것으로 설정합니다. 이미 OpenAI Chat Completions를 말하는 클라이언트는 수정 없이 동작하며, GLM-5.2에 도달하기 위해 SDK를 바꿀 필요는 없습니다.

    열기
  3. step 03

    model로 `glm-5.2` 보내기

    model 필드를 `glm-5.2` — 점을 포함해서 — 로 설정하고 messages를 POST하세요. 긴 출력에는 스트리밍을 켜고, GLM-5.2는 기본적으로 가장 깊은 노력 단계에서 생각한다는 점을 감안해 비용을 재기 전에 노력 단계를 정해 두세요.

    열기
docs/api/glm-5-2

API 레퍼런스

바로 사용 가능한 코드와 전체 파라미터 표입니다.

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "max",
    "stream": true
  }'

파라미터 검증 실패

제출 시 동기적으로 거부되며 문제 필드가 명시됩니다. 열거 값·범위·URL 필드를 확인하세요. 과금은 발생하지 않습니다.

인증 또는 잔액 문제

401은 Bearer 키 누락/무효, 402는 선차감액이 잔액을 초과함을 뜻합니다. 키와 크레딧은 콘솔에서 관리합니다.

콘텐츠 또는 소재 거부

참조 소재와 생성 결과는 자동 심사를 거칩니다. 거부된 작업은 명확한 오류와 함께 실패하고 전액 환불됩니다.

작업 실패 또는 시간 초과

실패 상태에 도달한 작업은 과금되지 않으며 선차감액이 자동 환불됩니다. 작업 ID를 보관했다가 재시도하세요.

자주 묻는 질문

이 모델에 대한 일반적인 질문입니다.

GLM-5.2는 api.reapi.ai 잔액에서 토큰 단위로 USD 사용량 과금되며, 입력과 출력 단가가 따로 있고 구독은 없습니다. 둘 다 Z.AI 공개 단가보다 약 3분의 1 낮습니다. 현재 수치는 이 페이지의 가격표에 있습니다.

start building

이제 출시할 준비가 되셨나요?

Playground에서 시험해 보거나 API 키를 발급받아 바로 연동해 보세요.