
DeepSeek
DeepSeek V4
Desde $0.140 por 1M tokens
GLM-5.2 es el modelo fundacional insignia de Z.AI, construido para la era de las tareas de horizonte largo. GLM-5.2 lee una ventana de contexto de 1M tokens que Z.AI describe como sólida y sin pérdida, devuelve hasta 128K tokens, piensa por defecto pero permite apagar el pensamiento, y expone un control de esfuerzo de razonamiento que ningún otro modelo de la familia GLM acepta. En reAPI, GLM-5.2 se factura alrededor de un tercio por debajo de la tarifa por token publicada por Z.AI, tanto en entrada como en salida.
glm-5.2Los modelos de chat se ejecutan en la pasarela api.reapi.ai, que tiene su propia consola y su propia clave. Abre la consola para ejecutar GLM-5.2 a través de la interfaz Chat Completions compatible con OpenAI.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Este es el caso con el que abre Z.AI, y la razón por la que existe esta ventana de contexto. A lo largo de una tarea, GLM-5.2 mantiene a la vista los límites de módulos, las restricciones de arquitectura, los contratos de API, la estructura de directorios y las decisiones tomadas antes — y eso es precisamente lo que evita que el tramo final de un trabajo largo parezca hecho por alguien que nunca leyó el principio. La formulación de Z.AI merece cita: el modelo no solo lee más contexto, traslada a la ejecución posterior los juicios de ingeniería que formó antes. Para comprobarlo en tu propio código, pide primero a GLM-5.2 una auditoría técnica — mapa de arquitectura, responsabilidades de módulos, contratos de API, flujos de datos, cadenas de llamada, deuda técnica — antes de dejarle cambiar nada.
Leer la documentación de la API
Z.AI describe a GLM-5.2 como más estable en trabajo entre archivos, de varios pasos y cadena larga: primero descompone el objetivo, identifica dependencias y riesgos, y luego implementa, verifica y cierra por etapas. Los casos que nombra son desacoplar módulos, migrar APIs, reestructurar directorios, adaptar SDK y refactorizar entre lenguajes — trabajos que fallan no porque una modificación concreta sea difícil, sino porque el paso cuarenta contradice al paso tres. Acota la tarea, di qué no debe cambiar y pide a GLM-5.2 el plan de ejecución, el alcance del impacto, los límites de riesgo y el método de verificación antes de que edite.

El modo de fallo de un agente de código autónomo no es el código malo, es la fuga de alcance: una dependencia extra, un contrato de API cambiado en silencio, una prueba omitida, un commit que nadie pidió. Z.AI sitúa la consistencia en exactamente estas restricciones — estilo de código, límites arquitectónicos, reglas de dependencias, proceso de build, requisitos de pruebas, límites de commit — entre las mejoras de GLM-5.2, y específicamente bajo contexto largo y muchas rondas. Da a GLM-5.2 tus reglas de lint reales, comandos de build, requisitos de pruebas y prohibiciones, luego una tarea real, y contrasta su informe con todo eso.
Basado en créditos: 1 crédito = 0,001 USD. Solo pagas por las generaciones completadas.
| Categoría | Unidad | Precio |
|---|---|---|
| Facturación por tokens | ||
| Entrada | 1M tokens | $0.9 |
| Salida | 1M tokens | $3 |
Z.AI publica una tarifa por millón de tokens para la entrada y la salida de GLM-5.2. En reAPI, GLM-5.2 queda alrededor de un tercio por debajo en ambas: sin suscripción por debajo, sin compromiso mínimo, pago por uso en USD contra el saldo de tu pasarela. Las cifras exactas están en la tabla de precios de esta página.
GLM-5.2 se sirve desde un endpoint `/v1/chat/completions` estándar. Si tu código ya habla ese formato, adoptar GLM-5.2 es una base URL, una clave y una cadena de modelo: los mismos SDK funcionan en cuanto la base URL apunta a la pasarela. Sin cambiar de SDK y sin cliente propio del proveedor.
La misma clave de api.reapi.ai que llama a GLM-5.2 llama también a las familias Claude, GPT y Gemini. Mandar a GLM-5.2 el grueso barato de los turnos de un agente y escalar solo los difíciles a un modelo de frontera cerrado es una cadena de modelo, no una segunda integración, una segunda factura y un segundo juego de credenciales.
Estos dos son la respuesta de pesos abiertos a la misma pregunta: un contexto de un millón de tokens orientado a programación de horizonte largo, con los pesos publicados en lugar de retenidos. En reAPI GLM-5.2 es con diferencia el más barato de la pareja y el más indulgente de integrar — el pensamiento es opcional, los parámetros de muestreo siguen haciendo algo, y el razonamiento anterior sale del historial salvo que pidas conservarlo. Kimi K3 responde con modalidad y un contrato más estricto. Elige por forma y después por precio.
La comparación refleja el comportamiento documentado por cada proveedor en el momento de escribir. Las tarifas se describen como relaciones y no como importes; las cifras vigentes de GLM-5.2 están en la tabla de precios de arriba.
Regístrate en api.reapi.ai, abre la consola y genera una API key. Esa única clave llega a GLM-5.2 y a todos los demás modelos de la pasarela, facturados desde un único saldo.
AbrirPon tu base URL en api.reapi.ai y tu clave en la que acabas de crear. Cualquier cliente que ya hable OpenAI Chat Completions funciona sin cambios: no hace falta cambiar de SDK para llegar a GLM-5.2.
AbrirPon el campo model en `glm-5.2` — con el punto — y envía tus messages. Activa el streaming para salidas largas y recuerda que GLM-5.2 piensa por defecto en el ajuste de esfuerzo más profundo, así que fija el nivel antes de medir coste.
AbrirDudas comunes sobre este modelo.
Explora más modelos de la misma categoría.

DeepSeek
Desde $0.140 por 1M tokens

MiniMax
Desde $0.600 por 1M tokens

OpenAI
Desde $0.800 por 1M tokens

OpenAI
Desde $1.00 por 1M tokens
Pruébalo en el playground o consigue una API key para integrarlo ahora.