Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 за секунду

GLM-5.2 — контекст 1M без потерь, флагман для кода с открытыми весами

GLM-5.2 — флагманская базовая модель Z.AI, созданная для эпохи долгих задач. GLM-5.2 читает контекстное окно на 1M токенов, которое Z.AI описывает как надёжное и работающее без потерь, отдаёт до 128K токенов, по умолчанию рассуждает, но позволяет мышление выключить, и предоставляет управление усилием рассуждения, которого нет ни у одной другой модели семейства GLM. На reAPI GLM-5.2 тарифицируется примерно на треть ниже опубликованной Z.AI ставки за токен — и на входе, и на выходе.

Особенности
Режим мышления · циферблат усилия рассуждения · вывод JSON
Для чего
Двуязычные задачи zh / en, агенты инструментов
Вход
Сообщения чата (совместимо с OpenAI)
Выход
Текст, потоковая передача опциональна
GLM-5.2modelglm-5.2

Песочница GLM-5.2

Чат-модели работают на шлюзе api.reapi.ai, у которого своя консоль и свой ключ. Откройте консоль, чтобы запустить GLM-5.2 через OpenAI-совместимый интерфейс Chat Completions.

Что такое GLM-5.2 API?

GLM-5.2 — флагманская базовая модель Z.AI, созданная для эпохи долгих задач и доступная на reAPI через OpenAI-совместимый эндпоинт /v1/chat/completions. Она читает контекстное окно на 1M токенов, которое Z.AI описывает как надёжное и работающее без потерь, отдаёт до 128K токенов, по умолчанию рассуждает, но позволяет мышление выключить, и остаётся единственной моделью семейства GLM, принимающей управление усилием рассуждения. Тарификация — за 1M токенов, вход и выход считаются отдельно.

Что можно создать на этой модели

Реальные рабочие процессы и production-сценарии, которые ты можешь собрать и запустить на этой модели.

GLM-5.2 строит карту архитектуры по целому репозиторию

Отдайте ему проект целиком, а не папку выдержек

Именно с этого случая Z.AI начинает, и ради него это контекстное окно и существует. На протяжении задачи GLM-5.2 держит в поле зрения границы модулей, архитектурные ограничения, контракты API, структуру каталогов и принятые ранее решения — и именно это не даёт поздней части длинной работы выглядеть так, будто её делал кто-то, не читавший начала. Формулировку Z.AI стоит привести дословно: модель не просто читает больше контекста, она переносит сформированные ранее инженерные суждения в дальнейшее выполнение. Чтобы проверить это на своей кодовой базе, сначала попросите у GLM-5.2 технический аудит — карту архитектуры, ответственности модулей, контракты API, потоки данных, цепочки вызовов, технический долг — и только потом позволяйте что-то менять.

Читать API-документацию
GLM-5.2 ведёт поэтапный рефакторинг по множеству файлов

Длинный рефакторинг, который доводится до закрытия

Z.AI описывает GLM-5.2 как более устойчивую на межфайловой, многошаговой работе с длинной цепочкой: сначала она разбирает цель, выявляет зависимости и риски, затем поэтапно реализует, проверяет и закрывает. Названные сценарии — расцепление модулей, миграция API, реорганизация каталогов, адаптация SDK и межъязыковой рефакторинг — это задачи, которые проваливаются не потому, что какая-то одна правка сложна, а потому что сороковой шаг противоречит третьему. Ограничьте задачу, скажите, что менять нельзя, и получите у GLM-5.2 план выполнения, область влияния, границы риска и способ проверки прежде, чем она начнёт правки.

GLM-5.2 запускает сборку, линтер и тесты и сообщает результаты

Инженерные правила, которые действительно держатся на длинном прогоне

Автономный агент для кода ломается не плохим кодом, а выходом за границы: лишняя зависимость, тихо изменённый контракт API, пропущенный тест, коммит, о котором никто не просил. Z.AI относит согласованность именно по этим ограничениям — стиль кода, архитектурные границы, правила зависимостей, процесс сборки, требования к тестам, границы коммитов — к улучшениям GLM-5.2, причём специально в условиях длинного контекста и множества ходов. Передайте GLM-5.2 настоящие правила линтера, команды сборки, требования к тестам и запреты, затем дайте реальную задачу и сверьте отчёт с ними.

Цены

Оплата кредитами — 1 кредит = $0.001 USD. Платишь только за успешные генерации.

Стоимость первого теста
$0.9900 credits

Одна генерация на самом дешёвом уровне (1M tokens).

Гид по бюджету тестирования
Пополнить кредиты
$10
≈ 11 тестов
$50
≈ 55 тестов
$100
≈ 111 тестов
МодельКатегорияЦена
Тарификация по токенамВход
$0.9
1M tokens
Выход
$3
1M tokens

Почему reAPI

Примерно на треть ниже опубликованной ставки

Z.AI публикует ставку за миллион токенов для входа и выхода GLM-5.2. На reAPI GLM-5.2 ниже неё по обоим направлениям примерно на треть — без подписки под этим, без минимального объёма, оплата по факту в долларах с баланса шлюза. Точные цифры — в таблице тарифов на этой странице.

OpenAI-совместимая замена «как есть»

GLM-5.2 отдаётся через стандартный эндпоинт `/v1/chat/completions`. Если ваш код уже говорит на этом формате, переход на GLM-5.2 — это base URL, ключ и строка модели: те же SDK работают, как только base URL указывает на шлюз. Ни смены SDK, ни клиента под конкретного вендора.

Один ключ на GLM, Claude, GPT и Gemini

Тот же ключ api.reapi.ai, которым вызывается GLM-5.2, вызывает и семейства Claude, GPT и Gemini. Отправлять дешёвую основную массу ходов агента в GLM-5.2 и поднимать к закрытой фронтир-модели только действительно трудные — это строка модели, а не вторая интеграция, второй счёт и второй набор учётных данных.

GLM-5.2 против Kimi K3

Эти две модели — ответ с открытыми весами на один и тот же вопрос: контекст на миллион токенов, нацеленный на долгое программирование, с опубликованными, а не удержанными весами. На reAPI GLM-5.2 заметно дешевле и снисходительнее в интеграции — мышление опционально, параметры сэмплирования по-прежнему что-то значат, а прошлое рассуждение уходит из истории, если вы не просите его сохранить. Kimi K3 отвечает модальностью и более строгим контрактом. Сначала выбирайте по форме, потом по цене.

Возможность
GLM-5.2 на reAPI
Kimi K3
Веса и позиционирование
Открытые — Z.AI сообщает о ней как о самой сильной открытой модели на бенчмарках кода и долгих задач
Открытые — первая в классе трёх триллионов параметров
Пределы контекста и вывода
Контекст 1M токенов, описан как работающий без потерь; максимум вывода 128K
Контекст 1M токенов; вывод по умолчанию ниже, но поднимается до всего окна
Мышление
Включено по умолчанию и отключается; когда включено, модель решает по каждому запросу
Всегда включено и не отключается
Управление усилием
Принимает семь значений, сворачивающихся к трём реальным поведениям, по умолчанию самое глубокое
Три настоящие ступени, тоже с самой глубокой по умолчанию
Параметры сэмплирования
temperature и top_p настраиваются оба, у temperature предел 1.0
Оба зафиксированы — отправка вернёт ошибку
Модальности на входе
Только текст — зрение это отдельная модель линейки
Текст, изображения и видео

Сравнение отражает поведение, задокументированное каждым вендором на момент написания. Ставки описаны как соотношения, а не суммы; действующие цифры по GLM-5.2 — в таблице тарифов выше.

GLM-5.2 в продакшн за три шага

  1. step 01

    Создайте аккаунт и ключ на api.reapi.ai

    Зарегистрируйтесь на api.reapi.ai, откройте консоль и сгенерируйте API-ключ. Один этот ключ достаёт до GLM-5.2 и до любой другой модели на шлюзе, а списание идёт с единого баланса.

    Открыть
  2. step 02

    Направьте клиент на шлюз

    Укажите base URL api.reapi.ai и только что созданный ключ. Любой клиент, который уже говорит на OpenAI Chat Completions, работает без изменений — менять SDK, чтобы дойти до GLM-5.2, не нужно.

    Открыть
  3. step 03

    Отправляйте `glm-5.2` в поле модели

    Поставьте в поле model значение `glm-5.2` — с точкой — и отправьте свои messages. Для длинных ответов включайте стриминг и помните, что GLM-5.2 по умолчанию думает на самой глубокой ступени усилия, поэтому определите ступень до того, как мерить стоимость.

    Открыть
docs/api/glm-5-2

Справочник API

Готовый код и полная таблица параметров.

curl https://api.reapi.ai/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "group": "default",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "max",
    "stream": true
  }'

Ошибка валидации параметров

Синхронный отказ с указанием проблемного поля. Проверьте значения enum, диапазоны и URL-поля — ничего не списывается.

Проблема с аутентификацией или балансом

401 — отсутствует или неверен Bearer-ключ; 402 — резерв превышает баланс. Ключи и кредиты — в консоли.

Контент или материал отклонён

Референсные материалы и результаты проходят автоматическую модерацию. Отклонённые задачи завершаются понятной ошибкой с полным возвратом.

Задача не выполнена или истёк таймаут

Задача в состоянии сбоя никогда не тарифицируется — резерв возвращается автоматически. Сохраните ID задачи и повторите.

Часто задаваемые вопросы

Распространённые вопросы об этой модели.

GLM-5.2 тарифицируется по факту в долларах за токен с баланса api.reapi.ai, с отдельными ставками на вход и выход и без подписки. Обе примерно на треть ниже опубликованной Z.AI ставки за токен. Актуальные цифры — в таблице тарифов на этой странице.

start building

Готов к запуску?

Попробуй в playground или получи API-ключ для интеграции прямо сейчас.