
DeepSeek
DeepSeek V4
От $0.140 за 1M токенов
GLM-5.2 — флагманская базовая модель Z.AI, созданная для эпохи долгих задач. GLM-5.2 читает контекстное окно на 1M токенов, которое Z.AI описывает как надёжное и работающее без потерь, отдаёт до 128K токенов, по умолчанию рассуждает, но позволяет мышление выключить, и предоставляет управление усилием рассуждения, которого нет ни у одной другой модели семейства GLM. На reAPI GLM-5.2 тарифицируется примерно на треть ниже опубликованной Z.AI ставки за токен — и на входе, и на выходе.
glm-5.2Чат-модели работают на шлюзе api.reapi.ai, у которого своя консоль и свой ключ. Откройте консоль, чтобы запустить GLM-5.2 через OpenAI-совместимый интерфейс Chat Completions.
Реальные рабочие процессы и production-сценарии, которые ты можешь собрать и запустить на этой модели.

Именно с этого случая Z.AI начинает, и ради него это контекстное окно и существует. На протяжении задачи GLM-5.2 держит в поле зрения границы модулей, архитектурные ограничения, контракты API, структуру каталогов и принятые ранее решения — и именно это не даёт поздней части длинной работы выглядеть так, будто её делал кто-то, не читавший начала. Формулировку Z.AI стоит привести дословно: модель не просто читает больше контекста, она переносит сформированные ранее инженерные суждения в дальнейшее выполнение. Чтобы проверить это на своей кодовой базе, сначала попросите у GLM-5.2 технический аудит — карту архитектуры, ответственности модулей, контракты API, потоки данных, цепочки вызовов, технический долг — и только потом позволяйте что-то менять.
Читать API-документацию
Z.AI описывает GLM-5.2 как более устойчивую на межфайловой, многошаговой работе с длинной цепочкой: сначала она разбирает цель, выявляет зависимости и риски, затем поэтапно реализует, проверяет и закрывает. Названные сценарии — расцепление модулей, миграция API, реорганизация каталогов, адаптация SDK и межъязыковой рефакторинг — это задачи, которые проваливаются не потому, что какая-то одна правка сложна, а потому что сороковой шаг противоречит третьему. Ограничьте задачу, скажите, что менять нельзя, и получите у GLM-5.2 план выполнения, область влияния, границы риска и способ проверки прежде, чем она начнёт правки.

Автономный агент для кода ломается не плохим кодом, а выходом за границы: лишняя зависимость, тихо изменённый контракт API, пропущенный тест, коммит, о котором никто не просил. Z.AI относит согласованность именно по этим ограничениям — стиль кода, архитектурные границы, правила зависимостей, процесс сборки, требования к тестам, границы коммитов — к улучшениям GLM-5.2, причём специально в условиях длинного контекста и множества ходов. Передайте GLM-5.2 настоящие правила линтера, команды сборки, требования к тестам и запреты, затем дайте реальную задачу и сверьте отчёт с ними.
Оплата кредитами — 1 кредит = $0.001 USD. Платишь только за успешные генерации.
| Категория | Единица | Цена |
|---|---|---|
| Тарификация по токенам | ||
| Вход | 1M tokens | $0.9 |
| Выход | 1M tokens | $3 |
Z.AI публикует ставку за миллион токенов для входа и выхода GLM-5.2. На reAPI GLM-5.2 ниже неё по обоим направлениям примерно на треть — без подписки под этим, без минимального объёма, оплата по факту в долларах с баланса шлюза. Точные цифры — в таблице тарифов на этой странице.
GLM-5.2 отдаётся через стандартный эндпоинт `/v1/chat/completions`. Если ваш код уже говорит на этом формате, переход на GLM-5.2 — это base URL, ключ и строка модели: те же SDK работают, как только base URL указывает на шлюз. Ни смены SDK, ни клиента под конкретного вендора.
Тот же ключ api.reapi.ai, которым вызывается GLM-5.2, вызывает и семейства Claude, GPT и Gemini. Отправлять дешёвую основную массу ходов агента в GLM-5.2 и поднимать к закрытой фронтир-модели только действительно трудные — это строка модели, а не вторая интеграция, второй счёт и второй набор учётных данных.
Эти две модели — ответ с открытыми весами на один и тот же вопрос: контекст на миллион токенов, нацеленный на долгое программирование, с опубликованными, а не удержанными весами. На reAPI GLM-5.2 заметно дешевле и снисходительнее в интеграции — мышление опционально, параметры сэмплирования по-прежнему что-то значат, а прошлое рассуждение уходит из истории, если вы не просите его сохранить. Kimi K3 отвечает модальностью и более строгим контрактом. Сначала выбирайте по форме, потом по цене.
Сравнение отражает поведение, задокументированное каждым вендором на момент написания. Ставки описаны как соотношения, а не суммы; действующие цифры по GLM-5.2 — в таблице тарифов выше.
Зарегистрируйтесь на api.reapi.ai, откройте консоль и сгенерируйте API-ключ. Один этот ключ достаёт до GLM-5.2 и до любой другой модели на шлюзе, а списание идёт с единого баланса.
ОткрытьУкажите base URL api.reapi.ai и только что созданный ключ. Любой клиент, который уже говорит на OpenAI Chat Completions, работает без изменений — менять SDK, чтобы дойти до GLM-5.2, не нужно.
ОткрытьПоставьте в поле model значение `glm-5.2` — с точкой — и отправьте свои messages. Для длинных ответов включайте стриминг и помните, что GLM-5.2 по умолчанию думает на самой глубокой ступени усилия, поэтому определите ступень до того, как мерить стоимость.
ОткрытьРаспространённые вопросы об этой модели.
Попробуй в playground или получи API-ключ для интеграции прямо сейчас.