Компания Z AI представила модель GLM-5.3 (max), релиз которой состоялся 18 августа 2026 года. Независимая платформа для бенчмарков Artificial Analysis провела полное тестирование модели по своей методологии, оценив интеллект, скорость, стоимость и другие параметры в сравнении с 182 моделями аналогичного класса.

Основные показатели

GLM-5.3 (max) входит в число лидирующих моделей по интеллекту и при этом умеренно оценена по цене относительно моделей аналогичного класса. Модель также работает быстрее среднего показателя, однако отличается повышенной многословностью в ответах. Поддерживается только текстовый ввод и вывод, контекстное окно составляет 1 миллион токенов.

По индексу интеллекта Artificial Analysis модель набрала 60 баллов, что заметно выше медианного значения (35) среди сопоставимых моделей. При оценке по этому индексу модель сгенерировала 170 миллионов токенов — значительно больше медианного показателя в 72 миллиона токенов, что говорит о высокой многословности ответов.

Стоимость использования GLM-5.3 (max) составляет $1.40 за 1 миллион входных токенов (умеренная цена, медиана — $1.75) и $4.40 за 1 миллион выходных токенов (также умеренно, медиана — $10.00). Полный прогон тестов индекса интеллекта обошёлся в $1238.50.

При скорости генерации 93 токена в секунду модель работает быстрее среднего показателя по рынку (75 токенов в секунду).

Технические характеристики

ПараметрЗначение
Поддержка рассуждений (reasoning)Да
Входная модальностьТекст
Выходная модальностьТекст
Контекстное окно1 миллион токенов (~1500 страниц A4 шрифтом Arial 12)

Методология Artificial Analysis сравнивает модели внутри однородных классов: рассуждающие модели (reasoning) сопоставляются как между собой, так и с обычными моделями; модели с открытыми весами делятся по размеру параметров (tiny, small, medium, large); проприетарные модели сравниваются в рамках одного ценового диапазона с моделями открытого доступа того же сегмента.

Индекс интеллекта

Индекс интеллекта Artificial Analysis версии 4.1.1 включает девять оценочных тестов: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience и AA-LCR. Итоговый показатель формируется как взвешенная сумма результатов по каждому из этих тестов.

Отдельно рассчитывается индекс AA-Omniscience, оценивающий надёжность знаний модели и склонность к галлюцинациям. Показатель варьируется от -100 до 100: положительные значения означают, что модель чаще даёт верные ответы, чем ошибочные, ноль — равное соотношение, а отказ от ответа не штрафуется.

Стоимость и токены

Стоимость выполнения одной задачи из индекса интеллекта рассчитывается как взвешенное среднее с учётом цен на входные, выходные, кэшированные и "размышляющие" токены. Для GLM-5.3 (max) этот показатель составляет $0.68 за задачу.

Скидка на повторное использование кэша (cache discount) у модели достигает 81% — это заметно снижает итоговую стоимость при работе с повторяющимся контекстом, например, в длинных диалогах или агентных сценариях.

Скорость и задержка

Скорость генерации токенов измеряется как количество токенов в секунду после получения первого фрагмента ответа от API. Задержка (time to first token) для GLM-5.3 (max) составляет 1.92 секунды на API Z AI — это лучше среднего показателя (2.81 секунды) среди моделей аналогичного ценового сегмента.

Сквозное время ответа (end-to-end response time) для генерации 500 токенов учитывает время до первого токена, время "размышления" модели (для reasoning-моделей) и скорость вывода.

Часто задаваемые вопросы

Когда вышла GLM-5.3 (max)?

Модель была выпущена 18 августа 2026 года.

Кто разработал GLM-5.3 (max)?

Модель создана компанией Z AI.

Насколько "умна" GLM-5.3 (max)?

Модель набирает 60 баллов по индексу интеллекта Artificial Analysis, что заметно выше среднего показателя (35) среди других reasoning-моделей в схожем ценовом сегменте.

Насколько быстро работает GLM-5.3 (max)?

Скорость генерации составляет 93.2 токена в секунду (на основе API Z AI), что выше среднего показателя (75.4 токена в секунду) среди моделей схожего ценового сегмента.

Какова задержка GLM-5.3 (max)?

Время до первого токена (TTFT) составляет 1.92 секунды (на API Z AI), что лучше среднего показателя (2.81 секунды) среди моделей схожего сегмента.

Сколько стоит использование GLM-5.3 (max)?

Стоимость составляет $1.40 за 1 миллион входных токенов (лучше среднего, медиана — $1.75) и $4.40 за 1 миллион выходных токенов (лучше среднего, медиана — $10.00), на основе API Z AI.

Какова цена API GLM-5.3 (max)?

Цена составляет $1.40 за 1M входных токенов и $4.40 за 1M выходных токенов (на основе API Z AI). При смешанном тарифе (соотношение cache hit/input/output 7:2:1) это составляет $0.90 за 1M токенов. Цены могут отличаться у разных провайдеров.

Насколько многословна GLM-5.3 (max)?

При оценке по индексу интеллекта модель сгенерировала 170 миллионов выходных токенов, что выше медианного показателя (72 миллиона) среди reasoning-моделей схожего ценового сегмента.

Является ли GLM-5.3 (max) reasoning-моделью?

Да, модель использует расширенное рассуждение (chain-of-thought) для проработки сложных задач перед выдачей ответа.

Какие входные модальности поддерживает GLM-5.3 (max)?

Модель поддерживает только текстовый ввод.

Какие выходные модальности поддерживает GLM-5.3 (max)?

Модель поддерживает только текстовый вывод.

Может ли GLM-5.3 (max) обрабатывать изображения?

Нет, модель не поддерживает ввод изображений и работает только с текстом.

Является ли GLM-5.3 (max) мультимодальной?

Нет, модель поддерживает только текстовый ввод.

Каков размер контекстного окна GLM-5.3 (max)?

Контекстное окно составляет 1 миллион токенов, что определяет объём текста и истории диалога, которые модель может обработать за один запрос.

Является ли GLM-5.3 (max) открытой моделью?

Нет, модель проприетарная, веса модели не опубликованы в открытом доступе.

Сколько параметров у GLM-5.3 (max)?

Модель насчитывает 753 миллиарда параметров.

Как GLM-5.3 (max) показывает себя в бенчмарках?

Модель набирает 60 баллов по индексу интеллекта Artificial Analysis — комплексному бенчмарку, оценивающему модели по рассуждению, знаниям, математике и программированию.

Доступна ли GLM-5.3 (max) через API?

Да, модель доступна через API у двух провайдеров.