Компания Z AI представила модель GLM-5.3 (max), релиз которой состоялся 18 августа 2026 года. Независимая платформа для бенчмарков Artificial Analysis провела полное тестирование модели по своей методологии, оценив интеллект, скорость, стоимость и другие параметры в сравнении с 182 моделями аналогичного класса.
Основные показатели
GLM-5.3 (max) входит в число лидирующих моделей по интеллекту и при этом умеренно оценена по цене относительно моделей аналогичного класса. Модель также работает быстрее среднего показателя, однако отличается повышенной многословностью в ответах. Поддерживается только текстовый ввод и вывод, контекстное окно составляет 1 миллион токенов.
По индексу интеллекта Artificial Analysis модель набрала 60 баллов, что заметно выше медианного значения (35) среди сопоставимых моделей. При оценке по этому индексу модель сгенерировала 170 миллионов токенов — значительно больше медианного показателя в 72 миллиона токенов, что говорит о высокой многословности ответов.
Стоимость использования GLM-5.3 (max) составляет $1.40 за 1 миллион входных токенов (умеренная цена, медиана — $1.75) и $4.40 за 1 миллион выходных токенов (также умеренно, медиана — $10.00). Полный прогон тестов индекса интеллекта обошёлся в $1238.50.
При скорости генерации 93 токена в секунду модель работает быстрее среднего показателя по рынку (75 токенов в секунду).
Технические характеристики
| Параметр | Значение |
|---|---|
| Поддержка рассуждений (reasoning) | Да |
| Входная модальность | Текст |
| Выходная модальность | Текст |
| Контекстное окно | 1 миллион токенов (~1500 страниц A4 шрифтом Arial 12) |
Методология Artificial Analysis сравнивает модели внутри однородных классов: рассуждающие модели (reasoning) сопоставляются как между собой, так и с обычными моделями; модели с открытыми весами делятся по размеру параметров (tiny, small, medium, large); проприетарные модели сравниваются в рамках одного ценового диапазона с моделями открытого доступа того же сегмента.
Индекс интеллекта
Индекс интеллекта Artificial Analysis версии 4.1.1 включает девять оценочных тестов: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience и AA-LCR. Итоговый показатель формируется как взвешенная сумма результатов по каждому из этих тестов.
Отдельно рассчитывается индекс AA-Omniscience, оценивающий надёжность знаний модели и склонность к галлюцинациям. Показатель варьируется от -100 до 100: положительные значения означают, что модель чаще даёт верные ответы, чем ошибочные, ноль — равное соотношение, а отказ от ответа не штрафуется.
Стоимость и токены
Стоимость выполнения одной задачи из индекса интеллекта рассчитывается как взвешенное среднее с учётом цен на входные, выходные, кэшированные и "размышляющие" токены. Для GLM-5.3 (max) этот показатель составляет $0.68 за задачу.
Скидка на повторное использование кэша (cache discount) у модели достигает 81% — это заметно снижает итоговую стоимость при работе с повторяющимся контекстом, например, в длинных диалогах или агентных сценариях.
Скорость и задержка
Скорость генерации токенов измеряется как количество токенов в секунду после получения первого фрагмента ответа от API. Задержка (time to first token) для GLM-5.3 (max) составляет 1.92 секунды на API Z AI — это лучше среднего показателя (2.81 секунды) среди моделей аналогичного ценового сегмента.
Сквозное время ответа (end-to-end response time) для генерации 500 токенов учитывает время до первого токена, время "размышления" модели (для reasoning-моделей) и скорость вывода.
Часто задаваемые вопросы
Когда вышла GLM-5.3 (max)?
Модель была выпущена 18 августа 2026 года.
Кто разработал GLM-5.3 (max)?
Модель создана компанией Z AI.
Насколько "умна" GLM-5.3 (max)?
Модель набирает 60 баллов по индексу интеллекта Artificial Analysis, что заметно выше среднего показателя (35) среди других reasoning-моделей в схожем ценовом сегменте.
Насколько быстро работает GLM-5.3 (max)?
Скорость генерации составляет 93.2 токена в секунду (на основе API Z AI), что выше среднего показателя (75.4 токена в секунду) среди моделей схожего ценового сегмента.
Какова задержка GLM-5.3 (max)?
Время до первого токена (TTFT) составляет 1.92 секунды (на API Z AI), что лучше среднего показателя (2.81 секунды) среди моделей схожего сегмента.
Сколько стоит использование GLM-5.3 (max)?
Стоимость составляет $1.40 за 1 миллион входных токенов (лучше среднего, медиана — $1.75) и $4.40 за 1 миллион выходных токенов (лучше среднего, медиана — $10.00), на основе API Z AI.
Какова цена API GLM-5.3 (max)?
Цена составляет $1.40 за 1M входных токенов и $4.40 за 1M выходных токенов (на основе API Z AI). При смешанном тарифе (соотношение cache hit/input/output 7:2:1) это составляет $0.90 за 1M токенов. Цены могут отличаться у разных провайдеров.
Насколько многословна GLM-5.3 (max)?
При оценке по индексу интеллекта модель сгенерировала 170 миллионов выходных токенов, что выше медианного показателя (72 миллиона) среди reasoning-моделей схожего ценового сегмента.
Является ли GLM-5.3 (max) reasoning-моделью?
Да, модель использует расширенное рассуждение (chain-of-thought) для проработки сложных задач перед выдачей ответа.
Какие входные модальности поддерживает GLM-5.3 (max)?
Модель поддерживает только текстовый ввод.
Какие выходные модальности поддерживает GLM-5.3 (max)?
Модель поддерживает только текстовый вывод.
Может ли GLM-5.3 (max) обрабатывать изображения?
Нет, модель не поддерживает ввод изображений и работает только с текстом.
Является ли GLM-5.3 (max) мультимодальной?
Нет, модель поддерживает только текстовый ввод.
Каков размер контекстного окна GLM-5.3 (max)?
Контекстное окно составляет 1 миллион токенов, что определяет объём текста и истории диалога, которые модель может обработать за один запрос.
Является ли GLM-5.3 (max) открытой моделью?
Нет, модель проприетарная, веса модели не опубликованы в открытом доступе.
Сколько параметров у GLM-5.3 (max)?
Модель насчитывает 753 миллиарда параметров.
Как GLM-5.3 (max) показывает себя в бенчмарках?
Модель набирает 60 баллов по индексу интеллекта Artificial Analysis — комплексному бенчмарку, оценивающему модели по рассуждению, знаниям, математике и программированию.
Доступна ли GLM-5.3 (max) через API?
Да, модель доступна через API у двух провайдеров.