К содержанию
Выпуск №72 · 19 августа 2026 / Новости

GLM-5.3 снижает цену сильного API, но миллион входных токенов за $1,40 еще не означает дешевый результат

Z.ai вывела GLM-5.3 в API по цене GLM-5.2, хотя новая модель показывает более высокие результаты в независимых тестах. Для бизнеса это повод пересчитать маршрутизацию сейчас, но сравнивать нужно стоимость успешно выполненной задачи, а не прайс за миллион токенов.

Редакция 19 августа 2026 г., 17:20 MSK

В Telegram

GLM-5.3 уже можно подключать к продуктам и агентам за $1,40 за миллион входных и $4,40 за миллион выходных токенов. Это достаточно низкая цена, чтобы отправить модель в eval против текущего провайдера, но недостаточно низкая, чтобы переносить на нее нагрузку по одному взгляду на тариф.

Главная ловушка здесь знакомая: API продает токены, а бизнес покупает выполненную задачу. И эти две единицы учета могут расходиться весьма заметно.

Что вышло в API

Как пишет VentureBeat, Z.ai сохранила для GLM-5.3 тариф предыдущего поколения: $1,40 за миллион входных токенов и $4,40 за миллион выходных. Кэшированный ввод стоит $0,26 за миллион токенов, хранение кэша пока указано как бесплатное на ограниченный срок.

Для простой иллюстрации VentureBeat складывает миллион входных и миллион выходных токенов. GLM-5.3 в таком расчете стоит $5,80 против $8 у Grok 4.6 на тарифе для контекста менее 200 тысяч токенов, $18 у Kimi K3, $30 у Claude Opus 5 и $35 у GPT-5.6 Sol в Standard mode.

Но GLM-5.3 не самый дешевый вариант в таблице. GPT-5.6 Luna стоит $0,20 за миллион входных и $1,20 за миллион выходных токенов. У Gemini 3.7 Flash до 31 декабря 2026 года действует тариф $0,75 и $3,75 соответственно. Поэтому история GLM-5.3 не про рекордно дешевый токен. Она про попытку продавать модель верхнего класса производительности в ценовом диапазоне заметно ниже премиальных API.

Основание для такого сравнения есть. Artificial Analysis присвоила GLM-5.3 результат 60 в Intelligence Index. Модель сравнялась с Kimi K3 среди open weights моделей и прибавила семь пунктов относительно GLM-5.2. При этом Z.ai только планирует открыть веса GLM-5.3, точной даты и условий лицензии пока нет.

Почему прайс может обмануть

Тот же анализ Artificial Analysis оценивает стоимость одной задачи индекса для GLM-5.3 примерно в $0,68 против $0,44 у GLM-5.2, хотя тарифы API одинаковы. Причина, указанная в исследовании, проста: новая модель многословнее. Больше выходных токенов по $4,40 за миллион превращают бесплатный апгрейд поколения в рост счета за законченный результат.

Для продуктовой команды это важнее любого места в рейтинге. Допустим, один ваш прогон потребляет 100 тысяч входных и 20 тысяч выходных токенов. По тарифу GLM-5.3 он обойдется в $0,228. Если по результатам собственного eval только три запуска из четырех проходят критерий качества, ожидаемая стоимость успеха уже составит около $0,304 без учета дополнительных исправляющих шагов. Это не характеристика модели, а пример того, как следует считать собственную нагрузку.

В формулу нужно включить длину контекста, объем ответа, долю кэшированного ввода, повторы, ошибки в tool calls и latency. Последних метрик VentureBeat не приводит, поэтому красивой общей цифры здесь быть не может. Для интерактивного агента модель, которая отвечает дешевле, но медленнее или чаще требует второго прохода, способна ухудшить экономику продукта, а не спасти ее.

Маршрутизация становится обязательной

IEEE Spectrum описывал практику, при которой сложные задачи отправляются дорогой frontier-модели, а более простые получает дешевый API. Сейчас этот подход перестает быть аккуратной оптимизацией для энтузиастов. Разрыв между тарифами достаточно велик, чтобы единый провайдер на все запросы выглядел как плата за отсутствие eval-инфраструктуры.

GLM-5.3 особенно интересно проверять на кодинге и длинных агентных сценариях, где Z.ai заявляет существенное усиление модели. Но именно там стоимость результата сильнее зависит от количества шагов и выходных токенов. Поэтому разумный первый ход не миграция, а теневой прогон: один и тот же набор реальных задач через GLM-5.3 и текущую модель, с одинаковыми критериями приемки.

Для бизнеса с ИИ в России вывод практический. Если массовый слой запросов можно перенести на GLM-5.3 без падения доли успешных задач и без роста времени ответа, экономия появится даже при сохранении дорогой модели для сложного хвоста. Если нет, цена $1,40 останется маркетингово удобной единицей, которая почти ничего не говорит о вашем счете.

Смотреть дальше стоит на три числа в собственном eval: стоимость принятого результата, долю запросов без повторного запуска и p95 latency. Прогноз о новом ценовом пороге подтвердится, если GLM-5.3 заберет заметную часть рабочего трафика хотя бы по двум массовым классам задач, а не просто выиграет таблицу с ценами за токен.

Как процитировать

«GLM-5.3 снижает цену сильного API, но миллион входных токенов за $1,40 еще не означает дешевый результат». hegai.media, 19 августа 2026 г.. https://hegai.media/novosti/glm-5-3-snizhaet-tsenu-silnogo-api-no-million-vhodnyh-tokenov-za-1-40--d8dfc288-31c0-46c4-ac16-9916f97e9941

так материал выглядит в мессенджере