OpenAI и Anthropic почти одновременно выпустили более дешёвые модели. Теперь обе frontier-лаборатории продают корпоративным клиентам не только качество в тестах, но и снижение расходов на реальную работу.
Как пишет CNBC, OpenAI добавила в семейство GPT-6 два уровня. GPT-6 Sol расположен ниже Astra и предназначен для сложных нагрузок, включая программирование. GPT-6 Luna рассчитан на массовые операции вроде извлечения информации и суммаризации документов. API-цены снижены на 50% относительно промотарифов GPT-5.6.
Anthropic в тот же день представила Claude Opus 5.5. Компания называет модель более экономной по расходу токенов и оценивает стоимость её работы примерно на 40% ниже, чем у Opus 5. Глава продуктового направления Anthropic Дианна Пенн объяснила CNBC, что модель регулирует объём рассуждений и ответа в зависимости от выбранного уровня усилий.
Цена токена не показывает полную стоимость
Сравнить скидку OpenAI со скидкой Anthropic напрямую нельзя. У OpenAI экономия строится на маршрутизации: сложный код отправляется в Sol, поток документов — в Luna. Anthropic сокращает число токенов, которые Opus тратит на получение результата.
Поэтому полезная метрика для бизнеса — стоимость принятого результата. К тарифу API нужно добавить расходы на повторные запросы, проверку сотрудником и исправление ошибок. Иначе низкая цена токена может скрывать дорогой рабочий процесс. Важна доля результатов, которые команда принимает без дополнительного цикла доработки.
Ценовая гонка началась не из щедрости. CNBC пишет, что клиенты пытаются сдержать расходы на ИИ, а на OpenAI и Anthropic давят более дешёвые open-weight модели Alibaba, Moonshot AI и DeepSeek. Масштаб проблемы уже заметен в бюджетах: по данным The Information, доля ИИ-провайдеров в software-расходах клиентов Zip выросла за год с 1,4% до 8%. Когда эксперимент превращается в отдельную строку бюджета, красивого демо для продления контракта мало.
Перед выбором модели компании стоит собрать собственный набор рабочих задач — например, поток документов с извлечением полей и типовые coding-сценарии — и одинаково прогнать его на Sol, Luna и Opus 5.5. Для каждого варианта нужно разделить общие затраты на число результатов, которые сотрудники приняли без переделки. Этот расчёт покажет, снижает ли новая тарифная политика стоимость конкретного процесса, а не только цифру в прайсе.

