Vercel уже снизил тарифы на GPT-5.6 Sol, причем существующие запросы автоматически оплачиваются по новой цене: model ID не изменился. Но заголовочные 50% не означают, что прежний счет уменьшится вдвое. Для работающего приложения реальная экономия составляет от 20% до трети, и ее легко съесть дополнительными ответами или ретраями.
Что именно подешевело
Как пишет Vercel, OpenAI снизила list price GPT-5.6 Sol, после чего скидка AI Gateway в 50% стала применяться уже к этой новой базе. Она действует до 18 сентября на всех service tiers.
На Default теперь нужно платить $2 за миллион входных и $10 за миллион выходных токенов. Раньше клиенты Vercel платили $2,50 и $15 соответственно. На Flex цена снизилась с $1,25/$7,50 до $1/$5, а на Priority, который Vercel обозначает как fast mode, с $5/$30 до $4/$20.
То есть вход подешевел на 20%, выход на треть. Формулировка про скидку 50% верна относительно новой list price, но не относительно вчерашнего счета клиента AI Gateway. Для финансовой модели бизнеса важна именно вторая цифра.
Тарифы указаны для запросов до 272K токенов. По данным Vercel, цены на cached tokens, cache writes, запросы с контекстом свыше 272K и US regional rates изменились в той же пропорции. BYOK-запросы оплачиваются по собственному тарифу клиента в OpenAI, поэтому переносить на них цены AI Gateway нельзя.
Считать нужно не токен, а завершенную работу
Новая цена делает Sol кандидатом на повторный eval, но сама по себе ничего не говорит о рентабельности замены текущей модели. Рабочая метрика здесь проста: все расходы на прогоны делятся на число задач, которые приложение завершило с приемлемым результатом.
В этот числитель должны попасть не только первый prompt и финальный ответ. Туда же относятся повторные запросы после ошибки, дополнительные обращения внутри инструментального цикла и исправления результата. Иначе команда оптимизирует красивую строку в прайс-листе, а не собственную себестоимость.
Особенно внимательно стоит смотреть на output. На Default миллион выходных токенов стоит столько же, сколько пять миллионов входных. Та же пропорция сохраняется на Flex и Priority. Поэтому модель, которая отвечает длиннее или требует еще одного полного прогона, может быстро вернуть экономику к прежнему уровню.
Математически запас не так велик. Если нагрузка почти целиком входная, рост оплачиваемого объема примерно на 25% съест выигрыш от новой цены. Если преобладает output, запас составляет около 50%. У реального агента результат окажется между этими границами и будет зависеть от структуры запросов.
Практический порог замены выглядит так: стоимость всех вызовов Sol, деленная на долю успешных задач в eval, должна быть ниже такого же показателя действующей модели. Если качество осталось прежним, снижение тарифа сразу работает в пользу Sol. Если ради того же результата понадобилось больше попыток, токенов или инструментальных циклов, скидка может остаться только на слайде с закупочными ценами.
В годовой бюджет эту цену пока ставить рано
Сниженная list price OpenAI и скидка Vercel здесь имеют разный горизонт. Vercel прямо указывает срок действия 50-процентной скидки AI Gateway: до 18 сентября. Поэтому расчет нужен как минимум в двух версиях: по текущим эффективным ставкам и по новой list price без промо, то есть $4/$20 на Default, $2/$10 на Flex и $8/$40 на Priority.
Это не повод ждать сентября. Новые ставки уже применяются автоматически, а значит, eval можно прогнать на сегодняшнем трафике и сразу увидеть стоимость успешной задачи. Но закреплять промоцену в годовом плане без второго сценария было бы бухгалтерией надежды.
Главный маркер на ближайшие недели конкретен: продлит ли Vercel скидку после 18 сентября. Если нет, Sol должна выдерживать сравнение с текущей моделью уже по новой list price. Если выдерживает только по промотарифу, это не новый дефолт, а временно выгодный маршрут.