К содержанию
Выпуск №63 · 10 августа 2026 / Новости

Безлимитный ИИ заканчивается: Microsoft превращает токены в жёсткий бюджет

По данным 404 Media, Microsoft ограничивает расход токенов сотрудниками и переводит инженеров на более дешёвые модели. Для фаундеров это сигнал: постоянный безлимит нельзя закладывать ни в себестоимость AI-продукта, ни в его тарифы.

Редакция 10 августа 2026 г., 17:20 MSK

В Telegram
Безлимитный ИИ заканчивается: Microsoft превращает токены в жёсткий бюджет
Иллюстрация: hegai.media

Идея безлимитного ИИ продержалась ровно до того момента, когда компании начали считать не число пользователей, а их реальное потребление. Теперь, как пишет ITPro со ссылкой на 404 Media, Microsoft требует от сотрудников расходовать токены с той же дисциплиной, что и любой другой критический ресурс. Если экономить приходится даже компании, которая называет себя AI-first, строить бизнес на вечной щедрости поставщиков моделей уже нельзя.

Что произошло

Во внутренней записке Microsoft Джей Парих призвал инженеров думать не о максимальном потреблении токенов, а о результате для клиентов и бизнеса. По данным 404 Media, подразделения должны работать с бюджетными ориентирами, а сотрудники получили инструменты для отслеживания расхода.

Конкретный целевой бюджет пока не назван. При этом внутренние данные, приведённые в инструкции по использованию Copilot, показывают, что многие инженеры тратят от сотен до нескольких тысяч долларов в месяц на токены.

Более дешёвая GPT-5.6 должна стать моделью по умолчанию для инженеров. Сама Microsoft не подтвердила ITPro достоверность публикации 404 Media, но и комментировать её отказалась.

Это не первый сигнал со стороны продуктов, связанных с Microsoft. В апреле GitHub ввёл для Copilot новую схему оплаты по потреблению из-за роста затрат на вычисления и инференс. Руководители объясняли изменение распространением агентов, использование которых обходится значительно дороже, чем работа с reasoning-моделями. В июле Сатья Наделла также предлагал клиентам выбирать более экономичные модели MAI вместо дорогих frontier-моделей.

Tokenmaxxing оказался плохим KPI

Ещё недавно компании поощряли сотрудников использовать как можно больше ИИ. ITPro пишет о внутренних рейтингах активных пользователей и других стимулах, призванных ускорить внедрение. Логика была понятной: если технология новая, сначала нужно снять страх и заставить людей попробовать её в работе.

Но потребление быстро перестало быть приличной заменой результату. По приведённым ITPro данным Bloomberg, Uber израсходовала годовой AI-бюджет за несколько месяцев и установила лимит в $1 500 на сотрудника в месяц. В июне Accenture попросила сотрудников реже применять ИИ для простых задач из-за стремительного роста расходов на токены. The Guardian ранее писал, что Atlassian ввела для сотрудников AI-кошельки с месячным лимитом до $2 000.

Присоединение Microsoft важно не само по себе. Оно показывает, что нормирование токенов становится не временной осторожностью отдельных покупателей, а рабочей практикой рынка. Сначала ИИ измеряли количеством запросов, теперь его всё чаще измеряют стоимостью полезного результата. Романтика внедрения закончилась на первой достаточно большой счёт-фактуре.

Для подписочной модели проблема особенно неприятная. Фиксированный тариф рассчитывается на усреднённое потребление, но экономика ломается на верхнем хвосте: самых активных пользователях и агентных сценариях. Доход от клиента остаётся фиксированным, а число оплачиваемых поставщику токенов таким быть не обязано. Поэтому «безлимит» неизбежно превращается либо в скрытый fair use, либо в кредиты, ограничения дорогих моделей и отдельную оплату интенсивных сценариев.

Что менять в продукте уже сейчас

Фаундерам стоит считать себестоимость так, будто поставщик может завтра ужесточить лимиты, изменить модель по умолчанию или перевести агентные функции на оплату по потреблению. Если продукт остаётся прибыльным только при постоянном безлимите, это не преимущество тарифа, а зависимость от чужой субсидии.

На уровне продукта нужны четыре вещи: лимиты на пользователя и задачу, маршрутизация простых запросов в более дешёвые модели, кэширование повторяющихся ответов и жёсткий контроль агентных циклов. Там, где агент сам продолжает работу, бюджет должен уметь остановить её раньше, чем это сделает финансовый директор.

Тарифы тоже придётся проверять не на среднем клиенте, а на самом ресурсоёмком. Кредиты, доплата за превышение и отдельные пакеты для агентов выглядят менее эффектно, чем крупная надпись «безлимит», зато переживают реальное использование.

Дальше стоит следить за тремя маркерами: появятся ли публичные лимиты Microsoft для сотрудников, станет ли usage-based billing стандартом для агентных функций и будут ли поставщики всё чаще назначать дешёвые модели вариантом по умолчанию. Если корпоративные тарифы сохранят настоящий безлимит, а внутренние кошельки и ограничения начнут исчезать, этот прогноз не сбудется. Пока рынок движется строго в обратную сторону.

Как процитировать

«Безлимитный ИИ заканчивается: Microsoft превращает токены в жёсткий бюджет». hegai.media, 10 августа 2026 г.. https://hegai.media/novosti/bezlimitnyy-ii-zakanchivaetsya-microsoft-prevraschaet-tokeny-v-zhestki--6ac9ed75-a947-4c61-b4e1-e974937854b5

так материал выглядит в мессенджере