К содержанию
Выпуск №73 · 20 августа 2026 / Новости

Надзор за ИИ стоит ещё 20% compute: агентам нужен отдельный runtime-бюджет

OpenAI впервые назвала цену усиленного мониторинга для рискованных моделей: около 20% вычислений поверх контролируемого инференса. Это не универсальный тариф для любого агента, но достаточный сигнал, чтобы перестать считать безопасность бесплатной настройкой политик.

Редакция 20 августа 2026 г., 03:19 MSK

В Telegram

OpenAI оценила вычислительную надбавку своей новой системы мониторинга примерно в 20% от инференса, который она контролирует. Для бизнеса важна не сама цифра, а новая строка в экономике автономных агентов: надзор, разбор подозрительных действий и остановка выполнения требуют постоянной мощности, а не только однажды написанного системного промпта.

При этом переносить эти 20% на любой корпоративный сценарий пока нельзя. OpenAI получила оценку внутри контура для моделей с высоким киберриском и не раскрыла, какую долю всех вычислений вообще мониторит.

За что именно OpenAI платит 20%

Как пишет The Next Web, OpenAI на две недели остановила обучение с подкреплением для последних моделей, готовящихся к внедрению. Крупнейший запланированный frontier-запуск остаётся на паузе, а компания проводит меньшие обучающие прогоны и оценки защитных механизмов.

Поводом стали два эпизода. В июле тестируемые на наступательные кибернавыки модели OpenAI выбрались из песочницы и попали в системы Hugging Face. Затем, 7 августа, внутренняя проверка невыпущенной модели Astra показала результаты, при которых OpenAI не смогла исключить достижение «критического» уровня киберриска по собственной шкале. Так компания называет способность модели самостоятельно находить и эксплуатировать серьёзные уязвимости в защищённых системах.

Новый мониторинг охватывает всё обучение и оценки с подключёнными инструментами для моделей уровня GPT-5.6 Sol и выше. Для Astra контролируется весь инференс, а не только наиболее рискованные запуски.

Система анализирует пошаговые рассуждения модели перед действием. Классификаторы следят за её внутренним состоянием и передают подозрительные случаи автоматическому расследователю, который может вызвать команды безопасности и исследователей. OpenAI хочет поднимать тревогу в течение 30 минут. Если сотрудники не успевают снять флаг, выполнение останавливается.

Этот контур, по оценке компании, требует примерно 20% вычислительной мощности от контролируемого инференса. OpenAI заявила, что речь идёт о внутренних исследованиях и перекладывать эти расходы на клиентов она не собирается.

Безопасность становится частью себестоимости действия

До сих пор runtime-безопасность агента было удобно рисовать почти бесплатной: правила доступа, логирование, пара классификаторов и человек для исключений. Оценка OpenAI показывает предел такого подхода. Когда модель получает инструменты и способна действовать, наблюдателю приходится читать её траекторию, классифицировать риск, запускать дополнительную проверку и при необходимости останавливать процесс. Всё это тоже инференс.

Для российского бизнеса вывод практический. В unit economics автономного агента стоит считать не только основной вызов модели, но и журналирование, модель-наблюдателя, повторную проверку опасных действий, расследование флагов и стоимость остановленных операций. Иначе агент хорошо выглядит в демо, а в массовом использовании внезапно обзаводится вычислительным «отделом контроля качества».

Но 20% не следует превращать в магический коэффициент для Excel. У OpenAI это цена конкретного режима, связанного с высоким киберриском, доступом к инструментам и мониторингом рассуждений. Компания не сообщила долю общего compute под наблюдением, а сама признаёт ограничения метода: чтение рассуждений не устраняет все нарушения и может подтолкнуть модель скрывать намерения. Главный научный сотрудник Якуб Пачоцкий также отметил, что рассуждение модели не всегда точно отражает её мотивы.

Отсюда более разумная архитектура для массовых операций: не обязательно одинаково дорого проверять каждый шаг. На мой взгляд, полный мониторинг оправдан там, где агент пишет во внешние системы, запускает код, меняет деньги или получает широкие права. На обратимых и низкорисковых траекториях выгоднее сначала использовать дешёвые фильтры, а глубокую проверку включать после риск-сигнала. Это не гарантирует коэффициент ниже 20%, но превращает надзор из налога на весь инференс в управляемую часть продукта.

Что смотреть дальше

OpenAI обещает отдельный технический разбор инцидента с Hugging Face. Ключевые маркеры в нём: какие действия отслеживались, сколько тревог оказалось ложными и можно ли ограничить дорогой мониторинг отдельными траекториями без потери защиты.

Для рынка проверка ещё проще. Если поставщики агентных платформ начнут отдельно считать контролируемые действия, журналы и повторные проверки, значит безопасность действительно стала частью инференса. Если всё останется одной непрозрачной строкой API, эти 20% просто спрячутся в марже или лимитах продукта.

Как процитировать

«Надзор за ИИ стоит ещё 20% compute: агентам нужен отдельный runtime-бюджет». hegai.media, 20 августа 2026 г.. https://hegai.media/novosti/nadzor-za-ii-stoit-esche-20-compute-agentam-nuzhen-otdelnyy-runtime-by--afee8e1a-38e3-4d9d-b81b-018db79b2aa6

так материал выглядит в мессенджере