К содержанию
Выпуск №82 · 29 августа 2026 / Новости

Hy4 дает миллионный контекст, но открытость этой модели начинается с кластерного бюджета

Tencent открыла Hy4 preview с 770 млрд параметров и контекстом свыше 1 млн токенов. Модель стоит добавить в тесты для длинных документов и памяти агентов, но планировать локальный запуск рано: лицензия, требования к памяти и реальная скорость инференса пока неясны.

Редакция 29 августа 2026 г., 03:20 MSK

В Telegram

Tencent 28 августа выпустила и открыла Hy4 preview. Главная цифра здесь не 770 млрд параметров, а 49 млрд, которые модель активирует при обработке токена. Это делает Hy4 потенциально интересной для команд, которым нужны доступные веса и сверхдлинный контекст, но точно не превращает ее в модель, которую можно без расчета расходов поставить рядом с обычным приложением.

Что именно выпустила Tencent

Как пишет TechNode, Hy4 preview получила 770 млрд параметров, из которых активируются 49 млрд, и контекстное окно свыше 1 млн токенов. Tencent позиционирует модель для программирования, офисной работы, анализа данных, разработки игр и научных задач.

Доступ уже есть в китайских и международных версиях WorkBuddy и CodeBuddy, а также в Yuanbao и ima. API предлагается через Tencent Cloud TokenHub и OpenRouter. Миллион входных токенов стоит $0,834, миллион выходных токенов: $2,501. В WorkBuddy и CodeBuddy действует бесплатный двухнедельный период.

Внутреннее слепое тестирование Tencent охватило 163 эксперта и 203 инженерные задачи. Hy4 получила среднюю оценку 2,99 из 4 против 2,92 у GLM 5.3 и 2,94 у Kimi K3. Это полезный сигнал, но пока только внутренний. Независимых замеров качества на длинном контексте в пакете источников нет.

Tencent также утверждает, что Hy4 помогла оптимизировать части ее собственных систем обучения и инференса, увеличив сквозную пропускную способность на 31,8% относительно базового уровня. Без описания базовой конфигурации эта цифра не отвечает на главный вопрос билдера: сколько токенов в секунду модель выдаст на доступном ему железе и во сколько обойдется стабильный сервис.

770 млрд звучат громко, 49 млрд важнее

Hy4 продолжает линию Hy3, но резко поднимает масштаб. Выпущенная в июле Hy3 имела 295 млрд параметров, активировала 21 млрд и поддерживала контекст до 256K. Она распространялась по Apache 2.0. Для Hy4 TechNode не называет конкретную лицензию, требования к памяти или готовые конфигурации инференса.

Именно поэтому слово «открыла» пока стоит читать осторожно. Доступ к модели и практический контроль над ее развертыванием не одно и то же. Команде нужны не только веса, но и понятная лицензия, воспроизводимая конфигурация, скорость на целевом железе и стоимость обработки реальной нагрузки. Пока из этой таблицы заполнены архитектурный масштаб, размер активной части, контекст и цена внешнего API.

Активные 49 млрд параметров выглядят заметно практичнее, чем полный размер в 770 млрд, но они более чем вдвое превышают 21 млрд у Hy3. Считать отсюда конкретные требования к памяти нельзя, таких данных Tencent в публикации не дала. Но для продуктового решения этого уже достаточно, чтобы не путать открытость с дешевизной. Hy4 следует оценивать как инфраструктурный проект или внешний API, а не как очевидную замену компактной локальной модели.

Кому имеет смысл тестировать Hy4 сейчас

Первый сценарий: длинные документы, где полезность появляется только при загрузке большого массива исходных материалов. Второй: память агентов, которым нужно удерживать историю действий и рабочий контекст. Третий: инженерные задачи, близкие к тем, на которых Tencent проводила внутреннюю оценку.

Начинать разумнее через API. Его тариф дает команде верхнеуровневую цену эксперимента без покупки инфраструктуры и настройки сервинга. На пилоте нужно измерять не абстрактное качество модели, а стоимость завершенной задачи: сколько контекста действительно используется, сколько выходных токенов требуется, как меняется точность ближе к пределу окна и не дешевле ли предварительно сократить документы другой моделью.

Локальное развертывание стоит обсуждать после появления трех вещей: точной лицензии Hy4, публичных требований к памяти и воспроизводимых конфигураций с замерами скорости. До этого решение строить собственный контур будет ставкой на недостающие данные.

Главный маркер на ближайшее время: независимый тест, который одновременно покажет качество на контексте около 1 млн токенов, потребление памяти и скорость генерации. Если такие конфигурации дадут приемлемую стоимость миллиона токенов на доступном командам железе, Hy4 станет реальным вариантом для контролируемого сервинга. Если нет, ее открытость останется полезной прежде всего тем, у кого кластер уже есть, а остальным Tencent фактически предлагает обычный облачный продукт с очень длинным окном.

Как процитировать

«Hy4 дает миллионный контекст, но открытость этой модели начинается с кластерного бюджета». hegai.media, 29 августа 2026 г.. https://hegai.media/novosti/hy4-daet-millionnyy-kontekst-no-otkrytost-etoy-modeli-nachinaetsya-s-k--7131e74b-78d4-4766-9b8d-c3014c8c0e9f

так материал выглядит в мессенджере