К содержанию
Выпуск №71 · 18 августа 2026 / Новости

NVIDIA Nemotron 3.5 Lightning стал доступен в Amazon SageMaker JumpStart

Самостоятельно настраивать обслуживающую инфраструктуру не потребуется.

Редакция 18 августа 2026 г., 14:37 MSK

В Telegram

Как сообщает AWS Machine Learning Blog, открытую модель NVIDIA Nemotron 3.5 Lightning теперь можно развернуть через Amazon SageMaker JumpStart. Самостоятельно настраивать обслуживающую инфраструктуру не потребуется. Модель рассчитана на высоконагруженные агентные сценарии и обучена работе с инструментами в популярных агентных средах.

В основе Nemotron 3.5 Lightning лежит гибридная архитектура Mixture-of-Experts. Всего у модели 30B параметров, но при каждом прямом проходе активируются только 3B. Она поддерживает контекст до 1M токенов, использует спекулятивное декодирование DFlash и способна работать на одном поддерживаемом GPU. По заявлению NVIDIA, пропускная способность может быть до 4 раз выше, а выполнение задач в высоконагруженных агентных сценариях завершается до 30% быстрее.

Модель дистиллировали из NVIDIA Nemotron 3 Ultra и разработали совместно с Nemotron Coalition. В системах с несколькими моделями Lightning можно поручить специализированные операции с большим числом вызовов. Например, классификацию предупреждений, извлечение полей из форм или проверку записей на соответствие правилам. Планирование многоэтапных процессов при этом можно оставить моделям передового уровня.

Ключевые факты

  • Из 30B параметров модели при каждом прямом проходе активируются 3B.

  • Контекстное окно достигает 1M токенов, а для спекулятивного декодирования используется DFlash.

  • NVIDIA заявляет до 4 раз более высокую пропускную способность и до 30% более быстрое завершение задач.

  • Модель может работать на одном поддерживаемом GPU.

Вопросы и ответы

Что изменится в развертывании модели?

Nemotron 3.5 Lightning можно запустить через SageMaker JumpStart без самостоятельной настройки обслуживающей инфраструктуры; для работы достаточно одного поддерживаемого GPU.

Для каких задач ее имеет смысл использовать?

Модель рассчитана на высоконагруженные агентные операции с большим числом вызовов, включая классификацию предупреждений, извлечение полей из форм и проверку записей по правилам. Планирование многоэтапных процессов предлагается оставлять моделям передового уровня.

За счет чего модель должна работать быстрее?

При общем размере 30B параметров на каждом проходе активируются только 3B, а для спекулятивного декодирования применяется DFlash. NVIDIA заявляет до 4 раз более высокую пропускную способность и до 30% более быстрое завершение задач.

Контекст по теме

Как процитировать

«NVIDIA Nemotron 3.5 Lightning стал доступен в Amazon SageMaker JumpStart». hegai.media, 18 августа 2026 г.. https://hegai.media/novosti/nvidia-nemotron-3-5-lightning-stal-dostupen-v-amazon-sagemaker-jumpsta--34d1d746-3821-4a54-9f71-dee3e2906f96

так материал выглядит в мессенджере