Qwen 3.8 27B получила 27 млрд параметров, поддержку обработки изображений и лицензию Apache 2. Модель разработала исследовательская лаборатория Qwen компании Alibaba. Как сообщает Simon Willison's Weblog, ее можно запускать локально на достаточно производительном ноутбуке.
Во внутренних бенчмарках Qwen новая модель опережает Qwen 3.6 27B и модель с закрытыми весами Qwen 3.7-Plus. Автор материала уточняет, что эти показатели еще нужно сопоставить с результатами независимых тестов.
Qwen 3.8 27B протестировали на MacBook Pro с M5 Max и 128 ГБ памяти, а также на NVIDIA DGX Spark. В обоих случаях использовались LM Studio и квантованная сборка Q4_K_M объемом 17 ГБ. На NVIDIA DGX Spark модель также запускали через llama-server.
Согласно документации Qwen, для параметра reasoning_effort по умолчанию задано значение xhigh. С его помощью можно менять глубину рассуждений и контролировать стоимость. По наблюдениям автора, в режиме xhigh модель выдавала чрезмерно подробные рассуждения.
Ключевые факты
Модель насчитывает 27 млрд параметров, поддерживает обработку изображений и распространяется по лицензии Apache 2.
По собственным бенчмаркам Qwen, модель показала прирост относительно Qwen 3.6 27B и Qwen 3.7-Plus.
Для тестов использовалась квантованная сборка Q4_K_M размером 17 ГБ в LM Studio.
Испытания проводились на MacBook Pro с M5 Max и 128 ГБ памяти, а также на NVIDIA DGX Spark.
Вопросы и ответы
- На каком оборудовании модель уже запускали локально?
Квантованную сборку Q4_K_M размером 17 ГБ тестировали через LM Studio на MacBook Pro с M5 Max и 128 ГБ памяти, а также на NVIDIA DGX Spark.
- Можно ли использовать модель в коммерческом продукте?
Модель распространяется по лицензии Apache 2 и поддерживает обработку изображений.
- Как режим xhigh влияет на эксплуатацию?
Параметр reasoning_effort позволяет менять глубину рассуждений и контролировать стоимость, а xhigh включен по умолчанию. В тестах этот режим приводил к чрезмерно подробным рассуждениям.
Контекст по теме
- Модель Moebius 0.2B для удаления объектов на изображениях запустили прямо в браузере через WebGPU23 июня 2026 г.
- Z.ai открыла веса модели GLM-5.2 с контекстом 1 млн токенов18 июня 2026 г.
- Georgi Gerganov назвал Qwen3.6-27B способной локальной моделью для задач программирования16 июня 2026 г.
- Первые впечатления от Claude Fable 5: строгие ограничения и большой контекст10 июня 2026 г.