К содержанию
Выпуск №81 · 28 августа 2026 / Новости

CXL превращает старую DDR4 в третий ярус AI-памяти, но экономия пока доступна гиперскейлерам

Marvell предлагает перестать держать весь рабочий набор AI-сервера в дорогой локальной памяти и вынести менее чувствительные данные в CXL и SSD. Идея уже работает у Meta (деятельность Meta признана экстремистской и запрещена в РФ), но повторить её без собственной электроники, системного ПО и точного расчёта задержек пока непросто.

* Деятельность Meta признана экстремистской и запрещена в РФ

Редакция 28 августа 2026 г., 10:20 MSK

В Telegram

Цены на DRAM заставляют инфраструктурные команды пересматривать не только закупки, но и саму архитектуру серверов. Предложение Marvell выглядит здраво: оставить дорогую память данным на критическом пути, а остальное разложить по более дешёвым ярусам. Но считать старую DDR4 готовой бюджетной заменой DDR5 рано. У Meta* за экономией стоят собственный чип, отдельное шасси и своя система размещения страниц.

Как устроен новый пирог памяти

Tom's Hardware пишет, что Marvell собрала трёхуровневую «AI memory infrastructure» на фоне резкого подорожания DRAM. Контрактные цены на обычную DRAM выросли на 90-95% в первом квартале 2026 года и ещё на 58-63% во втором. Доля памяти в капитальных расходах гиперскейлеров в этом году, по оценке издания, приблизится к 30% против примерно 8% в 2023 и 2024 годах.

По сути, Marvell предлагает перестать воспринимать память как один однородный пул. На мой взгляд, в локальной HBM и DDR5 придётся оставить данные, для которых любая дополнительная задержка бьёт по вычислениям. CXL-память подходит для CPU-side capacity, распределённого кеша и той части KV-cache, которую программный слой способен вовремя перемещать между ярусами. Совсем холодный остаток можно сбрасывать на SSD.

Средний ярус строится на контроллерах Structera X для DDR4 и DDR5. Они поставляются с 2024 года и, по данным блога Marvell, уже используются гиперскейлерами. Встроенное LZ4-сжатие, как утверждает компания, даёт в 2-2,5 раза больше эффективной ёмкости.

Для общего пула памяти Marvell предлагает коммутатор Structera S. Он соединяет 16 или 32 CPU либо GPU с пулом до 48 ТБ, заявляет суммарную пропускную способность 4 ТБ/с и полный цикл обмена менее 460 нс. Образцы должны появиться в текущем квартале. Photonic Fabric, полученный вместе с покупкой Celestial AI за $3,25 млрд, должен растянуть общий ярус на расстояние до 50 метров и хранить до 32 ТБ «тёплого» KV-cache.

Нижний ярус пока существует скорее в дорожной карте. Контроллер Bravera SC6 для PCIe 6.0 рассчитан на перенос KV-cache из HBM на SSD, но его образцы ожидаются только в четвёртом квартале 2026 года. По оценке Tom's Hardware, готовые накопители появятся не раньше 2027-го.

Что действительно можно вынести в DDR4

Лучший аргумент Marvell принадлежит не Marvell, а Meta. Компания уже использует переработанные модули DDR4 за собственным CXL-контроллером Vistara на миллионах серверов. В каждом MemServer установлены 768 ГБ локальной DDR5-6400 и 256 ГБ подключённой через CXL памяти DDR4-2400, извлечённой из списанных машин.

Meta сообщает, что около 40% её парка ограничено объёмом памяти. В отдельных задачах распределённого ML-инференса новая схема сократила необходимое число серверов до 25%, а в распределённом кешировании средняя задержка снизилась на 29%. Это показывает границу применимости лучше маркетинговой схемы: DDR4 полезна там, где сервер упирается в ёмкость, а не в скорость каждого обращения.

Часть KV-cache тоже можно отправить на отдельный ярус, но только если горячие страницы остаются рядом с вычислителем. Иначе экономия на модулях превратится в плату задержкой и пропускной способностью. Сам Marvell поэтому позиционирует CXL для CPU-side capacity и staging KV-cache, а не как замену GPU-to-GPU fabric.

Пока это не коробочное решение

Кейс Meta легко принять за доказательство доступности CXL. На деле он доказывает обратное. Meta разработала собственный ASIC, собственное шасси MemServer и собственный Linux-стек размещения страниц. Такой путь имеет смысл при миллионах серверов. Для обычной инфраструктурной команды это не продукт, а исследовательская программа с закупочным отделом внутри.

Рынок тоже пока не догнал презентации. По оценке Yole, две трети проданных в первом квартале 2025 года серверов поддерживали CXL, но фактическая доля машин, использующих технологию, сегодня близка к нулю. К 2030 году она может вырасти лишь до 13%.

Есть и неприятная деталь: «старая дешёвая DDR4» уже не настолько дешёвая. Производители сокращают её выпуск, а TrendForce оценивала рост цен на DDR4 в первом квартале до 50%. Tom's Hardware не приводит цены контроллеров Marvell, поэтому доказать итоговую экономию для покупателя по этому пакету данных нельзя.

Практический вывод простой: проектировать AI-сервер как один дорогой пул памяти уже расточительно, но закладывать CXL-экономию в бюджет до испытаний тоже рано. Проверять нужно вместе четыре величины: стоимость модулей и контроллеров, реальную пропускную способность, задержку на рабочих нагрузках и качество программного размещения данных.

Главный маркер на 2027 год: появятся ли серийные конфигурации не только у гиперскейлеров, с опубликованной полной ценой и end-to-end тестами KV-cache, распределённого кеша и инференса. Если продавцы продолжат показывать лишь ёмкость пула и лабораторные наносекунды, третий ярус останется ответом поставщика на дефицит, а не доступной архитектурой для рынка.

Как процитировать

«CXL превращает старую DDR4 в третий ярус AI-памяти, но экономия пока доступна гиперскейлерам». hegai.media, 28 августа 2026 г.. https://hegai.media/novosti/cxl-prevraschaet-staruyu-ddr4-v-tretiy-yarus-ai-pamyati-no-ekonomiya-p--b3a16b2e-105f-479c-b4b1-f6fb19d4b46c

так материал выглядит в мессенджере