К содержанию
Выпуск №78 · 25 августа 2026 / Новости

В edge-AI память становится частью ускорителя, но коэффициент Samsung 3,01x пока нельзя класть в бизнес-кейс

LPDDR5X-PIM выполняет часть вычислений рядом с данными и в тесте Samsung втрое увеличила число токенов в секунду. Для разработчиков локального инференса это повод пересчитать связку памяти и ускорителя, но не повод заказывать железо по одному вендорскому слайду.

Редакция 25 августа 2026 г., 23:19 MSK

В Telegram

Samsung раскрыла на Hot Chips 2026 архитектуру LPDDR5X-PIM и предварительные результаты инференса: до 3,01 раза больше токенов в секунду по сравнению с обычной LPDDR5X. Практический вывод не в том, что Samsung внезапно изобрела «память втрое быстрее», а в другом: в edge-устройствах часть работы ускорителя теперь можно перенести туда, где лежат веса модели.

Покупать по этим цифрам пока рано. Но проектировать следующее поколение устройства так, будто память остается пассивным складом данных, уже рискованно.

Что именно показала Samsung

Как пишет Tom's Hardware, Samsung встроила вычислительную логику в каждый банк LPDDR5X. Она выполняет базовые MAC-операции непосредственно рядом с ячейками DRAM, вместо того чтобы постоянно гонять данные между памятью и процессором.

Память может работать в двух режимах: обычном single-bank и вычислительном multi-bank. Стандартные DRAM-контроллеры сохраняются, а команды переключаются между традиционными чтением и записью и операциями PIM. После вычислений хост забирает готовый результат из памяти.

На бумаге эффект выглядит внушительно. У LPDDR5X-9600 пиковая пропускная способность составляет 76,8 ГБ/с, а с PIM Samsung заявляет эффективные 614 ГБ/с, то есть восьмикратный рост. Он возникает не из-за магического ускорения интерфейса, а благодаря сокращению движения данных и параллельной работе банков.

В предварительном тесте время выполнения модели сократилось в 2,28 раза, а производительность в токенах в секунду выросла в 3,01 раза. Samsung использовала Llama 3.1 с 8 млрд параметров и неназванный edge AI-ускоритель. Именно неназванный: Tom's Hardware предполагает, что это мог быть ранний Gaia SoC, но подтверждения нет.

Есть и более существенная оговорка. Выходные данные в сравнении отличались. На вопрос участника презентации Samsung ответила, что продолжает оптимизацию точности и ожидает сохранить выигрыш в производительности. Пока качество результата не выровнено, коэффициент 3,01x остается характеристикой конкретного вендорского теста, а не готовой цифрой для расчета продукта.

Почему вычисления переезжают в LPDDR

PIM для Samsung не новая идея. Компания демонстрировала технологию еще в 2021 году, затем применила ее в HBM и в 2023-м представила концепцию LPDDR5X-PIM. Теперь речь идет уже о продукте, проходящем валидацию.

Причина перехода к LPDDR довольно прозаична: HBM слишком дорога. По данным презентации Samsung, память формирует основную часть стоимости AI-чипов, и ее доля растет. Одновременно DDR5 и тем более HBM повышают требования к энергопотреблению. Для edge-устройств это особенно неприятная комбинация: бюджет, питание и охлаждение ограничены, а модель все равно нужно кормить данными.

LPDDR5X-PIM атакует не недостаток арифметических блоков, а «налог на доставку» данных до них. Поэтому технология выглядит наиболее убедительно там, где веса уже находятся в памяти, вычисления сводятся к повторяющимся MAC-операциям, а инференс упирается в пропускную способность. В таком сценарии более мощный ускоритель может оказаться дорогим способом ждать память.

Для билдера это меняет порядок проектирования. Сначала стоит моделировать весь тракт память плюс ускоритель, и только потом выбирать вычислительный чип. Если PIM действительно снимает часть обмена с хоста, можно проверять варианты с менее агрессивным ускорителем, более дешевой подсистемой памяти или меньшим общим энергобюджетом. Это пока не обещание экономии, а новый параметр архитектурного выбора.

Плата за него тоже видна. Хотя Samsung не ожидает роста общего энергопотребления относительно обычной DRAM, пиковая мощность PIM будет «намного выше» из-за импульсного характера нагрузки. Значит, питание и тепловой режим придется считать не только по среднему значению. Добавятся поддержка PIM-команд, размещение данных и проверка качества вывода модели. Стандартный корпус на 561 контакт делает память внешне похожей на LPDDR5X, но не превращает ее в замену по принципу «вставил и получил 3x».

Что смотреть дальше

Главный маркер будет не очередной пик TPS, а тест с раскрытым ускорителем, одинаковым качеством выхода и замером полного энергопотребления системы. Если преимущество сохранится при этих условиях, производителям edge-устройств придется сравнивать не отдельные TOPS и ГБ/с, а стоимость одного корректного ответа всей связки.

Второй маркер уже обозначен: Samsung рассчитывает получить начальную спецификацию JEDEC для LPDDR6X-PIM в этом году. Если PIM перейдет из фирменной реализации в спецификацию следующего поколения памяти, вычислительная DRAM станет не экзотикой для презентаций, а требованием, которое имеет смысл закладывать в техническое задание уже сейчас.

Как процитировать

«В edge-AI память становится частью ускорителя, но коэффициент Samsung 3,01x пока нельзя класть в бизнес-кейс». hegai.media, 25 августа 2026 г.. https://hegai.media/novosti/v-edge-ai-pamyat-stanovitsya-chastyu-uskoritelya-no-koeffitsient-samsu--4ff4c64f-c720-4b70-a3d8-58c1a7974b38

так материал выглядит в мессенджере