
Marvell Structera S: 48 ТБ памяти в пуле для GPU
Подберём сервер под задачи
Ответьте на несколько вопросов — подготовим предложение
Marvell представила Structera S 30260 — первый в отрасли коммутатор на 260 линий PCIe 6.0 и CXL 3.x. Он объединяет память нескольких серверов в один пул до 48 терабайт с пропускной способностью 4 терабайта в секунду и задержкой ниже 460 наносекунд. Для дата-центра это способ нарастить память под ИИ-инференс, не покупая лишние ускорители и не переплачивая за HBM.
Краткое содержание
- 260 линий PCIe 6.0/CXL 3.x — вдвое больше, чем у ближайших конкурентов;
- общий пул памяти до 48 ТБ на 16 или 32 процессора/ускорителя, 4 ТБ/с и задержка ниже 460 нс;
- совместим с DDR4 и DDR5, работает с Intel Xeon, AMD EPYC и Arm-платформами;
- инженерные образцы доступны уже сейчас, массовая поставка — в третьем квартале 2026 года.
Что решает общий пул памяти вместо DIMM в каждом сервере
В обычном сервере память жёстко привязана к своим слотам: если она не используется на одной машине, соседняя с нехваткой памяти взять её не может. Для ИИ-инференса это особенно больно: растущие окна контекста и кеш промежуточных вычислений (KV-кеш) съедают память быстрее, чем считает процессор. Structera S 30260 решает это на уровне коммутатора: до 32 процессоров, GPU или других ускорителей подключаются к общему пулу памяти объёмом до 48 ТБ и делят между собой 4 ТБ/с полосы с задержкой ниже 460 наносекунд. Коммутатор одинаково работает с DDR4 и DDR5, поэтому в пул можно свести уже закупленную память вместо покупки новой под каждый сервер.
Цифры Marvell: в 16 раз против локальной памяти
По заявлению компании, пулинг памяти через Structera S даёт до 16 раз лучшую масштабируемость по сравнению с локальной памятью. Причина простая: память не простаивает на одних серверах, пока её не хватает на других. Сегодняшняя программная альтернатива, пулинг памяти через RDMA по сети, проигрывает коммутатору по задержке на 72%: у Marvell всё происходит на уровне шины PCIe, а не через сетевой стек. Для конфигураций с GPU компания заявляет прирост пропускной способности инференса до 4,8 раза и снижение времени до первого токена на 82,7%. Насколько это подтвердится на реальных нагрузках заказчиков — покажут независимые тесты, но сама архитектура снимает узкое место, знакомое любому, кто держит длинный контекст на ограниченной памяти ускорителя.
Часть большого портфеля, но пока без цены
Structera S — третий кирпич в линейке Marvell после контроллеров расширения памяти Structera X и ускорителя вычислений рядом с памятью Structera A на 16 ядрах Arm Neoverse V2. Технология досталась Marvell вместе с покупкой XConn Technologies, а новый коммутатор совместим по плате, выводам и питанию с прошлым поколением на PCIe 5.0/CXL 2.0 — апгрейд не потребует менять разводку стойки. Но пока это инженерные образцы: массовая поставка намечена на третий квартал 2026 года, цену компания не называет, а серверных платформ с готовой поддержкой на рынке ещё нет. Класс техники — уровень гипермасштабируемых дата-центров, и в Россию это железо, если и попадёт, то не первым эшелоном поставок.
Мнение DigitalRazor
CXL-пулинг памяти закрывает реальную боль ИИ-инференса: нехватку памяти под контекст и KV-кеш без переплаты за лишние ускорители с HBM на борту. Но Structera S 30260 — пока инженерные образцы, а не серийный продукт: цены нет, и готовых серверных платформ с поддержкой тоже нет. Тем, кто планирует парк под тяжёлый ИИ-инференс на 2027 год, есть смысл закладывать CXL-пулинг в архитектуру уже сейчас, а саму закупку — отложить до серийных поставок и подтверждённой совместимости с конкретными серверами.













