8 800 500-99-26 Для звонков по России
MaxLinear Panther: сжатие ИИ-данных втрое на SSD
Железо
2 мин

MaxLinear Panther: сжатие ИИ-данных втрое на SSD

DigitalRazor
DigitalRazor
Подписаться в Telegram
Содержание 4 раздела
Краткое содержание Что за чип и зачем разгружать процессор от сжатия Как это считается в пользу ИИ-инференса Чего MaxLinear пока не раскрыла
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX

Подберём сервер под задачи

Ответьте на несколько вопросов — подготовим предложение

MaxLinear показала на выставке FMS 2026 ускоритель хранения Panther и забрала с ним Best of Show в категории «Серверы и сети». Чип берёт на себя сжатие, шифрование и проверку целостности данных, разгружая процессор сервера, а для ИИ-инференса обещает почти вдвое больше кеша контекста на тех же накопителях.

Краткое содержание

  • Panther — отдельный ускоритель для сжатия, шифрования, избыточного кодирования и контроля целостности данных;
  • сжатие ИИ-данных — до 3 раз, из-за этого эффективная ёмкость под KV-кеш вырастает до 2,2 раза;
  • обмен данными идёт по PCIe напрямую между устройствами, в обход процессора хоста;
  • приз Best of Show FMS 2026 в категории «Серверы и сети», финалист в номинации по ИИ-инфраструктуре.

Что за чип и зачем разгружать процессор от сжатия

Сжатие, шифрование, избыточное кодирование (erasure coding) и проверка целостности данных обычно ложатся на центральный процессор сервера — это стандартные, но прожорливые по ядрам задачи. Panther выносит их на отдельный чип и передаёт данные по PCIe напрямую между накопителем, сетевой картой и ускорителем, минуя оперативную память и ядра хоста. Для сервера с ИИ-нагрузкой это высвобождает процессорные ядра под то, для чего сервер и покупали, — саму модель, а не служебную обработку данных.

Как это считается в пользу ИИ-инференса

Здесь MaxLinear целится в конкретное узкое место — KV-кеш, промежуточные данные, которые модель копит во время генерации ответа и которые быстро вытесняют из памяти ускорителя всё остальное. Сжатие данных втрое, по заявлению компании, поднимает эффективную ёмкость под этот кеш до 2,2 раза и позволяет держать до 2,2 раза больше параллельных ИИ-агентов на той же инфраструктуре. Итоговый выигрыш по полезной ёмкости хранения под ИИ-данные — до 2,5 раза. Чип уже интегрируют с OpenZFS через собственные модули и с фреймворком SPDK для разгрузки сжатия на уровне драйвера.

Чего MaxLinear пока не раскрыла

У предыдущего поколения, Panther V, была заявлена конкретная пропускная способность — 450 Гбит/с. Для нового Panther компания пока называет только относительные коэффициенты — «втрое», «в 2,2 раза», «в 2,5 раза» — без абсолютных цифр по скорости, задержке или энергопотреблению. Не названы и партнёры, которые поставят чип в готовых серверах или JBOF-полках, как и сроки серийных поставок. Пока это приз выставки и предварительная демонстрация, а не продукт в прайс-листе.

Мнение DigitalRazor

Идея разгрузить процессор от сжатия и шифрования не нова, но привязка именно к KV-кешу ИИ-инференса — свежий и разумный угол: у многих заказчиков узкое место сегодня не диски, а память ускорителей. Закладывать Panther в проект сейчас рано — ждём абсолютных цифр по скорости и первых накопителей или JBOF-систем с этим чипом на борту. Но тем, кто планирует парк под инференс на 2027 год, стоит спросить у поставщиков SSD и DPU, появится ли поддержка Panther или похожих решений в дорожной карте.

Для каких задач Компактный GPU-сервер до 2 видеокарт для начальных задач в AI и графике. Оптимален для инференса, визуализации, VFX и рендеринга в студиях и лабораториях, где важна гибкость.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 282 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 4.5U
Для каких задач Универсальная платформа на 4–6 GPU для локального обучения моделей и генеративных задач. Подходит для команд, которым важна надёжность сервера и свобода выбора графики — от RTX 5090 до PRO RTX 6000.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 576 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 6.5U
Для каких задач Сервер промышленного уровня на 8 GPU с кластерной архитектурой. Предназначен для дата-центров и AI-ферм, где требуется масштабируемость и полная загрузка ресурсов под обучение LLM и R&D.
Подробнее
Видеокарты
RTX PRO 6000 / RTX 5090
Объем видеопамяти до 768 ГБ
Процессоры
AMD Epyc, Intel Xeon
Количество ядер до 320
RAM до 3072 ГБ DDR5
Форм-фактор 6U
Для каких задач Серия серверов для кластеризации на 4 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 564 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 128
RAM до 1536 ГБ DDR5
Форм-фактор 2U
Для каких задач Серия серверов для кластеризации на 8 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 4U
Для каких задач HGX объединяет 8 видеокарт NVIDIA H200, достигая экстремальной плотности производительности. Благодаря внутренней связности NVSwitch мгновенно интегрируется в масштабные вычислительные кластеры.
Подробнее
Видеокарты
NVIDIA H200 SXM
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 5U
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX
6.9К

Так же будет интересно почитать

Сайт использует cookies
Узнать подробнее