
Silicon Motion MonTitan: SSD в роли памяти для ИИ-агентов
Подберём сервер под задачи
Ответьте на несколько вопросов — подготовим предложение
Silicon Motion показала на Flash Memory Summit 2026 платформу MonTitan SSD Reference Design Kit — референсный дизайн, который превращает корпоративный накопитель в постоянный слой памяти для автономных ИИ-агентов. Тем, кто строит агентную ИИ-инфраструктуру, это даёт способ разгрузить дорогую память ускорителя на SSD — и не покупать лишние GPU только ради ёмкости.
Краткое содержание
- контроллеры SM8366 (PCIe 5.0) и SM8466 (PCIe 6.0) получили архитектуру PerformaShape;
- поддержка KV-кэша ИИ-агентов и предсказуемого качества обслуживания через интерфейс NVMe TP4176;
- формфакторы U.2, E1.L и E3.S, ёмкость — до 256 терабайт;
- референсный дизайн нацелен на многоагентные и мультиарендные ИИ-нагрузки с постоянной записью.
Что показала Silicon Motion
На Flash Memory Summit 2026 компания представила MonTitan SSD Reference Design Kit — не готовый накопитель, а референсную платформу для производителей корпоративных SSD. В её основе — архитектура PerformaShape второго поколения с аппаратной поддержкой «многомерного шейпинга» нагрузки: контроллер умеет гибко перераспределять ресурсы накопителя между разными потоками запросов в реальном времени.
- два контроллера — SM8366 на PCIe 5.0 и SM8466 на PCIe 6.0;
- формфакторы U.2, E1.L и E3.S — стандартные для серверов и СХД;
- заявленная ёмкость — до 256 терабайт на накопитель;
- интеграция с NVMe TP4176 — открытым API для управления качеством обслуживания.
Зачем SSD превращают в память для агентов
Автономные ИИ-агенты держат в памяти контекст диалога и промежуточные результаты — так называемый KV-кэш. Чем длиннее сессия и чем больше агентов работает параллельно, тем быстрее кэш выедает дорогую память ускорителя. MonTitan предлагает выгружать часть этого кэша на SSD, оставляя его «горячим» и доступным без пересчёта с нуля. Для инфраструктуры это новый уровень памяти между HBM ускорителя и обычным хранилищем — дешевле памяти GPU, но быстрее и постояннее, чем классический холодный SSD.
Практический эффект — меньше простаивающих ускорителей: часть данных, которая раньше требовала докупки GPU только ради объёма памяти, теперь можно держать на SSD-массиве. Для дата-центра с десятками параллельных ИИ-агентов это прямая экономия на самом дорогом компоненте стойки.
Что учесть: это референс, а не готовый диск
MonTitan — не серийный накопитель, а набор для инженеров производителей SSD. Реальные продукты на SM8366 и SM8466 появятся у партнёров Silicon Motion позже, и сроки компания не назвала. Заявленные цифры по задержке и выносливости — результат демонстраций на выставке, а не независимых тестов в промышленной эксплуатации. Прежде чем закладывать такую архитектуру в план закупок, стоит дождаться накопителей конкретных вендоров и их собственных цифр производительности под вашу нагрузку.
Мнение DigitalRazor
Выгружать KV-кэш на SSD вместо GPU-памяти — логичный ход, и рано или поздно это станет стандартом для инфраструктуры с десятками параллельных ИИ-агентов. Пока же перед нами референсный дизайн, а не серийный накопитель: закладывать его в проект закупок рано. Разумный шаг сейчас — планировать в стойке отдельный ярус NVMe-хранилища под кэш и следить, у кого из вендоров первым появятся готовые SSD на этих контроллерах.













