8 800 500-99-26 Для звонков по России
Ryzen AI Max+ 395: обзор процессора и серии
Рабочие станции
12 мин

Ryzen AI Max+ 395: обзор процессора и серии

DigitalRazor
DigitalRazor
Подписаться в Telegram
Содержание 11 разделов
Краткий ориентир Что такое Ryzen AI Max (Strix Halo) и чем он отличается от обычных мобильных чипов Производительность процессора: одноядерные и многоядерные тесты Графика Radeon 8060S Локальный ИИ-инференс: главная причина интереса к этому чипу в 2026 году Настройка под ИИ-задачи: Windows и Linux Strix Halo против DGX Spark, Mac Studio и дискретных видеокарт Стоит ли ждать Gorgon Halo (Ryzen AI Max PRO 400) Сколько стоит мини-ПК на Ryzen AI Max+ 395 и что выбрать FAQ: ответы на частые вопросы Заключение
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX

Подберём сервер под задачи

Ответьте на несколько вопросов — подготовим предложение

В этой статье расскажем про гибридный процессор Ryzen AI Max+ 395: характеристики, CPU- и GPU-тесты, измерения в токенах в секунду, настройка Windows 11 и Linux, цены и сравнение с DGX Spark, Mac Studio и RTX 5090. Если уже известны модель, длина контекста и нужная скорость ответа, пригодится отдельный гайд по выбору оборудования для локальной LLM.

Ryzen AI Max+ 395 не пытается заменить настольную видеокарту. Смысл Strix Halo в другом: 16-ядерный процессор Zen 5, Radeon 8060S и до 128 ГБ быстрой памяти собраны в компактной платформе. В системе со 128 ГБ для iGPU можно зарезервировать до 96 ГБ видеопамяти (VRAM), поэтому компьютер способен запускать квантизованные LLM, которые не помещаются в память массовых дискретных GPU.

Такая система закрывает сразу несколько ролей: рабочая станция для кода и монтажа, игровой ПК для 1080p и локальный узел инференса. Но универсальность не отменяет компромиссы. Скорость зависит от охлаждения, лимита мощности, драйвера, бэкенда и квантизации. А распаянную LPDDR5x нельзя увеличить после покупки.

Краткий ориентир

  • Для локального ИИ главную роль играют Radeon 8060S и большой общий пул памяти, а не NPU;
  • Для LLM 7B–30B дискретная видеокарта часто быстрее и проще;
  • Для 70B–120B конфигурация Strix Halo со 128 ГБ позволяет запускать квантизованные модели без нескольких дорогих GPU;
  • Для игр это уровень быстрых мобильных систем, а не замена настольной RTX 5090;
  • Покупать нужно готовое устройство с проверенным охлаждением, а не название чипа в спецификации.

Что такое Ryzen AI Max (Strix Halo) и чем он отличается от обычных мобильных чипов

Ryzen AI Max+ 395 объединяет CPU, iGPU, NPU и контроллер памяти на одной подложке. Процессор получил полноценные ядра Zen 5, а не компактные Zen 5c от некоторых мобильных APU. Частоты составляют 3,0–5,1 ГГц, общий кэш — 80 МБ. Графика Radeon 8060S содержит 40 вычислительных блоков RDNA 3.5 и работает на частоте до 2,9 ГГц.

Framework Desktop motherboard

Ryzen AI Max+ 395 объединяет CPU, графику и NPU в одной платформе

Блок XDNA 2 выдаёт до 50 TOPS и соответствует требованию Copilot+ PC к NPU — не менее 40 TOPS. Суммарно AMD заявляет до 126 TOPS для CPU, GPU и NPU. Однако эти показатели не описывают скорость LLM в LM Studio: языковую модель обычно считает Radeon 8060S через Vulkan или ROCm.

Ключевое отличие — унифицированная память. LPDDR5x-8000 подключена по 256-битной шине, что даёт 256 ГБ/с пропускной способности. CPU и iGPU работают с одним физическим пулом без копирования весов между системной RAM и VRAM дискретной видеокарты. Подробнее влияние ширины интерфейса разобрано в материале зачем видеокарте широкая шина памяти.

Общий пул не равен бесконечной VRAM. Windows, приложения и кэш тоже занимают гигабайты, а CPU и GPU делят одну полосу. В прикладных тестах пропускная способность для GPU обычно ниже теоретических 256 ГБ/с и зависит от устройства, режима питания и методики измерения.

По спецификации AMD номинальный TDP Ryzen AI Max+ 395 равен 55 Вт, настраиваемый диапазон cTDP — 45–120 Вт. Производители готовых систем могут задавать собственные профили мощности платформы, поэтому число в карточке устройства не всегда равно TDP процессора. Один и тот же чип в планшете и настольном корпусе показывает разные результаты.

Модель CPU и кэш Графика и NPU Память и TDP
Ryzen AI Max+ 395 16/32, 3,0–5,1 ГГц, 80 МБ Radeon 8060S, 40 CU; 50 TOPS До 128 ГБ LPDDR5x-8000; 45–120 Вт
Ryzen AI Max+ 392 12/24, 3,2–5,0 ГГц, 76 МБ Radeon 8060S, 40 CU; 50 TOPS До 128 ГБ LPDDR5x-8000; 45–120 Вт
Ryzen AI Max 390 12/24, 3,2–5,0 ГГц, 76 МБ Radeon 8050S, 32 CU; 50 TOPS До 128 ГБ LPDDR5x-8000; 45–120 Вт
Ryzen AI Max+ 388 8/16, 3,6–5,0 ГГц, 40 МБ Radeon 8060S, 40 CU; 50 TOPS До 128 ГБ LPDDR5x-8000; 45–120 Вт
Ryzen AI Max 385 8/16, 3,6–5,0 ГГц, 40 МБ Radeon 8050S, 32 CU; 50 TOPS До 128 ГБ LPDDR5x-8000; 45–120 Вт

У Max 390 сохраняется потолок в 128 ГБ, но меньше CPU-ядер и графических блоков. Для чистого инференса это может быть выгоднее: объём модели не меняется, а переплата за многопоток нужна не всегда. Max 385 интересен по той же логике, хотя Radeon 8050S ограничивает игры и GPU-вычисления сильнее.

Найдите станцию под ваши задачи

Готовые конфигурации для работы с большими массивами данных

Производительность процессора: одноядерные и многоядерные тесты

Для сравнения используем округлённые средние результаты Cinebench 2024 из базы Notebookcheck. У ASUS ROG Flow Z13 с 32 ГБ LPDDR5x-8000 в профиле Turbo CPU потребляет около 70 Вт и кратковременно доходит до 86 Вт. Это не настольная система со 120-ваттным режимом, но пример показывает поведение Strix Halo в корпусе с жёстким ограничением по охлаждению.

Тест Ryzen AI Max+ 395 в Cinebench 2024
Однопоточный тест
Многопоточный тест
Apple M4 Pro 14C
177
1 696
AMD Ryzen AI Max+ 395
115
1 791
AMD Ryzen 9 7945HX
113
1 739
0
180
360
540
720
900
1080
1260
1440
1620
1800

Score

Однопоточная производительность не сильнейшая сторона Ryzen AI Max+ 395. Интерфейс, браузер и часть игр не получают прямой выгоды от шестнадцати ядер. Многопоточный результат убедительнее: рендеринг, компиляция, кодирование видео и подготовка данных загружают чип целиком. Материал сколько ядер и кэша нужно процессору помогает отделить игровые требования от рабочих.

Важное замечание

У устройств на базе Ryzen AI Max+ 395 многопоточный результат лежит в диапазоне 1648–1912 баллов. На разброс влияют лимиты мощности, охлаждение, прошивка и режим работы. Поэтому лучше ориентироваться на длительный тест, а не лучший короткий прогон.

В целом Strix Halo близок к M4 Pro в многопотоке, но заметно уступает ему в одном потоке. Если основная работа — Blender, Premiere Pro или DaVinci Resolve, полезнее смотреть не один CPU-бенчмарк, а профиль приложения. У DigitalRazor есть отдельные гайды по ПК для Blender, компьютеру для Premiere Pro и станции для DaVinci Resolve.

Для монтажа, 3D и инженерных приложений компактность нужна не всегда. Если проекту важны дискретная RTX, расширяемая оперативная память и апгрейд, логичнее перейти к полноразмерной рабочей станции.

Если задачи помещаются в 32 ГБ видеопамяти, ПК с GeForce RTX 5090 даст заметно более высокую скорость в рендеринге, CUDA-приложениях и локальном инференсе. Это вариант для тех, кому важнее производительность, чем компактность и большой единый пул памяти.

[ PERFORMANCE PRO 350D ]
350D Tower
R7 9700X · RTX 5080 16ГБ · 64GB DDR5 RGB · 1 ТБ
463 500 ₽
34 763 ₽ / мес Примерный ежемесячный платёж. Итоговая сумма рассчитывается индивидуально.
Подробнее
350D Tower
i9-14900K · RTX 5090 32ГБ · 64GB DDR5 RGB · 1 ТБ
938 000 ₽
70 350 ₽ / мес Примерный ежемесячный платёж. Итоговая сумма рассчитывается индивидуально.
Подробнее
350D Tower
R9 9950X · RTX 5090 32ГБ · 64GB DDR5 RGB · 1 ТБ NVME 5.0
1 037 500 ₽
77 813 ₽ / мес Примерный ежемесячный платёж. Итоговая сумма рассчитывается индивидуально.
Подробнее

Графика Radeon 8060S

Radeon 8060S — одна из самых производительных встроенных графических систем своего поколения. Однако называть её прямой заменой RTX 4070 некорректно: мобильная RTX 4070 работает с разными лимитами мощности, поэтому результаты разных ноутбуков заметно различаются.

Тест Radeon 8060S в 3DMark Time Spy Graphics
Radeon 8060S, ROG Flow Z13
10 224
RTX 4070 Laptop (65 Вт)
9 513
RTX 4070 Laptop (75 Вт)
10 693
RTX 4070 Laptop (140 Вт)
13 215
0
2640
5280
7920
10560
13200

Score

В играх Radeon 8060S уверенно работает в Full HD, но тяжёлая трассировка лучей и максимальные настройки в 1440p требуют FSR или снижения качества.

Для корректного сравнения взяты два устройства одной серии в режиме Turbo:

  • Radeon 8060S — ASUS ROG Flow Z13 с Ryzen AI Max+ 395;
  • RTX 4070 Laptop — ASUS ROG Flow Z13 ACRNM с TGP 65 Вт.

Все значения — средний FPS в нативном разрешении без апскейлинга. В каждой игре для обоих устройств использован один и тот же пресет Notebookcheck.

Тест Radeon 8060S в играх, 1080p
Radeon 8060S
RTX 4070 Laptop, 65 Вт
Cyberpunk 2077
76
67
Baldur’s Gate 3
85
86
GTA V
74
95
Horizon Forbidden West
49
56
F1 24
46
58
Black Myth: Wukong
27
25
God of War Ragnarök
76
76
Call of Duty: Black Ops 6
83
71
Ghost of Tsushima
51
55
Monster Hunter Wilds
39
40
Indiana Jones and the Great Circle
40
39
Star Wars Outlaws
33
35
0
19
38
57
76
95

FPS

Тест Radeon 8060S в играх, 1440p
Radeon 8060S
RTX 4070 Laptop, 65 Вт
Cyberpunk 2077
46
40
Baldur’s Gate 3
55
62
GTA V
64
76
Horizon Forbidden West
38
46
F1 24
29
37
Black Myth: Wukong
20
18
God of War Ragnarök
58
61
Call of Duty: Black Ops 6
64
52
Ghost of Tsushima
40
44
Monster Hunter Wilds
29
29
Star Wars Outlaws
23
26
0
19
38
57
76

FPS

В 1080p видеокарты в целом близки. Radeon 8060S заметно быстрее в Cyberpunk 2077 и Call of Duty: Black Ops 6, а RTX 4070 Laptop лидирует в GTA V, Horizon Forbidden West и F1 24.

У встроенной графики есть и рабочая роль: аппаратное кодирование H.264, H.265 и AV1, ускорение интерфейса и часть вычислений. Но CUDA-приложения на Radeon не заработают автоматически. Перед покупкой проверьте нужный движок и плагины; общий подход разобран в статье как выбрать видеокарту в 2026 году.

Локальный ИИ-инференс: главная причина интереса к этому чипу в 2026 году

Главное преимущество Ryzen AI Max+ 395 — не 126 TOPS, а объём памяти, доступный Radeon 8060S. В системе со 128 ГБ через Variable Graphics Memory можно закрепить до 96 ГБ как VRAM. Суммарно графика адресует до 112 ГБ, но этот потолок нельзя целиком занять весами нейронок: место требуется ОС, рантайму, KV-кэшу и рабочим приложениям.

Ryzen AI Max+ 395 на Framework Desktop

Чип Ryzen AI Max+ 395 на Framework Desktop

Для Framework Desktop AMD опубликовала Linux-настройку, которая увеличивает GTT-пул драйвера до 120 ГБ через параметры TTM. Это не 120 ГБ выделенной VRAM и не универсальная настройка: результат зависит от ядра, драйвера и параметров загрузки. Для устойчивого сервиса нужно оставить память операционной системе и приложениям.

Квантизация уменьшает объём весов: Q4 использует около четырёх бит на вес, а BF16 — 16 бит, поэтому до учёта служебных данных разница составляет примерно четыре раза. MXFP4 оптимизирован для поддерживаемых моделей. Архитектура тоже влияет на скорость: смесь экспертов (Mixture of Experts, MoE) активирует лишь часть параметров для каждого токена. Поэтому gpt-oss-120B может отвечать быстрее плотной Llama 70B, хотя у gpt-oss-120B больше параметров.

Ниже — результаты одного тестового набора на Radeon 8060S через Vulkan и llama.cpp: промпт на 512 токенов, генерация 128 токенов, шесть потоков CPU и максимальный перенос слоёв на iGPU. Автор теста не указал версии ОС и драйвера, а также лимит мощности, поэтому цифры служат ориентиром, а не гарантией для любого устройства.

Модель Параметры и квантизация Размер Генерация, токенов/с
Llama 3.2 3B 3B Q4_K_XL 1.9 ГБ 93
gpt-oss-20B 20B MXFP4, MoE 11.3 ГБ 77
gpt-oss-120B 120B MXFP4, MoE 59.0 ГБ 54
Qwen3-Coder-30B-A3B — MoE 30,5B / 3,3B active, BF16 56.9 ГБ 9.2
Llama 3.3 70B 70B Q4_K_XL 39.7 ГБ 5.1
Mistral-Large-2411 123B Q4_K_M 64.2 ГБ 3.0

Для чата 5 токенов/с терпимы, но длинный ответ приходится ждать. Скорость 50–90 токенов/с воспринимается как мгновенная, хотя обработка большого промпта остаётся отдельной стадией. При выборе LLM сравнивайте скорость генерации и обработки промпта, длину контекста и качество квантизации.

В другом воспроизводимом тесте Ryzen AI Max+ 395 с Ubuntu 25.10, ядром 6.17, ROCm 7.2.0 и llama.cpp b8280 показал 51,1 токена/с на gpt-oss-120B MXFP4, 69,6 на Qwen3-Coder 30B MoE Q4 и 3,8 на Llama 3.3 70B Q6. Qwen3 235B в Q3 заняла 104,7 ГБ; на GPU перенесли 80 из 95 слоёв, скорость составила 7,8 токена/с. Модель запускается, но этот режим нельзя считать универсально быстрым.

Для первого знакомства пригодятся обзор локальных моделей 2026 года и инструкция как запустить GPT-OSS локально. Там проще подобрать размер до покупки железа.

Если нужен один компактный компьютер для локальных моделей и повседневных x86-программ, подойдёт AI-станция DigitalRazor на Ryzen AI Max+ 395. Конфигурация со 128 ГБ памяти рассчитана на сценарии, в которых 32 ГБ VRAM дискретной видеокарты уже недостаточно.

Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Radeon 8060S
Объем видеопамяти 64 ГБ
Процессоры
Ryzen AI Max+ 395
Количество ядер 16 Zen 5
RAM Объединена с VRAM
Форм-фактор SFF
Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Radeon 8060S
Объем видеопамяти 64 ГБ
Процессоры
Ryzen AI Max+ 395
Количество ядер 16 Zen 5
RAM Объединена с VRAM
Форм-фактор SFF

Настройка под ИИ-задачи: Windows и Linux

Windows 11: самый короткий путь к первой модели

Windows подходит для локального чата, RAG, генерации изображений и обычной работы на той же машине. Начните с Vulkan: он широко поддерживается и не требует собирать весь ROCm-стек. Установите свежую версию AMD Software: Adrenalin Edition, затем задайте Variable Graphics Memory.

  1. Откройте AMD Software: Adrenalin Edition и найдите настройку VGM.
  2. На системе со 128 ГБ сначала задайте VGM 64 ГБ.
  3. Для LLM, которой тесно, переключитесь на 96 ГБ и перезагрузите компьютер.
  4. Установите LM Studio или соберите llama.cpp с Vulkan.
  5. Проверьте число слоёв, перенесённых на GPU, размер контекста и фактическую скорость генерации.
Variable Graphics Memory

Объём памяти для встроенной графики меняется в AMD Software

ROCm 7.2.1 официально поддерживает Ryzen AI Max+ 395 в Windows 11 с PyTorch 2.9.1, Python 3.12 и FP16. Но в production-ветке ROCm 7.2.1 на Windows действуют следующие ограничения: обучение не поддерживается, модуль torch.distributed недоступен, а для LLM заявлен только размер пакета 1. Поэтому ROCm полезен для совместимых PyTorch-приложений, но не заменяет Vulkan во всех программах.

Linux: больше контроля, больше ручной работы

Linux выбирают для серверного инференса, контейнеров и более полного стека ROCm. Совместимость vLLM и других серверных движков нужно проверять для конкретной версии и бэкенда. Платформа чувствительна к версии ядра, amdgpu, прошивке, Secure Boot и сборке приложения.

AMD Ryzen AI Developer Center

В Linux память настраивается через AMD Ryzen AI Developer Center

  1. Сверьте дистрибутив, ядро и ROCm с текущей матрицей совместимости.
  2. Обновите прошивку и драйвер, затем проверьте стабильность под длительной нагрузкой.
  3. Запустите маленькую модель и убедитесь, что вычисления идут на GPU, а не на CPU.
  4. Зафиксируйте версию llama.cpp, квантизацию, контекст, размер пакета, лимит мощности и температуры.
  5. Увеличивайте размер модели и выделенную память по одному параметру за тест.
Сценарий Windows 11 Linux Что выбрать
Быстрый запуск GGUF LM Studio, Vulkan llama.cpp, Vulkan Windows проще
PyTorch-инференс ROCm с ограничениями более полный ROCm Linux гибче
Дообучение не основной сценарий зависит от стеказависит от стека Linux или NVIDIA
Ежедневная рабочая станция широкий x86-софт требует настройки зависит от приложений

Не начинайте тест с максимального контекста. KV-кэш растёт вместе с диалогом и способен занять десятки гигабайт поверх весов. Хорошая методика проста: один и тот же промпт, одинаковое число генерируемых токенов, прогрев, три повтора и среднее значение.

Нужна помощь с выбором?

Специалисты помогут подобрать оборудование под нагрузку, бюджет и задачи

Написать

Strix Halo против DGX Spark, Mac Studio и дискретных видеокарт

Ryzen AI Max+ 395 силён там, где модель не помещается в 32 ГБ VRAM, а отдельный сервер избыточен. DGX Spark предлагает CUDA и готовую среду. Mac Studio берёт пропускной способностью памяти и MLX. RTX 5090 намного быстрее для подходящих моделей, но её 32 ГБ быстро становятся потолком.

Платформа Память и полоса Цена в России Сильный сценарий
Ryzen AI Max+ 395, 128 ГБ 96 ГБ VGM; 256 ГБ/с 395 000–486 000 ₽ за готовый мини-ПК 70B–120B, Windows/x86
NVIDIA DGX Spark 128 ГБ; 273 ГБ/с 575 000–710 000 ₽ CUDA, разработка, дообучение
Mac Studio M3 Ultra от 96 ГБ; более 800 ГБ/с от 599 990 ₽ за версию 96 ГБ / 1 ТБ MLX, Metal, macOS
GeForce RTX 5090 32 ГБ GDDR7; 1792 ГБ/с 500 000–565 000 ₽ только за видеокарту CUDA, 4K, модели до 32 ГБ

Цифры нельзя превращать в общий рейтинг. Теоретическая пропускная способность памяти RTX 5090 ровно в семь раз выше, но Llama 70B Q4 обычно не помещается целиком в 32 ГБ. Strix Halo вмещает крупную модель, однако генерирует плотные 70B со скоростью около 3–5 токенов/с. Mac Studio требует macOS, а DGX Spark использует Arm и не заменяет обычный Windows-ПК во всех программах.

Подробности о платформах собраны в обзоре NVIDIA DGX Spark, рейтинге видеокарт для ИИ и сравнении игровых и профессиональных GPU для LLM. Для RTX 5090 есть отдельный обзор флагманской видеокарты.

Если рабочий процесс завязан на CUDA, PyTorch и программное окружение NVIDIA, вместо универсального x86-ПК можно выбрать DGX Spark. Система подходит для локальной разработки и инференса моделей, которым тесно в памяти одной потребительской видеокарты.

Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Grace Blackwell
Объем видеопамяти 128 ГБ
Процессоры
NVIDIA GB10
Количество ядер 20 Arm
RAM Объединена с VRAM
Форм-фактор SFF
Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Grace Blackwell
Объем видеопамяти 128 ГБ
Процессоры
NVIDIA GB10
Количество ядер 20 Arm
RAM Объединена с VRAM
Форм-фактор SFF
Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Grace Blackwell
Объем видеопамяти 128 ГБ
Процессоры
NVIDIA GB10
Количество ядер 20 Arm
RAM Объединена с VRAM
Форм-фактор SFF

Стоит ли ждать Gorgon Halo (Ryzen AI Max PRO 400)

Gorgon Halo — семейство Ryzen AI Max PRO 400. Старшая модель Ryzen AI Max+ PRO 495 сохранит 16 ядер, 32 потока и 40 CU у видеоядра, но частота CPU поднимется до 5,2 ГГц, Radeon 8065S — до 3,0 ГГц, а NPU — до 55 TOPS. Главная перемена — до 192 ГБ единой памяти и до 160 ГБ, выделяемых графике.

Характеристика Ryzen AI Max+ 395 Ryzen AI Max+ PRO 495 Изменение
Максимальная память 128 ГБ 192 ГБ +50%
Память для GPU до 96 ГБ VGM до 160 ГБ +67%
Скорость LPDDR5x 8000 МТ/с 8533 МТ/с +6,7%
Частота iGPU 2,9 ГГц 3,0 ГГц +3,4%

LPDDR5x-8533 повышает теоретическую пропускную способность примерно до 273 ГБ/с против 256 ГБ/с, то есть на 6,7%; частоты CPU, GPU и NPU тоже немного выросли. Но независимых тестов пока недостаточно, чтобы оценить ускорение LLM. Главный выигрыш — ёмкость: модель на 140–150 ГБ может поместиться, тогда как Strix Halo со 128 ГБ её не удержит.

Модель CPU и кэш Графика и NPU Память и TDP
Ryzen AI Max+ PRO 495 16/32, 3,1–5,2 ГГц, 80 МБ Radeon 8065S, 40 CU; 55 TOPS До 192 ГБ LPDDR5x-8533; 45–120 Вт
Ryzen AI Max PRO 490 12/24, 3,2–5,0 ГГц, 76 МБ Radeon 8050S, 32 CU; 50 TOPS До 192 ГБ LPDDR5x-8533; 45–120 Вт
Ryzen AI Max PRO 485 8/16, 3,6–5,0 ГГц, 40 МБ Radeon 8050S, 32 CU; 50 TOPS До 192 ГБ LPDDR5x-8533; 45–120 Вт

AMD запланировала первые системы HP и Lenovo на третий квартал 2026 года. На 18 августа официальная страница процессора опубликована, но независимых тестов и стабильных розничных цен готовых конфигураций ещё мало. Ждать разумно ради 160 ГБ памяти для GPU и, по заявлению AMD, моделей на 300B+ в 4-битной квантизации, а не ради неподтверждённого прироста скорости.

Сколько стоит мини-ПК на Ryzen AI Max+ 395 и что выбрать

Цены нужно сравнивать при одинаковых объёмах памяти и SSD. На август 2026 года официальные магазины США показывали ACEMAGIC M1A Pro+ 128 ГБ + 2 ТБ за 3099 долларов и GMKtec EVO-X3 в той же конфигурации за 3799,99 долларов. У DigitalRazor компактная станция MS-S1 MAX стоит от 360 000 рублей за 64 ГБ и от 660 000 рублей за 128 ГБ; наличие старшей версии нужно уточнять перед заказом.

Система Память / SSD Цена на 18.08.2026 Что проверить
Minisforum MS-S1 MAX 64 ГБ / 2 ТБ от 360 000 ₽ хватает ли 48 ГБ VGM
Minisforum MS-S1 MAX 128 ГБ / 2 ТБ от 660 000 ₽ наличие и срок поставки
ACEMAGIC M1A Pro+ 128 ГБ / 2 ТБ 3099 $ регион, гарантия, акция
GMKtec EVO-X3 128 ГБ / 2 ТБ 3799,99 $ OCuLink, профиль мощности

Выбирать нужно в таком порядке:

  1. Определить размер весов, KV-кэша и запас под ОС.
  2. Для 7B–35B сравнить стоимость с ПК на дискретной RTX.
  3. Для 70B–120B, особенно с большим контекстом, выбирать 128 ГБ; 70B Q4 может поместиться и в 64 ГБ, но запас будет меньше.
  4. Проверить стабильный лимит мощности, уровень шума через 20 минут и температуру SSD.
  5. Для eGPU искать OCuLink или доступный PCIe, а не рассчитывать только на USB4.
  6. Сверить гарантию, сервис и готовность окружения под Windows или Linux.

Если модель, контекст и число одновременных пользователей известны, полезнее протестировать их до покупки. DigitalRazor поможет подготовить систему, запустить нагрузку и показать скорость, занятую память и температуры на реальном сценарии.

Для каких задач Компактный GPU-сервер до 2 видеокарт для начальных задач в AI и графике. Оптимален для инференса, визуализации, VFX и рендеринга в студиях и лабораториях, где важна гибкость.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 282 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 4.5U
Для каких задач Универсальная платформа на 4–6 GPU для локального обучения моделей и генеративных задач. Подходит для команд, которым важна надёжность сервера и свобода выбора графики — от RTX 5090 до PRO RTX 6000.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 576 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 6.5U
Для каких задач Сервер промышленного уровня на 8 GPU с кластерной архитектурой. Предназначен для дата-центров и AI-ферм, где требуется масштабируемость и полная загрузка ресурсов под обучение LLM и R&D.
Подробнее
Видеокарты
RTX PRO 6000 / RTX 5090
Объем видеопамяти до 768 ГБ
Процессоры
AMD Epyc, Intel Xeon
Количество ядер до 320
RAM до 3072 ГБ DDR5
Форм-фактор 6U
Для каких задач Серия серверов для кластеризации на 4 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 564 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 128
RAM до 1536 ГБ DDR5
Форм-фактор 2U
Для каких задач Серия серверов для кластеризации на 8 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 4U
Для каких задач HGX объединяет 8 видеокарт NVIDIA H200, достигая экстремальной плотности производительности. Благодаря внутренней связности NVSwitch мгновенно интегрируется в масштабные вычислительные кластеры.
Подробнее
Видеокарты
NVIDIA H200 SXM
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 5U

FAQ: ответы на частые вопросы

1. Ryzen AI Max+ 395 — это процессор для ноутбука или для мини-ПК?
Для обоих форматов. Чип относится к мобильной платформе, но используется в мини-ПК и рабочих станциях. Настольный корпус обычно дольше поддерживает высокий лимит мощности и обеспечивает более высокую производительность.
2. Сколько памяти реально доступно видеокарте на Ryzen AI Max+ 395?
В системе со 128 ГБ Windows позволяет закрепить до 96 ГБ VGM, а всего GPU адресует до 112 ГБ. Часть памяти всегда нужна ОС, приложениям и KV-кэшу.
3. Подходит ли Ryzen AI Max+ 395 для игр в 2026 году?
Да, для 1080p и части игр в 1440p с FSR. Radeon 8060S близка к RTX 4070 Laptop на 65–75 Вт, но слабее 140-ваттной версии и настольных GPU.
4. Какую самую большую нейросеть можно запустить на этом чипе?
AMD заявляет до 235B в Q4 на системе со 128 ГБ. В тесте Qwen3 235B Q3 заняла 104,7 ГБ, на GPU перенесли 80 из 95 слоёв, скорость составила 7,8 токена/с.
5. Стоит ли ждать Ryzen AI Max PRO 400 (Gorgon Halo) вместо покупки сейчас?
Ждать стоит ради 192 ГБ общей и до 160 ГБ графической памяти. Теоретическая пропускная способность вырастет на 6,7%, но без независимых тестов обещать заметное ускорение уже помещающейся LLM нельзя.
6. Чем Ryzen AI Max+ 395 отличается от младших Ryzen AI Max 390 и 385?
У 395 — 16 CPU-ядер и 40 CU, у 390 — 12 и 32 CU, у 385 — восемь и 32 CU. Все три модели поддерживают до 128 ГБ памяти и оснащены NPU производительностью до 50 TOPS.

Заключение

Ryzen AI Max+ 395 — компактная платформа для случаев, когда обычной видеокарте не хватает VRAM, а большой GPU-сервер пока избыточен. Чип совмещает быстрый многопоточный CPU, графику уровня маломощной RTX 4070 Laptop и до 128 ГБ единой памяти. На одной машине можно писать код, монтировать, играть и запускать квантизованные модели на 70B–120B.

Компромиссы заметны. Плотные LLM на 70B+ работают медленно, LPDDR5x распаяна, а результат сильно зависит от корпуса и программного стека. RTX 5090 быстрее, когда модель помещается в 32 ГБ, и удобнее для CUDA-задач. DGX Spark предлагает готовую NVIDIA-экосистему, а Mac Studio лучше подходит тем, кто работает в MLX и macOS.

Перед покупкой зафиксируйте четыре числа: размер модели, KV-кэш, требуемые токены в секунду и бюджет всей системы. Затем проверьте бэкенд, лимит мощности, шум и гарантию. Gorgon Halo стоит ждать, если проект действительно упирается в 96–112 ГБ, а не ради обещания абстрактной «новизны».

Для каких задач Серия серверов для кластеризации на 4 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 564 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 128
RAM до 1536 ГБ DDR5
Форм-фактор 2U
Для каких задач Серия серверов для кластеризации на 8 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 4U
Для каких задач HGX объединяет 8 видеокарт NVIDIA H200, достигая экстремальной плотности производительности. Благодаря внутренней связности NVSwitch мгновенно интегрируется в масштабные вычислительные кластеры.
Подробнее
Видеокарты
NVIDIA H200 SXM
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 5U
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX
518

Так же будет интересно почитать

Выбираем компьютер для работы в Blender
Олег Олегович Олег Олегович
Статьи
Выбираем компьютер для работы в Blender

Blender полюбился многим за стабильное развитие и техническую поддержку. Спектр возможностей у приложения широкий: от визуализации до монтажа и рендеринга. Поэтому выбор оптимального компьютера вызывает вопросы. В продолжении цикла статей разберем системные требования и ответим, какую графическую станцию выбрать для комфортной работы.

4 мин
74.7К
Процессоры AMD Ryzen X3D в рабочих задачах
Олег Олегович Олег Олегович
Статьи
Процессоры AMD Ryzen X3D в рабочих задачах

В этом материале расскажем, почему постулат «Ryzen X3D предназначены только для игр» можно считать устаревшим. Почему Ryzen 9900X3D и 9950X3D — не просто какие-то странные процессоры, а очень любопытное гибридное решение. Вариант для тех, кто использует компьютер не только для игр, но и для работы.

9 мин
68.9К

Сайт использует cookies
Узнать подробнее