
Ryzen AI Max+ 395: обзор процессора и серии
Подберём сервер под задачи
Ответьте на несколько вопросов — подготовим предложение
В этой статье расскажем про гибридный процессор Ryzen AI Max+ 395: характеристики, CPU- и GPU-тесты, измерения в токенах в секунду, настройка Windows 11 и Linux, цены и сравнение с DGX Spark, Mac Studio и RTX 5090. Если уже известны модель, длина контекста и нужная скорость ответа, пригодится отдельный гайд по выбору оборудования для локальной LLM.
Ryzen AI Max+ 395 не пытается заменить настольную видеокарту. Смысл Strix Halo в другом: 16-ядерный процессор Zen 5, Radeon 8060S и до 128 ГБ быстрой памяти собраны в компактной платформе. В системе со 128 ГБ для iGPU можно зарезервировать до 96 ГБ видеопамяти (VRAM), поэтому компьютер способен запускать квантизованные LLM, которые не помещаются в память массовых дискретных GPU.
Такая система закрывает сразу несколько ролей: рабочая станция для кода и монтажа, игровой ПК для 1080p и локальный узел инференса. Но универсальность не отменяет компромиссы. Скорость зависит от охлаждения, лимита мощности, драйвера, бэкенда и квантизации. А распаянную LPDDR5x нельзя увеличить после покупки.
Краткий ориентир
- Для локального ИИ главную роль играют Radeon 8060S и большой общий пул памяти, а не NPU;
- Для LLM 7B–30B дискретная видеокарта часто быстрее и проще;
- Для 70B–120B конфигурация Strix Halo со 128 ГБ позволяет запускать квантизованные модели без нескольких дорогих GPU;
- Для игр это уровень быстрых мобильных систем, а не замена настольной RTX 5090;
- Покупать нужно готовое устройство с проверенным охлаждением, а не название чипа в спецификации.
Что такое Ryzen AI Max (Strix Halo) и чем он отличается от обычных мобильных чипов
Ryzen AI Max+ 395 объединяет CPU, iGPU, NPU и контроллер памяти на одной подложке. Процессор получил полноценные ядра Zen 5, а не компактные Zen 5c от некоторых мобильных APU. Частоты составляют 3,0–5,1 ГГц, общий кэш — 80 МБ. Графика Radeon 8060S содержит 40 вычислительных блоков RDNA 3.5 и работает на частоте до 2,9 ГГц.
Ryzen AI Max+ 395 объединяет CPU, графику и NPU в одной платформе
Блок XDNA 2 выдаёт до 50 TOPS и соответствует требованию Copilot+ PC к NPU — не менее 40 TOPS. Суммарно AMD заявляет до 126 TOPS для CPU, GPU и NPU. Однако эти показатели не описывают скорость LLM в LM Studio: языковую модель обычно считает Radeon 8060S через Vulkan или ROCm.
Ключевое отличие — унифицированная память. LPDDR5x-8000 подключена по 256-битной шине, что даёт 256 ГБ/с пропускной способности. CPU и iGPU работают с одним физическим пулом без копирования весов между системной RAM и VRAM дискретной видеокарты. Подробнее влияние ширины интерфейса разобрано в материале зачем видеокарте широкая шина памяти.
Общий пул не равен бесконечной VRAM. Windows, приложения и кэш тоже занимают гигабайты, а CPU и GPU делят одну полосу. В прикладных тестах пропускная способность для GPU обычно ниже теоретических 256 ГБ/с и зависит от устройства, режима питания и методики измерения.
По спецификации AMD номинальный TDP Ryzen AI Max+ 395 равен 55 Вт, настраиваемый диапазон cTDP — 45–120 Вт. Производители готовых систем могут задавать собственные профили мощности платформы, поэтому число в карточке устройства не всегда равно TDP процессора. Один и тот же чип в планшете и настольном корпусе показывает разные результаты.
| Модель | CPU и кэш | Графика и NPU | Память и TDP |
|---|---|---|---|
| Ryzen AI Max+ 395 | 16/32, 3,0–5,1 ГГц, 80 МБ | Radeon 8060S, 40 CU; 50 TOPS | До 128 ГБ LPDDR5x-8000; 45–120 Вт |
| Ryzen AI Max+ 392 | 12/24, 3,2–5,0 ГГц, 76 МБ | Radeon 8060S, 40 CU; 50 TOPS | До 128 ГБ LPDDR5x-8000; 45–120 Вт |
| Ryzen AI Max 390 | 12/24, 3,2–5,0 ГГц, 76 МБ | Radeon 8050S, 32 CU; 50 TOPS | До 128 ГБ LPDDR5x-8000; 45–120 Вт |
| Ryzen AI Max+ 388 | 8/16, 3,6–5,0 ГГц, 40 МБ | Radeon 8060S, 40 CU; 50 TOPS | До 128 ГБ LPDDR5x-8000; 45–120 Вт |
| Ryzen AI Max 385 | 8/16, 3,6–5,0 ГГц, 40 МБ | Radeon 8050S, 32 CU; 50 TOPS | До 128 ГБ LPDDR5x-8000; 45–120 Вт |
У Max 390 сохраняется потолок в 128 ГБ, но меньше CPU-ядер и графических блоков. Для чистого инференса это может быть выгоднее: объём модели не меняется, а переплата за многопоток нужна не всегда. Max 385 интересен по той же логике, хотя Radeon 8050S ограничивает игры и GPU-вычисления сильнее.
Найдите станцию под ваши задачи
Готовые конфигурации для работы с большими массивами данных
Производительность процессора: одноядерные и многоядерные тесты
Для сравнения используем округлённые средние результаты Cinebench 2024 из базы Notebookcheck. У ASUS ROG Flow Z13 с 32 ГБ LPDDR5x-8000 в профиле Turbo CPU потребляет около 70 Вт и кратковременно доходит до 86 Вт. Это не настольная система со 120-ваттным режимом, но пример показывает поведение Strix Halo в корпусе с жёстким ограничением по охлаждению.
Score
Однопоточная производительность не сильнейшая сторона Ryzen AI Max+ 395. Интерфейс, браузер и часть игр не получают прямой выгоды от шестнадцати ядер. Многопоточный результат убедительнее: рендеринг, компиляция, кодирование видео и подготовка данных загружают чип целиком. Материал сколько ядер и кэша нужно процессору помогает отделить игровые требования от рабочих.
Важное замечание
У устройств на базе Ryzen AI Max+ 395 многопоточный результат лежит в диапазоне 1648–1912 баллов. На разброс влияют лимиты мощности, охлаждение, прошивка и режим работы. Поэтому лучше ориентироваться на длительный тест, а не лучший короткий прогон.
В целом Strix Halo близок к M4 Pro в многопотоке, но заметно уступает ему в одном потоке. Если основная работа — Blender, Premiere Pro или DaVinci Resolve, полезнее смотреть не один CPU-бенчмарк, а профиль приложения. У DigitalRazor есть отдельные гайды по ПК для Blender, компьютеру для Premiere Pro и станции для DaVinci Resolve.
Для монтажа, 3D и инженерных приложений компактность нужна не всегда. Если проекту важны дискретная RTX, расширяемая оперативная память и апгрейд, логичнее перейти к полноразмерной рабочей станции.
Если задачи помещаются в 32 ГБ видеопамяти, ПК с GeForce RTX 5090 даст заметно более высокую скорость в рендеринге, CUDA-приложениях и локальном инференсе. Это вариант для тех, кому важнее производительность, чем компактность и большой единый пул памяти.
Графика Radeon 8060S
Radeon 8060S — одна из самых производительных встроенных графических систем своего поколения. Однако называть её прямой заменой RTX 4070 некорректно: мобильная RTX 4070 работает с разными лимитами мощности, поэтому результаты разных ноутбуков заметно различаются.
Score
В играх Radeon 8060S уверенно работает в Full HD, но тяжёлая трассировка лучей и максимальные настройки в 1440p требуют FSR или снижения качества.
Для корректного сравнения взяты два устройства одной серии в режиме Turbo:
- Radeon 8060S — ASUS ROG Flow Z13 с Ryzen AI Max+ 395;
- RTX 4070 Laptop — ASUS ROG Flow Z13 ACRNM с TGP 65 Вт.
Все значения — средний FPS в нативном разрешении без апскейлинга. В каждой игре для обоих устройств использован один и тот же пресет Notebookcheck.
FPS
FPS
В 1080p видеокарты в целом близки. Radeon 8060S заметно быстрее в Cyberpunk 2077 и Call of Duty: Black Ops 6, а RTX 4070 Laptop лидирует в GTA V, Horizon Forbidden West и F1 24.
У встроенной графики есть и рабочая роль: аппаратное кодирование H.264, H.265 и AV1, ускорение интерфейса и часть вычислений. Но CUDA-приложения на Radeon не заработают автоматически. Перед покупкой проверьте нужный движок и плагины; общий подход разобран в статье как выбрать видеокарту в 2026 году.
Локальный ИИ-инференс: главная причина интереса к этому чипу в 2026 году
Главное преимущество Ryzen AI Max+ 395 — не 126 TOPS, а объём памяти, доступный Radeon 8060S. В системе со 128 ГБ через Variable Graphics Memory можно закрепить до 96 ГБ как VRAM. Суммарно графика адресует до 112 ГБ, но этот потолок нельзя целиком занять весами нейронок: место требуется ОС, рантайму, KV-кэшу и рабочим приложениям.
Чип Ryzen AI Max+ 395 на Framework Desktop
Для Framework Desktop AMD опубликовала Linux-настройку, которая увеличивает GTT-пул драйвера до 120 ГБ через параметры TTM. Это не 120 ГБ выделенной VRAM и не универсальная настройка: результат зависит от ядра, драйвера и параметров загрузки. Для устойчивого сервиса нужно оставить память операционной системе и приложениям.
Квантизация уменьшает объём весов: Q4 использует около четырёх бит на вес, а BF16 — 16 бит, поэтому до учёта служебных данных разница составляет примерно четыре раза. MXFP4 оптимизирован для поддерживаемых моделей. Архитектура тоже влияет на скорость: смесь экспертов (Mixture of Experts, MoE) активирует лишь часть параметров для каждого токена. Поэтому gpt-oss-120B может отвечать быстрее плотной Llama 70B, хотя у gpt-oss-120B больше параметров.
Ниже — результаты одного тестового набора на Radeon 8060S через Vulkan и llama.cpp: промпт на 512 токенов, генерация 128 токенов, шесть потоков CPU и максимальный перенос слоёв на iGPU. Автор теста не указал версии ОС и драйвера, а также лимит мощности, поэтому цифры служат ориентиром, а не гарантией для любого устройства.
| Модель | Параметры и квантизация | Размер | Генерация, токенов/с |
|---|---|---|---|
| Llama 3.2 3B | 3B Q4_K_XL | 1.9 ГБ | 93 |
| gpt-oss-20B | 20B MXFP4, MoE | 11.3 ГБ | 77 |
| gpt-oss-120B | 120B MXFP4, MoE | 59.0 ГБ | 54 |
| Qwen3-Coder-30B-A3B — MoE | 30,5B / 3,3B active, BF16 | 56.9 ГБ | 9.2 |
| Llama 3.3 70B | 70B Q4_K_XL | 39.7 ГБ | 5.1 |
| Mistral-Large-2411 | 123B Q4_K_M | 64.2 ГБ | 3.0 |
Для чата 5 токенов/с терпимы, но длинный ответ приходится ждать. Скорость 50–90 токенов/с воспринимается как мгновенная, хотя обработка большого промпта остаётся отдельной стадией. При выборе LLM сравнивайте скорость генерации и обработки промпта, длину контекста и качество квантизации.
В другом воспроизводимом тесте Ryzen AI Max+ 395 с Ubuntu 25.10, ядром 6.17, ROCm 7.2.0 и llama.cpp b8280 показал 51,1 токена/с на gpt-oss-120B MXFP4, 69,6 на Qwen3-Coder 30B MoE Q4 и 3,8 на Llama 3.3 70B Q6. Qwen3 235B в Q3 заняла 104,7 ГБ; на GPU перенесли 80 из 95 слоёв, скорость составила 7,8 токена/с. Модель запускается, но этот режим нельзя считать универсально быстрым.
Для первого знакомства пригодятся обзор локальных моделей 2026 года и инструкция как запустить GPT-OSS локально. Там проще подобрать размер до покупки железа.
Если нужен один компактный компьютер для локальных моделей и повседневных x86-программ, подойдёт AI-станция DigitalRazor на Ryzen AI Max+ 395. Конфигурация со 128 ГБ памяти рассчитана на сценарии, в которых 32 ГБ VRAM дискретной видеокарты уже недостаточно.
Настройка под ИИ-задачи: Windows и Linux
Windows 11: самый короткий путь к первой модели
Windows подходит для локального чата, RAG, генерации изображений и обычной работы на той же машине. Начните с Vulkan: он широко поддерживается и не требует собирать весь ROCm-стек. Установите свежую версию AMD Software: Adrenalin Edition, затем задайте Variable Graphics Memory.
- Откройте AMD Software: Adrenalin Edition и найдите настройку VGM.
- На системе со 128 ГБ сначала задайте VGM 64 ГБ.
- Для LLM, которой тесно, переключитесь на 96 ГБ и перезагрузите компьютер.
- Установите LM Studio или соберите llama.cpp с Vulkan.
- Проверьте число слоёв, перенесённых на GPU, размер контекста и фактическую скорость генерации.
Объём памяти для встроенной графики меняется в AMD Software
ROCm 7.2.1 официально поддерживает Ryzen AI Max+ 395 в Windows 11 с PyTorch 2.9.1, Python 3.12 и FP16. Но в production-ветке ROCm 7.2.1 на Windows действуют следующие ограничения: обучение не поддерживается, модуль torch.distributed недоступен, а для LLM заявлен только размер пакета 1. Поэтому ROCm полезен для совместимых PyTorch-приложений, но не заменяет Vulkan во всех программах.
Linux: больше контроля, больше ручной работы
Linux выбирают для серверного инференса, контейнеров и более полного стека ROCm. Совместимость vLLM и других серверных движков нужно проверять для конкретной версии и бэкенда. Платформа чувствительна к версии ядра, amdgpu, прошивке, Secure Boot и сборке приложения.
В Linux память настраивается через AMD Ryzen AI Developer Center
- Сверьте дистрибутив, ядро и ROCm с текущей матрицей совместимости.
- Обновите прошивку и драйвер, затем проверьте стабильность под длительной нагрузкой.
- Запустите маленькую модель и убедитесь, что вычисления идут на GPU, а не на CPU.
- Зафиксируйте версию llama.cpp, квантизацию, контекст, размер пакета, лимит мощности и температуры.
- Увеличивайте размер модели и выделенную память по одному параметру за тест.
| Сценарий | Windows 11 | Linux | Что выбрать |
|---|---|---|---|
| Быстрый запуск GGUF | LM Studio, Vulkan | llama.cpp, Vulkan | Windows проще |
| PyTorch-инференс | ROCm с ограничениями | более полный ROCm | Linux гибче |
| Дообучение | не основной сценарий | зависит от стеказависит от стека | Linux или NVIDIA |
| Ежедневная рабочая станция | широкий x86-софт | требует настройки | зависит от приложений |
Не начинайте тест с максимального контекста. KV-кэш растёт вместе с диалогом и способен занять десятки гигабайт поверх весов. Хорошая методика проста: один и тот же промпт, одинаковое число генерируемых токенов, прогрев, три повтора и среднее значение.
Нужна помощь с выбором?
Специалисты помогут подобрать оборудование под нагрузку, бюджет и задачи
Strix Halo против DGX Spark, Mac Studio и дискретных видеокарт
Ryzen AI Max+ 395 силён там, где модель не помещается в 32 ГБ VRAM, а отдельный сервер избыточен. DGX Spark предлагает CUDA и готовую среду. Mac Studio берёт пропускной способностью памяти и MLX. RTX 5090 намного быстрее для подходящих моделей, но её 32 ГБ быстро становятся потолком.
| Платформа | Память и полоса | Цена в России | Сильный сценарий |
|---|---|---|---|
| Ryzen AI Max+ 395, 128 ГБ | 96 ГБ VGM; 256 ГБ/с | 395 000–486 000 ₽ за готовый мини-ПК | 70B–120B, Windows/x86 |
| NVIDIA DGX Spark | 128 ГБ; 273 ГБ/с | 575 000–710 000 ₽ | CUDA, разработка, дообучение |
| Mac Studio M3 Ultra | от 96 ГБ; более 800 ГБ/с | от 599 990 ₽ за версию 96 ГБ / 1 ТБ | MLX, Metal, macOS |
| GeForce RTX 5090 | 32 ГБ GDDR7; 1792 ГБ/с | 500 000–565 000 ₽ только за видеокарту | CUDA, 4K, модели до 32 ГБ |
Цифры нельзя превращать в общий рейтинг. Теоретическая пропускная способность памяти RTX 5090 ровно в семь раз выше, но Llama 70B Q4 обычно не помещается целиком в 32 ГБ. Strix Halo вмещает крупную модель, однако генерирует плотные 70B со скоростью около 3–5 токенов/с. Mac Studio требует macOS, а DGX Spark использует Arm и не заменяет обычный Windows-ПК во всех программах.
Подробности о платформах собраны в обзоре NVIDIA DGX Spark, рейтинге видеокарт для ИИ и сравнении игровых и профессиональных GPU для LLM. Для RTX 5090 есть отдельный обзор флагманской видеокарты.
Если рабочий процесс завязан на CUDA, PyTorch и программное окружение NVIDIA, вместо универсального x86-ПК можно выбрать DGX Spark. Система подходит для локальной разработки и инференса моделей, которым тесно в памяти одной потребительской видеокарты.
Стоит ли ждать Gorgon Halo (Ryzen AI Max PRO 400)
Gorgon Halo — семейство Ryzen AI Max PRO 400. Старшая модель Ryzen AI Max+ PRO 495 сохранит 16 ядер, 32 потока и 40 CU у видеоядра, но частота CPU поднимется до 5,2 ГГц, Radeon 8065S — до 3,0 ГГц, а NPU — до 55 TOPS. Главная перемена — до 192 ГБ единой памяти и до 160 ГБ, выделяемых графике.
| Характеристика | Ryzen AI Max+ 395 | Ryzen AI Max+ PRO 495 | Изменение |
|---|---|---|---|
| Максимальная память | 128 ГБ | 192 ГБ | +50% |
| Память для GPU | до 96 ГБ VGM | до 160 ГБ | +67% |
| Скорость LPDDR5x | 8000 МТ/с | 8533 МТ/с | +6,7% |
| Частота iGPU | 2,9 ГГц | 3,0 ГГц | +3,4% |
LPDDR5x-8533 повышает теоретическую пропускную способность примерно до 273 ГБ/с против 256 ГБ/с, то есть на 6,7%; частоты CPU, GPU и NPU тоже немного выросли. Но независимых тестов пока недостаточно, чтобы оценить ускорение LLM. Главный выигрыш — ёмкость: модель на 140–150 ГБ может поместиться, тогда как Strix Halo со 128 ГБ её не удержит.
| Модель | CPU и кэш | Графика и NPU | Память и TDP |
|---|---|---|---|
| Ryzen AI Max+ PRO 495 | 16/32, 3,1–5,2 ГГц, 80 МБ | Radeon 8065S, 40 CU; 55 TOPS | До 192 ГБ LPDDR5x-8533; 45–120 Вт |
| Ryzen AI Max PRO 490 | 12/24, 3,2–5,0 ГГц, 76 МБ | Radeon 8050S, 32 CU; 50 TOPS | До 192 ГБ LPDDR5x-8533; 45–120 Вт |
| Ryzen AI Max PRO 485 | 8/16, 3,6–5,0 ГГц, 40 МБ | Radeon 8050S, 32 CU; 50 TOPS | До 192 ГБ LPDDR5x-8533; 45–120 Вт |
AMD запланировала первые системы HP и Lenovo на третий квартал 2026 года. На 18 августа официальная страница процессора опубликована, но независимых тестов и стабильных розничных цен готовых конфигураций ещё мало. Ждать разумно ради 160 ГБ памяти для GPU и, по заявлению AMD, моделей на 300B+ в 4-битной квантизации, а не ради неподтверждённого прироста скорости.
Сколько стоит мини-ПК на Ryzen AI Max+ 395 и что выбрать
Цены нужно сравнивать при одинаковых объёмах памяти и SSD. На август 2026 года официальные магазины США показывали ACEMAGIC M1A Pro+ 128 ГБ + 2 ТБ за 3099 долларов и GMKtec EVO-X3 в той же конфигурации за 3799,99 долларов. У DigitalRazor компактная станция MS-S1 MAX стоит от 360 000 рублей за 64 ГБ и от 660 000 рублей за 128 ГБ; наличие старшей версии нужно уточнять перед заказом.
| Система | Память / SSD | Цена на 18.08.2026 | Что проверить |
|---|---|---|---|
| Minisforum MS-S1 MAX | 64 ГБ / 2 ТБ | от 360 000 ₽ | хватает ли 48 ГБ VGM |
| Minisforum MS-S1 MAX | 128 ГБ / 2 ТБ | от 660 000 ₽ | наличие и срок поставки |
| ACEMAGIC M1A Pro+ | 128 ГБ / 2 ТБ | 3099 $ | регион, гарантия, акция |
| GMKtec EVO-X3 | 128 ГБ / 2 ТБ | 3799,99 $ | OCuLink, профиль мощности |
Выбирать нужно в таком порядке:
- Определить размер весов, KV-кэша и запас под ОС.
- Для 7B–35B сравнить стоимость с ПК на дискретной RTX.
- Для 70B–120B, особенно с большим контекстом, выбирать 128 ГБ; 70B Q4 может поместиться и в 64 ГБ, но запас будет меньше.
- Проверить стабильный лимит мощности, уровень шума через 20 минут и температуру SSD.
- Для eGPU искать OCuLink или доступный PCIe, а не рассчитывать только на USB4.
- Сверить гарантию, сервис и готовность окружения под Windows или Linux.
Если модель, контекст и число одновременных пользователей известны, полезнее протестировать их до покупки. DigitalRazor поможет подготовить систему, запустить нагрузку и показать скорость, занятую память и температуры на реальном сценарии.
FAQ: ответы на частые вопросы
Заключение
Ryzen AI Max+ 395 — компактная платформа для случаев, когда обычной видеокарте не хватает VRAM, а большой GPU-сервер пока избыточен. Чип совмещает быстрый многопоточный CPU, графику уровня маломощной RTX 4070 Laptop и до 128 ГБ единой памяти. На одной машине можно писать код, монтировать, играть и запускать квантизованные модели на 70B–120B.
Компромиссы заметны. Плотные LLM на 70B+ работают медленно, LPDDR5x распаяна, а результат сильно зависит от корпуса и программного стека. RTX 5090 быстрее, когда модель помещается в 32 ГБ, и удобнее для CUDA-задач. DGX Spark предлагает готовую NVIDIA-экосистему, а Mac Studio лучше подходит тем, кто работает в MLX и macOS.
Перед покупкой зафиксируйте четыре числа: размер модели, KV-кэш, требуемые токены в секунду и бюджет всей системы. Затем проверьте бэкенд, лимит мощности, шум и гарантию. Gorgon Halo стоит ждать, если проект действительно упирается в 96–112 ГБ, а не ради обещания абстрактной «новизны».






























