8 800 500-99-26 Для звонков по России
Mac Studio M5 Ultra: 512 ГБ памяти без GPU-сервера
Железо
3 мин

Mac Studio M5 Ultra: 512 ГБ памяти без GPU-сервера

DigitalRazor
DigitalRazor
Подписаться в Telegram
Содержание 4 раздела
Краткое содержание Что внутри: M5 Ultra и единая память Зачем компании 512 ГБ памяти в одном корпусе Что учесть: скорость, сроки и экосистема
Подберём решение под ваш проект

Расскажите о задаче — предложим оптимальную конфигурацию и реализацию.

Обсудить проект
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX

Есть проект? Напишите нам

Обсудим задачу и подберём оборудование

Обсудить проект

Apple представила Mac Studio на новом чипе M5 Ultra: до 512 гигабайт единой памяти и 1,2 терабайта в секунду пропускной способности за 5499 долларов стартовой цены. Для бизнеса, который гоняет большие языковые модели локально, это готовая альтернатива стойке серверных ускорителей — но с другими компромиссами по скорости и экосистеме.

Краткое содержание

  • M5 Ultra — до 36 ядер CPU и 80 ядер GPU, единая память до 512 ГБ на скорости 1,2 ТБ/с;
  • Mac Studio с M5 Ultra стоит от 5499 долларов, но конфигурация на 512 ГБ выйдет только в конце октября;
  • по данным Apple, прирост производительности в ИИ-задачах — до 4,3 раза относительно M3 Ultra;
  • единая память заменяет видеопамять ускорителя, но её пропускная способность заметно ниже, чем у серверных GPU на HBM.

Что внутри: M5 Ultra и единая память

M5 Ultra — это два кристалла M5 Max, которые связывает интерконнект UltraFusion. В сумме — до 36 ядер процессора (12 «супер»-ядер и 24 производительных), до 80 ядер графики и 32-ядерный нейронный процессор. Ключевая цифра для ИИ-задач — единая память: до 512 ГБ на одной шине с пропускной способностью 1,2 ТБ/с, на 50% больше, чем у прошлого поколения M3 Ultra. По заявлению Apple, прирост производительности в ИИ-нагрузках достигает 4,3 раза.

Младший чип линейки, M5 Max, скромнее: 18 ядер CPU, до 40 ядер GPU, до 128 ГБ памяти на 614 ГБ/с — и стартует с 2499 долларов. Обновился и Mac mini: чип M6 на 2-нанометровом техпроцессе даёт 12 ядер CPU и GPU, но лимит памяти — 32 ГБ на 170 ГБ/с, для серьёзного инференса тесновато.

Зачем компании 512 ГБ памяти в одном корпусе

У видеокарт даже топового уровня память измеряется десятками гигабайт, а объединение нескольких GPU в один пул требует NVLink или дорогой сетевой инфраструктуры. Mac Studio с M5 Ultra решает вопрос иначе — единая память доступна всему чипу целиком, без обмена данными между устройствами. 512 ГБ достаточно, чтобы загрузить в память крупную открытую модель вроде DeepSeek V4 Pro или Qwen3.8-2.4T-A95B в квантованном виде — без сборки многокарточного сервера и настройки распределённого инференса. Для команды, которая тестирует большие модели или держит их для внутренних задач, это способ обойтись одним компактным корпусом на столе вместо стойки.

Что учесть: скорость, сроки и экосистема

Единая память Apple — не замена серверных ускорителей, а другой инструмент. Пропускная способность 1,2 ТБ/с солидна для настольного компьютера, но заметно ниже, чем у ускорителей на HBM в дата-центре: там счёт идёт на терабайты в секунду с запасом. На практике это означает, что Mac Studio выигрывает по объёму памяти и проигрывает по скорости генерации токенов на по-настоящему больших моделях.

Конфигурация на 512 ГБ появится в продаже только в конце октября — до этого предельный объём составляет 256 ГБ, и апгрейд до него добавляет к цене ещё 4000 долларов. И третий момент — экосистема: инференс на Mac идёт через Metal и фреймворки вроде MLX или llama.cpp, а не через CUDA, на которой построена большая часть серверных пайплайнов. Перенести готовый CUDA-стек на Mac Studio не получится — потребуется отдельная сборка под задачу.

Мнение DigitalRazor

Mac Studio с M5 Ultra — интересный вариант для тестирования больших моделей и локальных R&D-задач, но не замена GPU-серверу в продакшене: разная экосистема и заметно меньшая пропускная способность памяти делают его нишевым инструментом, а не универсальным решением. Если компания уже строит инференс на CUDA, разумнее нарастить парк серверных ускорителей под конкретную нагрузку — мы поможем подобрать конфигурацию под бюджет и модель.

MS-S1 MAX · 64 ГБ
Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Radeon 8060S
Объем видеопамяти 64 ГБ
Процессоры
Ryzen AI Max+ 395
Количество ядер 16 Zen 5
RAM Объединена с VRAM
Форм-фактор SFF
MS-S1 MAX · 128 ГБ
Для каких задач Запуск и дообучение больших языковых моделей до 200 млрд локально
Подробнее
Видеокарты
Radeon 8060S
Объем видеопамяти 64 ГБ
Процессоры
Ryzen AI Max+ 395
Количество ядер 16 Zen 5
RAM Объединена с VRAM
Форм-фактор SFF
Подберём решение под ваш проект

Расскажите о задаче — предложим оптимальную конфигурацию и реализацию.

Обсудить проект
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX
9.2К

Так же будет интересно почитать

Сайт использует cookies
Узнать подробнее