
Mac Studio M5 Ultra: 512 ГБ памяти без GPU-сервера
Есть проект? Напишите нам
Обсудим задачу и подберём оборудование
Apple представила Mac Studio на новом чипе M5 Ultra: до 512 гигабайт единой памяти и 1,2 терабайта в секунду пропускной способности за 5499 долларов стартовой цены. Для бизнеса, который гоняет большие языковые модели локально, это готовая альтернатива стойке серверных ускорителей — но с другими компромиссами по скорости и экосистеме.
Краткое содержание
- M5 Ultra — до 36 ядер CPU и 80 ядер GPU, единая память до 512 ГБ на скорости 1,2 ТБ/с;
- Mac Studio с M5 Ultra стоит от 5499 долларов, но конфигурация на 512 ГБ выйдет только в конце октября;
- по данным Apple, прирост производительности в ИИ-задачах — до 4,3 раза относительно M3 Ultra;
- единая память заменяет видеопамять ускорителя, но её пропускная способность заметно ниже, чем у серверных GPU на HBM.
Что внутри: M5 Ultra и единая память
M5 Ultra — это два кристалла M5 Max, которые связывает интерконнект UltraFusion. В сумме — до 36 ядер процессора (12 «супер»-ядер и 24 производительных), до 80 ядер графики и 32-ядерный нейронный процессор. Ключевая цифра для ИИ-задач — единая память: до 512 ГБ на одной шине с пропускной способностью 1,2 ТБ/с, на 50% больше, чем у прошлого поколения M3 Ultra. По заявлению Apple, прирост производительности в ИИ-нагрузках достигает 4,3 раза.
Младший чип линейки, M5 Max, скромнее: 18 ядер CPU, до 40 ядер GPU, до 128 ГБ памяти на 614 ГБ/с — и стартует с 2499 долларов. Обновился и Mac mini: чип M6 на 2-нанометровом техпроцессе даёт 12 ядер CPU и GPU, но лимит памяти — 32 ГБ на 170 ГБ/с, для серьёзного инференса тесновато.
Зачем компании 512 ГБ памяти в одном корпусе
У видеокарт даже топового уровня память измеряется десятками гигабайт, а объединение нескольких GPU в один пул требует NVLink или дорогой сетевой инфраструктуры. Mac Studio с M5 Ultra решает вопрос иначе — единая память доступна всему чипу целиком, без обмена данными между устройствами. 512 ГБ достаточно, чтобы загрузить в память крупную открытую модель вроде DeepSeek V4 Pro или Qwen3.8-2.4T-A95B в квантованном виде — без сборки многокарточного сервера и настройки распределённого инференса. Для команды, которая тестирует большие модели или держит их для внутренних задач, это способ обойтись одним компактным корпусом на столе вместо стойки.
Что учесть: скорость, сроки и экосистема
Единая память Apple — не замена серверных ускорителей, а другой инструмент. Пропускная способность 1,2 ТБ/с солидна для настольного компьютера, но заметно ниже, чем у ускорителей на HBM в дата-центре: там счёт идёт на терабайты в секунду с запасом. На практике это означает, что Mac Studio выигрывает по объёму памяти и проигрывает по скорости генерации токенов на по-настоящему больших моделях.
Конфигурация на 512 ГБ появится в продаже только в конце октября — до этого предельный объём составляет 256 ГБ, и апгрейд до него добавляет к цене ещё 4000 долларов. И третий момент — экосистема: инференс на Mac идёт через Metal и фреймворки вроде MLX или llama.cpp, а не через CUDA, на которой построена большая часть серверных пайплайнов. Перенести готовый CUDA-стек на Mac Studio не получится — потребуется отдельная сборка под задачу.
Мнение DigitalRazor
Mac Studio с M5 Ultra — интересный вариант для тестирования больших моделей и локальных R&D-задач, но не замена GPU-серверу в продакшене: разная экосистема и заметно меньшая пропускная способность памяти делают его нишевым инструментом, а не универсальным решением. Если компания уже строит инференс на CUDA, разумнее нарастить парк серверных ускорителей под конкретную нагрузку — мы поможем подобрать конфигурацию под бюджет и модель.







