8 800 500-99-26 Для звонков по России
NVIDIA Vera Rubin: в 10 раз больше токенов на ватт
Железо
2 мин

NVIDIA Vera Rubin: в 10 раз больше токенов на ватт

DigitalRazor
DigitalRazor
Подписаться в Telegram
Содержание 4 раздела
Краткое содержание Первые цифры не со слайда, а с боевого кластера Сборка стойки — тоже часть экономики Чья это цифра и почему её рано брать в расчёт
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX

Подберём сервер под задачи

Ответьте на несколько вопросов — подготовим предложение

NVIDIA впервые показала не слайды, а живые тесты Vera Rubin NVL72 на реальной инсталляции CoreWeave: на модели DeepSeek-R1 стойка выдаёт в десять раз больше токенов на ватт, чем предыдущая NVL72 на GB200. Для дата-центра, где счёт идёт на мегаватты, это не маркетинговая цифра, а прямая экономия на электричестве.

Краткое содержание

  • первые результаты Vera Rubin NVL72 на реальной инсталляции CoreWeave (не демо-стенд) — на модели DeepSeek-R1 в 10 раз больше токенов на ватт, чем у GB200 NVL72;
  • вычислительный лоток стойки теперь собирается за 1 минуту вместо 90 минут у GB200 — изменение конструкции ради монтажа на объекте;
  • платформа объединяет шесть чипов NVIDIA: CPU Vera, GPU Rubin, коммутаторы NVLink 6 и Spectrum-6, сетевые адаптеры ConnectX-9 и DPU BlueField-4;
  • цифры показаны на одном клиенте и одной модели — независимых замеров пока нет.

Первые цифры не со слайда, а с боевого кластера

Обычно новые платформы NVIDIA сопровождают синтетическими тестами на собственных стендах. В этот раз компания показала журналистам цифры с работающей инсталляции облачного провайдера CoreWeave: на модели DeepSeek-R1 Vera Rubin NVL72 выдаёт в десять раз больше токенов на каждый затраченный ватт, чем предыдущее поколение NVL72 на связке Grace Blackwell и GB200. Для инференса именно эта метрика определяет счёт за электричество в масштабе: не пиковая производительность стойки, а сколько ответов модели получится из одного киловатта мощности, которую вы уже оплатили дата-центру.

Сборка стойки — тоже часть экономики

Отдельно NVIDIA показала: досталось и механике. Вычислительный лоток Vera Rubin NVL72 собирается на объекте примерно за минуту, тогда как у GB200 та же операция занимала полтора часа. При развёртывании кластера на десятки и сотни стоек разница в 90 раз — это уже не мелочь для интегратора, а изменение сроков ввода в эксплуатацию и трудозатрат бригады монтажников. Платформа целиком строится на связке из шести чипов NVIDIA: процессор Vera, ускоритель Rubin, коммутаторы NVLink 6 и Spectrum-6, сетевой адаптер ConnectX-9 и DPU BlueField-4 — вся стойка становится единой экосистемой одного вендора.

Чья это цифра и почему её рано брать в расчёт

Десятикратный рост токенов на ватт — цифра, выбранная и предоставленная самой NVIDIA, а не результат независимого замера сторонней лабораторией: один клиент, одна модель, одна метрика. Это не значит, что цифра ложная, но переносить её на свою нагрузку без проверки не стоит — разные модели и профили запросов дают разный выигрыш. К тому же Vera Rubin NVL72 — платформа для гиперскейлеров и крупных облачных провайдеров: розничных серверов на этой связке ждать не стоит, а сроки появления доступа к ней у меньших облачных площадок пока не называются.

Мнение DigitalRazor

Десятикратный рост токенов на ватт — цифра, на которую стоит опираться при планировании бюджета на электричество для инференса к 2027 году, но закладывать её в расчёт TCO один в один пока рано: ждите независимых тестов на своих моделях. Для среднего заказчика Vera Rubin NVL72 сегодня не про закупку, а про ориентир, куда движется экономика ИИ-инфраструктуры у крупных облаков. И повод пересчитать, что выгоднее: собственный парк под текущее поколение ускорителей или аренда мощностей у тех, кто уже перейдёт на новую платформу.

Для каких задач Компактный GPU-сервер до 2 видеокарт для начальных задач в AI и графике. Оптимален для инференса, визуализации, VFX и рендеринга в студиях и лабораториях, где важна гибкость.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 282 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 4.5U
Для каких задач Универсальная платформа на 4–6 GPU для локального обучения моделей и генеративных задач. Подходит для команд, которым важна надёжность сервера и свобода выбора графики — от RTX 5090 до PRO RTX 6000.
Подробнее
Видеокарты
RTX / RTX PRO / H200 NVL
Объем видеопамяти до 576 ГБ
Процессоры
Threadripper PRO
Количество ядер до 96
RAM до 1024 ГБ DDR5
Форм-фактор 6.5U
Для каких задач Сервер промышленного уровня на 8 GPU с кластерной архитектурой. Предназначен для дата-центров и AI-ферм, где требуется масштабируемость и полная загрузка ресурсов под обучение LLM и R&D.
Подробнее
Видеокарты
RTX PRO 6000 / RTX 5090
Объем видеопамяти до 768 ГБ
Процессоры
AMD Epyc, Intel Xeon
Количество ядер до 320
RAM до 3072 ГБ DDR5
Форм-фактор 6U
Для каких задач Серия серверов для кластеризации на 4 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 564 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 128
RAM до 1536 ГБ DDR5
Форм-фактор 2U
Для каких задач Серия серверов для кластеризации на 8 GPU. Предназначены для дата-центров и AI-ферм, где требуется повышенная плотность для обучение LLM и R&D.
Подробнее
Видеокарты
L40s / RTX PRO / H200 NVL
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 4U
Для каких задач HGX объединяет 8 видеокарт NVIDIA H200, достигая экстремальной плотности производительности. Благодаря внутренней связности NVSwitch мгновенно интегрируется в масштабные вычислительные кластеры.
Подробнее
Видеокарты
NVIDIA H200 SXM
Объем видеопамяти до 1128 ГБ
Процессоры
AMD EPYC, Intel Xeon
Количество ядер до 256
RAM до 2048 ГБ DDR5
Форм-фактор 5U
Подберём сервер под вашу задачу

Подберём конфигурацию сервера и отправим предложение.

Смотреть серверы
или свяжитесь с нами
Telegram Telegram WhatsApp WhatsApp ВКонтакте ВКонтакте MAX MAX

Так же будет интересно почитать

Сайт использует cookies
Узнать подробнее