Top.Mail.Ru
NVIDIA Vera Rubin NVL72 (36x Vera Rubin Superchip) купить в Москве, Санкт-Петербурге с доставкой по России - цены Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
В связи с праздником в Китае 25 сентября срок уточнения цен, наличия и срок поставки будет увеличен. Благодарим за понимание!
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

NVIDIA Vera Rubin NVL72 (36x Vera Rubin Superchip)

nvidia
+200 ₽

Цена с учетом расширенной гарантии

Цена включает НДС 7%

1 273 111 300 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Гарантия 1 год с заменой компонентов
Подробнее
Условия доставки и самовывоза
Подробнее
Помощь в вопросе выбора и совместимости
Подробнее
Тип Новые
Парт.№ VR200
Основная задача Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU) NVIDIA Vera
Видеокарта (GPU) NVIDIA Rubin
Количество GPU, шт 72
Общий объем видеопамяти (VRAM), ГБ 21197
Тип памяти GPU HBM4
Объем оперативной памяти (RAM), ГБ 55296
Тип оперативной памяти LPDDR5x
Форм-фактор 48U
Подробные характеристики
Подробное описание

NVIDIA Vera Rubin NVL72 - это стоечный AI-суперкомпьютер нового поколения для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Платформа объединяет 36 Vera Rubin Superchip, внутри которых работают 72 NVIDIA Rubin GPU и 36 NVIDIA Vera CPU, формируя rack-scale систему для агентного ИИ, reasoning-моделей, триллионных LLM и длинных контекстов.

Ключевая особенность Vera Rubin NVL72 - переход на HBM4 и шестое поколение NVIDIA NVLink. Система располагает 20,7 ТБ HBM4 GPU-памяти с суммарной пропускной способностью до 1580 ТБ/с, а также 54 ТБ LPDDR5X CPU-памяти для обслуживания больших контекстов, KV-cache, data movement и агентных AI-нагрузок. NVLink 6 обеспечивает до 260 ТБ/с межGPU-связности на уровне стойки, что особенно важно для распределённого обучения, крупного inference-serving и моделей с сотнями миллиардов или триллионами параметров.

Rubin GPU поддерживает современные режимы точности NVFP4, FP8/FP6, FP16/BF16, TF32, INT8, FP32 и FP64. Для всей стойки NVIDIA заявляет до 3600 PFLOPS NVFP4 Inference, 2520 PFLOPS NVFP4 Training, 1260 PFLOPS FP8/FP6 Training и 288 PFLOPS FP16/BF16. При этом Vera Rubin NVL72 не является системой для классической визуализации, локального рендеринга или видеонаблюдения: её основной профиль - AI-фабрики, обучение, inference на триллионных моделях, agentic AI, RAG, HPC и масштабные корпоративные AI-сервисы.


Производительность GPU

Тип точностиСовокупная мощность системы
FP4 (NVFP4)2520 PFLOPS
FP81260 PFLOPS
FP61260 PFLOPS
FP16288 PFLOPS
BF16288 PFLOPS
FP329360 TFLOPS
TF32144 PFLOPS
FP32*28800 TFLOPS
FP64*14400 TFLOPS
INT818 POPS

* - Максимальная производительность достигается за счет использования алгоритмов эмуляции на базе NVIDIA Tensor Core.


Совместимость с LLM-моделями

Модель Тип квантизации Требуется VRAM Совместимость Примечание
DeepSeek-V4-Pro Нет Примерно 865GB ✅ VR200 NVL72 уверенно запускает модель с огромным запасом HBM4 под длинный контекст, KV-cache, крупные батчи и высокий параллелизм reasoning-запросов.
Qwen3.8-2.4T-A95B Нет Примерно 4.89TB ✅ Крупная MoE-модель для серверов с большим объёмом GPU-памяти; подходит для сложных reasoning-задач, RAG, агентных сценариев и production-инференса. Для стабильной работы требуется распределение по нескольким GPU и достаточный запас памяти под KV-cache, длинный контекст и параллельные запросы.
Gpt-oss:120b Нет Примерно 196GB ✅ Для VR200 NVL72 это сравнительно лёгкая модель: система позволяет держать множество инстансов, длинный контекст, высокий concurrency и большой запас под KV-cache.
GigaChat3.5-432B-A28B-bf16 Нет Примерно 868GB ✅ VR200 NVL72 подходит для крупномасштабного инференса этой модели, включая BF16-serving, длинный контекст, большие батчи и параллельное обслуживание множества пользователей.
Mistral-Large-3-675B-Instruct-251 Нет Примерно 682GB ✅ Платформа даёт большой резерв для корпоративного serving, длинных контекстных окон, крупных батчей и высокой плотности одновременных agentic- и RAG-запросов.
GLM-5.2 Нет Примерно 1.51TB ✅ VR200 NVL72 рассчитан на модели такого класса и сохраняет крупный запас HBM4 под KV-cache, параллельные сессии, большие контексты и масштабный production-инференс.
Gemma-4-31B-IT-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 32.7GB ✅ Для VR200 NVL72 это крайне лёгкая модель, которую удобно масштабировать на большое число параллельных NVFP4-инстансов с длинным контекстом и очень высокой плотностью запросов.
NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 80.4GB ✅ VR200 NVL72 запускает такую модель с огромным запасом по памяти и производительности, что удобно для большого числа одновременных инстансов, длинного контекста и высоконагруженного agentic serving.

Совместимость с диффузионными моделями

Модель Тип Совместимость Примечание
Stable Diffusion XL 1.0 Текст в изображение ✅ VR200 NVL72 легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском графических пайплайнов на уровне AI-фабрики.
Flux.2-dev Текст в изображение ✅ Масштаб Vera Rubin NVL72 позволяет повышать разрешение, ускорять обработку и одновременно обслуживать большое число генеративных очередей.
SD Turbo Быстрые предпросмотры ✅ Подходит для экстремально высокой параллельности, быстрых предпросмотров и генерации большого количества изображений в production-потоке.
Kandinsky-5.0-T2I-Lite-sft-Diffusers Текст в изображение ✅ Можно одновременно запускать множество независимых генеративных пайплайнов с большим запасом HBM4, вычислительной мощности и межGPU-связности.
Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers Текст в видео ✅ Платформа хорошо подходит для параллельной генерации коротких роликов, ускорения T2V-пайплайнов и масштабных видеодиффузионных сценариев.
NVIDIA-Cosmos3-Super Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями ✅ Модель объёмом 133GB хорошо подходит для VR200 NVL72: система рассчитана на мультимодальные world-model сценарии, видео, действия, симуляцию физического мира и параллельный запуск сложных AI-пайплайнов.
Задать вопрос

Наличие на складах (0 шт.)

Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней

Мы отправляем заказы ведущими транспортными компаниями:

  • CDEK
  • Деловые линии
  • ПЭК

Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.


Ориентировочные сроки сборки заказов:

  • Серверные комплектующие: 1-2 раб. дня.
  • Серверы: 1-4 раб. дня.
  • Перемещение между офисами (МСК-СПБ): 1-2 раб. дня.

В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.


Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:

  • Безналичная оплата по счету (для организаций)
  • Онлайн оплата банковской картой ЮКасса (SberPay, T-Pay, СБП)
Узнать больше

ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.

Также мы можем предложить расширенный срок гарантийных отношений:


входит в стоимость
127 311 130 ₽
190 966 695 ₽
254 622 260 ₽
318 277 825 ₽

Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.


Подробнее об условиях гарантии ServerFlow

ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.

Почему Trade-in в ServerFlow — это удобно:

  • Оперативная оценка оборудования. Оператор онлайн чата постарается в течении 30 минут дать оценку оборудованию.
  • Конструктивный диалог. Если вы не согласны с предложенной стоимостью мы постараемся найти компромисс.
  • Забор оборудования. После согласования Trade-in мы согласуем курьерскую доставку от двери, а если вам удобно лично посетить наш офис в Москве или Санкт-Петербурге.
  • Тестирование и подтверждение скидки. Технические инженеры ServerFlow проверяет стабильность вашего оборудования. В случае подтверждения стабильности мы утвердим скидку на оборудование.
Скидка 1 500 ₽ за обратную связь

Поделитесь впечатлением о работе ServerFlow после получения заказа.

* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.

nvidia
+200 ₽
Цена с учетом расширенной гарантии

Цена включает НДС 7%

1 273 111 300 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Под заказ
1 273 111 300 руб. Цена включает НДС 7%
добавить В корзину

Похожие товары

Supermicro SYS-821GE-TNHR (8× H200 SXM 141GB, Xeon Platinum 8558, RAM 2TB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
ASRock Rack 6U8X-TURIN2 SYN H200 (8× H200 SXM 141GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro SYS-221GE-NR (4x NVIDIA H100 80GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G893-ZD1-AAX3 (8× H200 SXM 141GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
AMD Ryzen AI Halo (Radeon 8060S, Ryzen AI Max+ 395, RAM 128GB, OS Linux)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
NVIDIA DGX A100 (8× A100 SXM 80GB, 2× EPYC 7742, RAM 1TB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G893-ZX1-AAX1 (8× Instinct MI300X 192GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro 747BTQ-R2K04B (4× Tesla P100 16GB, 2× Xeon E5 2697v4, RAM 256GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)