Top.Mail.Ru
GIGABYTE NVIDIA Vera Rubin NVL72 (36x Vera Rubin Superchip) купить в Москве, Санкт-Петербурге с доставкой по России - цены Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

GIGABYTE NVIDIA Vera Rubin NVL72 (36x Vera Rubin Superchip)

GIGABYTE
+200

Цена с учетом расширенной гарантии

Цена включает НДС 7%

1 239 495 100 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Гарантия 1 год с заменой компонентов
Подробнее
Условия доставки и самовывоза
Подробнее
Помощь в вопросе выбора и совместимости
Подробнее
Тип Новые
Парт.№ DLB5-CB0
Основная задача Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU) NVIDIA Vera
Видеокарта (GPU) NVIDIA Rubin
Количество GPU, шт 72
Общий объем видеопамяти (VRAM), ГБ 21197
Тип памяти GPU HBM4
Объем оперативной памяти (RAM), ГБ 55296
Тип оперативной памяти LPDDR5x
Форм-фактор 48U
Подробные характеристики
Подробное описание

GIGABYTE NVIDIA Vera Rubin NVL72 - это rack-scale AI-суперкомпьютер нового поколения на базе 36 NVIDIA Vera Rubin Superchip, объединяющий 72 Rubin GPU и 36 Vera CPU. Система предназначена для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Архитектура рассчитана прежде всего на trillion-scale LLM, reasoning-модели, agentic AI, крупные MoE-системы и высоконагруженные AI-фабрики.

Платформа располагает 20,7 ТБ HBM4 GPU-памяти с совокупной пропускной способностью до 1580 ТБ/с и 54 ТБ LPDDR5X CPU-памяти. Шестое поколение NVIDIA NVLink 6 объединяет 72 Rubin GPU в высокоскоростной вычислительный домен, обеспечивая эффективный обмен данными при распределённом обучении, длинных контекстах, больших KV-cache и масштабном inference-serving. GIGABYTE дополняет систему NVIDIA ConnectX-9 SuperNIC, BlueField-4 DPU, поддержкой Quantum-X800 InfiniBand или Spectrum-X Ethernet и собственным GIGABYTE POD Manager для управления AI-инфраструктурой.

Rubin GPU поддерживает современные AI-режимы NVFP4, FP8/FP6, FP16/BF16, INT8, TF32, FP32 и FP64, что позволяет использовать платформу как для высокоплотного инференса, так и для обучения и научных вычислений. Система имеет полностью жидкостное охлаждение и ориентирована именно на AI-фабрики и HPC-инфраструктуру; для обычного графического рендеринга или классического видеонаблюдения она избыточна и не является профильным решением.


Производительность GPU

Тип точностиСовокупная мощность системы
FP4 (NVFP4)2520 PFLOPS
FP81260 PFLOPS
FP61260 PFLOPS
FP16288 PFLOPS
BF16288 PFLOPS
FP329360 TFLOPS
TF32144 PFLOPS
FP32*28800 TFLOPS
FP64*14400 TFLOPS
INT818 POPS

* - Максимальная производительность достигается за счет использования алгоритмов эмуляции на базе NVIDIA Tensor Core.


Совместимость с LLM-моделями

Модель Тип квантизации Требуется VRAM Совместимость Примечание
DeepSeek-V4-Pro Нет Примерно 865GB GIGABYTE Vera Rubin NVL72 уверенно запускает модель с огромным запасом HBM4 под длинный контекст, KV-cache, крупные батчи и высокую параллельность reasoning-запросов.
Qwen3.5-397B-A17B / Qwen3.6-35B-A3B Нет Примерно 807GB / 71.9 GB Первая модель подходит для тяжёлого распределённого serving и RAG на NVLink 6, а вторую можно масштабировать на большое число параллельных инстансов с высокой плотностью запросов.
Gpt-oss:120b Нет Примерно 196GB Для GIGABYTE Vera Rubin NVL72 это сравнительно лёгкая модель: платформа позволяет одновременно обслуживать множество инстансов, длинные контексты и высокий concurrency с большим резервом памяти.
GigaChat3.5-432B-A28B-bf16 Нет Примерно 868GB Платформа подходит для крупномасштабного BF16-инференса этой модели, включая длинный контекст, большие батчи, RAG и параллельное обслуживание большого числа корпоративных пользователей.
Mistral-Large-3-675B-Instruct-251 Нет Примерно 682GB GIGABYTE Vera Rubin NVL72 даёт большой резерв HBM4 для длинных контекстных окон, крупных батчей, корпоративного serving и высокой плотности одновременных agentic- и RAG-запросов.
GLM-5.2 Нет Примерно 1.51TB Модель такого класса комфортно размещается в 20.7TB HBM4 системы, оставляя большой резерв под KV-cache, параллельные сессии, длинный контекст и масштабный production-инференс.
Gemma-4-31B-IT-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 32.7GB Для GIGABYTE Vera Rubin NVL72 это крайне лёгкая NVFP4-модель, которую удобно разворачивать в большом числе параллельных инстансов для высокоплотного и энергоэффективного inference-serving.
NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 80.4GB Платформа запускает модель с огромным запасом по HBM4 и NVFP4-производительности, что удобно для множества одновременных инстансов, длинного контекста и высоконагруженного agentic serving.

Совместимость с диффузионными моделями

Модель Тип Совместимость Примечание
Stable Diffusion XL 1.0 Текст в изображение GIGABYTE Vera Rubin NVL72 легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском генеративных пайплайнов уровня AI-фабрики.
Flux.2-dev Текст в изображение 20.7TB HBM4 и масштаб 72 Rubin GPU позволяют одновременно обслуживать большое число тяжёлых генеративных очередей, повышать разрешение и увеличивать throughput.
SD Turbo Быстрые предпросмотры Для этой платформы модель очень лёгкая и подходит для экстремально высокой параллельности, мгновенных предпросмотров и массовой генерации изображений в production-среде.
Kandinsky-5.0-T2I-Lite-sft-Diffusers Текст в изображение Можно одновременно запускать множество независимых T2I-пайплайнов, используя большой запас HBM4 и высокоскоростную связность NVLink 6 для масштабных генеративных нагрузок.
Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers Текст в видео Платформа подходит для массовой параллельной генерации видео, тяжёлых T2V-пайплайнов и production-сценариев, где требуется высокая пропускная способность и большое число одновременных задач.
NVIDIA-Cosmos3-Super Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями GIGABYTE Vera Rubin NVL72 особенно хорошо подходит для модели такого класса: 72 Rubin GPU, HBM4 и NVLink 6 рассчитаны на тяжёлые мультимодальные world-model сценарии, физический AI, видео, действия и масштабные симуляции.
Задать вопрос

Наличие на складах (0 шт.)

Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней

Мы отправляем заказы ведущими транспортными компаниями:

  • CDEK
  • Деловые линии
  • ПЭК

Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.


Ориентировочные сроки сборки заказов:

  • Серверные комплектующие: 1-2 раб. дня.
  • Серверы: 1-4 раб. дня.
  • Перемещение между офисами (МСК-СПБ): 1-2 раб. дня.

В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.


Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:

  • Безналичная оплата по счету (для организаций)
  • Онлайн оплата банковской картой ЮКасса (SberPay, T-Pay, СБП)
Узнать больше

ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.

Также мы можем предложить расширенный срок гарантийных отношений:


входит в стоимость
123 949 510
185 924 265
247 899 020
309 873 775

Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.


Подробнее об условиях гарантии ServerFlow

ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.

Почему Trade-in в ServerFlow — это удобно:

  • Оперативная оценка оборудования. Оператор онлайн чата постарается в течении 30 минут дать оценку оборудованию.
  • Конструктивный диалог. Если вы не согласны с предложенной стоимостью мы постараемся найти компромисс.
  • Забор оборудования. После согласования Trade-in мы согласуем курьерскую доставку от двери, а если вам удобно лично посетить наш офис в Москве или Санкт-Петербурге.
  • Тестирование и подтверждение скидки. Технические инженеры ServerFlow проверяет стабильность вашего оборудования. В случае подтверждения стабильности мы утвердим скидку на оборудование.
Скидка 1 500 ₽ за обратную связь

Поделитесь впечатлением о работе ServerFlow после получения заказа.

* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.

GIGABYTE
+200
Цена с учетом расширенной гарантии

Цена включает НДС 7%

1 239 495 100 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Под заказ
1 239 495 100 руб. Цена включает НДС 7%
добавить В корзину

Похожие товары

HPE DL380a Gen12 (8× RTX PRO 6000 BSE 96GB, 2× Xeon 6760P, RAM 1TB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro SYS-420GP-TNAR (8× A100 SXM 80GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G593-SD1-AAX1 (8× H100 SXM 80GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G593-ZD1-AAX3 (8× H200 SXM 141GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
HP ZGX Nano G1n (GB10 Grace Superchip, ARM v9.2-A (GB10), RAM 128GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Deepcool MATREXX 55 MESH (3× RTX A5000 24GB, 1× EPYC 7402, RAM 256GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G494-ZB4-AAP2 (8× RTX PRO 6000 BSE 96GB, 2× EPYC 9655, RAM 768GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE G492-IL0 (8× A100 SXM 80GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)