Top.Mail.Ru
NVIDIA GB300 NVL72 (36x GB300 Grace Blackwell Ultra) купить в Москве, Санкт-Петербурге с доставкой по России - цены Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

NVIDIA GB300 NVL72 (36x GB300 Grace Blackwell Ultra)

nvidia
+200

Цена с учетом расширенной гарантии

Цена включает НДС 7%

914 458 900 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Гарантия 1 год с заменой компонентов
Подробнее
Условия доставки и самовывоза
Подробнее
Помощь в вопросе выбора и совместимости
Подробнее
Спецификация GB300 NVL72.pdf
Тип Новые
Основная задача Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг
Процессор (CPU) NVIDIA GB300 (Grace)
Видеокарта (GPU) NVIDIA GB300 (Blackwell Ultra)
Количество GPU, шт 72
Общий объем видеопамяти (VRAM), ГБ 20088
Тип памяти GPU HBM3e
Объем оперативной памяти (RAM), ГБ 17856
Тип оперативной памяти LPDDR5x
Форм-фактор 48U
Подробные характеристики
Подробное описание

NVIDIA GB300 NVL72 - это стоечная AI-система нового поколения для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Платформа объединяет 72 ускорителя NVIDIA Blackwell Ultra и 36 процессоров NVIDIA Grace в единую rack-scale архитектуру, ориентированную на reasoning-модели, большие агентные системы и тяжёлые корпоративные AI-нагрузки.

Система располагает 20 ТБ HBM3e VRAM с пропускной способностью до 576 ТБ/с и 17 ТБ LPDDR5X, а общий объём быстрой памяти достигает 37 ТБ. Между GPU используется NVLink 5 с суммарной полосой до 130 ТБ/с, что позволяет эффективно масштабировать многомодельный инференс, обучение и работу с очень длинным контекстом.

Архитектура Blackwell Ultra поддерживает FP4, FP8/FP6, FP16/BF16, INT8, а также оптимизирована под современные CUDA-фреймворки, включая vLLM, TensorRT-LLM и SGLang. В сравнении с предыдущим поколением Blackwell GB300 NVL72 предлагает 1,5× больше плотной FP4-производительности и 2× более высокую производительность attention-слоёв. Это платформа прежде всего для AI-фабрик и крупных вычислительных центров, а не для классических задач рендеринга или рабочей визуализации.


Производительность GPU

Тип точностиСовокупная мощность системы
FP4 Tensor core1440 PFLOPS
FP8 Tensor core720 PFLOPS
FP6 Tensor core720 PFLOPS
FP16 Tensor core360 PFLOPS
BF16 Tensor core360 PFLOPS
FP326 PFLOPS
TF32 Tensor core180 PFLOPS
FP64 Tensor core100 TFLOPS
INT824 POPS

Совместимость с LLM-моделями

Модель Тип квантизации Требуется VRAM Совместимость Примечание
DeepSeek-V4-Pro Нет Примерно 865GB GB300 NVL72 уверенно запускает модель с огромным запасом под длинный контекст, KV-cache, большие батчи и высокий параллелизм запросов.
Qwen3.8-2.4T-A95B Нет Примерно 4.89TB Крупная MoE-модель для серверов с большим объёмом GPU-памяти; подходит для сложных reasoning-задач, RAG, агентных сценариев и production-инференса. Для стабильной работы требуется распределение по нескольким GPU и достаточный запас памяти под KV-cache, длинный контекст и параллельные запросы.
Gpt-oss:120b Нет Примерно 196GB Для такой модели система имеет колоссальный запас по памяти и вычислениям, что полезно для длинного контекста, высокой concurrency и плотного размещения инстансов.
GigaChat3.5-432B-A28B-bf16 Нет Примерно 868GB GB300 NVL72 подходит для крупномасштабного инференса этой модели, включая длинный контекст, большие батчи и параллельное обслуживание множества пользователей.
Mistral-Large-3-675B-Instruct-251 Нет Примерно 682GB Платформа даёт большой резерв для длинных контекстных окон, крупных батчей, корпоративного serving и высокой плотности одновременных запросов.
GLM-5.2 Нет Примерно 1.51TB GB300 NVL72 рассчитан на модели такого класса и сохраняет крупный запас под KV-cache, параллельные сессии, большие контексты и масштабный инференс.
Gemma-4-31B-IT-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 32.7GB Для GB300 NVL72 это крайне лёгкая модель, которую удобно масштабировать на большое число параллельных инстансов с длинным контекстом и очень высокой плотностью запросов.
NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 NVFP4 (FP4 для NVIDIA) Примерно 80.4GB GB300 NVL72 запускает такую модель с огромным запасом по памяти и производительности, что удобно для большого числа одновременных инстансов, длинного контекста и высоконагруженного serving.
Kimi-K3 Нет Примерно 1.56TB Полноразмерная версия для мощных GPU-серверов; подходит для reasoning-задач, RAG, агентных рабочих процессов и производственного инференса с высоким запасом качества.
MiniMax-M3 Нет Примерно 854GB Полноразмерная версия для серверов с большим запасом памяти; подходит для reasoning-задач, RAG, агентных сценариев и стабильного production-инференса без агрессивной квантизации.
MiMo-V2.5-Pro Нет Примерно 1.03TB Крупная Pro-версия для серверов с большим объёмом GPU-памяти; подходит для сложных reasoning-задач, RAG, агентных сценариев и production-инференса с высоким запасом качества.

Совместимость с диффузионными моделями

Модель Тип Совместимость Примечание
Stable Diffusion XL 1.0 Текст в изображение GB300 NVL72 легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском графических пайплайнов.
Flux.2-dev Текст в изображение Масштаб системы позволяет повышать разрешение, ускорять обработку и одновременно обслуживать большое число генеративных очередей.
SD Turbo Быстрые предпросмотры Подходит для экстремально высокой параллельности и быстрого создания большого количества превью в продуктивных рабочих потоках.
Kandinsky-5.0-T2I-Lite-sft-Diffusers Текст в изображение Можно одновременно запускать множество независимых генеративных пайплайнов с большим запасом по памяти и вычислительным ресурсам.
Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers Текст в видео Платформа хорошо подходит для параллельной генерации коротких видеороликов и ускорения тяжёлых видеодиффузионных сценариев.
NVIDIA-Cosmos3-Super Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями Модель объёмом 133 GB для генерации, анализа и симуляции физического мира. Работает с текстом, изображениями, видео и действиями, поэтому подходит для сложных мультимодальных сценариев. Требует высокой производительности и большого объёма видеопамяти, а стабильность запуска зависит от конкретной конфигурации и настроек оптимизации.
Задать вопрос

Наличие на складах (0 шт.)

Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Позиция временно отсутствует на складе. Ваш заказ будет отправлен с другого склада. В случае если вам требуется самовывоз, менеджер согласует бесплатное перемещение на нужный склад.
Доступно бесплатное перемещение с другого склада в течении 1-2 рабочих дней

Мы отправляем заказы ведущими транспортными компаниями:

  • CDEK
  • Деловые линии
  • ПЭК

Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.


Ориентировочные сроки сборки заказов:

  • Серверные комплектующие: 1-2 раб. дня.
  • Серверы: 1-4 раб. дня.
  • Перемещение между офисами (МСК-СПБ): 1-2 раб. дня.

В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.


Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:

  • Безналичная оплата по счету (для организаций)
  • Онлайн оплата банковской картой ЮКасса (SberPay, T-Pay, СБП)
Узнать больше

ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.

Также мы можем предложить расширенный срок гарантийных отношений:


входит в стоимость
91 445 890
137 168 835
182 891 780
228 614 725

Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.


Подробнее об условиях гарантии ServerFlow

ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.

Почему Trade-in в ServerFlow — это удобно:

  • Оперативная оценка оборудования. Оператор онлайн чата постарается в течении 30 минут дать оценку оборудованию.
  • Конструктивный диалог. Если вы не согласны с предложенной стоимостью мы постараемся найти компромисс.
  • Забор оборудования. После согласования Trade-in мы согласуем курьерскую доставку от двери, а если вам удобно лично посетить наш офис в Москве или Санкт-Петербурге.
  • Тестирование и подтверждение скидки. Технические инженеры ServerFlow проверяет стабильность вашего оборудования. В случае подтверждения стабильности мы утвердим скидку на оборудование.
Скидка 1 500 ₽ за обратную связь

Поделитесь впечатлением о работе ServerFlow после получения заказа.

* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.

nvidia
+200
Цена с учетом расширенной гарантии

Цена включает НДС 7%

914 458 900 руб.

Узнать сроки доставки

добавить В корзину
Гарантия 1 год с заменой компонентов
Доставка СДЭК и ведущими службами доставки
Тестируем оборудование
перед отправкой
Под заказ
914 458 900 руб. Цена включает НДС 7%
добавить В корзину

Похожие товары

GIGABYTE XL43-ZX0-AAS2 (8x H200 NVL 141GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE AI TOP ATOM (GB10 Grace Superchip, ARM v9.2-A (GB10), RAM 128GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE XL44-SX2-AAS1 (8x H200 NVL 141GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro ARS-221GL-NR (2× H100 NVL 94GB, 2× Grace, RAM 960GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
GIGABYTE XL43-ZX0-AAS2 (8x RTX PRO 6000 BSE 96GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro SYS-221GE-NR (4x RTX PRO 6000 BSE 96GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Supermicro AS-A126GS-TNBR (8× B200 SXM 180GB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Huawei Atlas 800I A3 (8× Ascend 910C 128GB, 4× Kunpeng 920, RAM 2TB)
Санкт-Петербург, ул. Заозёрная, 8, корп. 2Л
Временно нет в наличии
Москва, 2-я Брестская ул., 39 с4
Временно нет в наличии
Подробнее
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)