Цена с учетом расширенной гарантии
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
| Тип | Новые |
| Парт.№ | DLB5-CB0 |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг |
| Процессор (CPU) | NVIDIA Vera |
| Видеокарта (GPU) | NVIDIA Rubin |
| Количество GPU, шт | 72 |
| Общий объем видеопамяти (VRAM), ГБ | 21197 |
| Тип памяти GPU | HBM4 |
| Объем оперативной памяти (RAM), ГБ | 55296 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | 48U |
GIGABYTE NVIDIA Vera Rubin NVL72 - это rack-scale AI-суперкомпьютер нового поколения на базе 36 NVIDIA Vera Rubin Superchip, объединяющий 72 Rubin GPU и 36 Vera CPU. Система предназначена для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Архитектура рассчитана прежде всего на trillion-scale LLM, reasoning-модели, agentic AI, крупные MoE-системы и высоконагруженные AI-фабрики.
Платформа располагает 20,7 ТБ HBM4 GPU-памяти с совокупной пропускной способностью до 1580 ТБ/с и 54 ТБ LPDDR5X CPU-памяти. Шестое поколение NVIDIA NVLink 6 объединяет 72 Rubin GPU в высокоскоростной вычислительный домен, обеспечивая эффективный обмен данными при распределённом обучении, длинных контекстах, больших KV-cache и масштабном inference-serving. GIGABYTE дополняет систему NVIDIA ConnectX-9 SuperNIC, BlueField-4 DPU, поддержкой Quantum-X800 InfiniBand или Spectrum-X Ethernet и собственным GIGABYTE POD Manager для управления AI-инфраструктурой.
Rubin GPU поддерживает современные AI-режимы NVFP4, FP8/FP6, FP16/BF16, INT8, TF32, FP32 и FP64, что позволяет использовать платформу как для высокоплотного инференса, так и для обучения и научных вычислений. Система имеет полностью жидкостное охлаждение и ориентирована именно на AI-фабрики и HPC-инфраструктуру; для обычного графического рендеринга или классического видеонаблюдения она избыточна и не является профильным решением.
| Тип точности | Совокупная мощность системы |
| FP4 (NVFP4) | 2520 PFLOPS |
| FP8 | 1260 PFLOPS |
| FP6 | 1260 PFLOPS |
| FP16 | 288 PFLOPS |
| BF16 | 288 PFLOPS |
| FP32 | 9360 TFLOPS |
| TF32 | 144 PFLOPS |
| FP32* | 28800 TFLOPS |
| FP64* | 14400 TFLOPS |
| INT8 | 18 POPS |
* - Максимальная производительность достигается за счет использования алгоритмов эмуляции на базе NVIDIA Tensor Core.
| Модель | Тип квантизации | Требуется VRAM | Совместимость | Примечание |
| DeepSeek-V4-Pro | Нет | Примерно 865GB | ✅ | GIGABYTE Vera Rubin NVL72 уверенно запускает модель с огромным запасом HBM4 под длинный контекст, KV-cache, крупные батчи и высокую параллельность reasoning-запросов. |
| Qwen3.5-397B-A17B / Qwen3.6-35B-A3B | Нет | Примерно 807GB / 71.9 GB | ✅ | Первая модель подходит для тяжёлого распределённого serving и RAG на NVLink 6, а вторую можно масштабировать на большое число параллельных инстансов с высокой плотностью запросов. |
| Gpt-oss:120b | Нет | Примерно 196GB | ✅ | Для GIGABYTE Vera Rubin NVL72 это сравнительно лёгкая модель: платформа позволяет одновременно обслуживать множество инстансов, длинные контексты и высокий concurrency с большим резервом памяти. |
| GigaChat3.5-432B-A28B-bf16 | Нет | Примерно 868GB | ✅ | Платформа подходит для крупномасштабного BF16-инференса этой модели, включая длинный контекст, большие батчи, RAG и параллельное обслуживание большого числа корпоративных пользователей. |
| Mistral-Large-3-675B-Instruct-251 | Нет | Примерно 682GB | ✅ | GIGABYTE Vera Rubin NVL72 даёт большой резерв HBM4 для длинных контекстных окон, крупных батчей, корпоративного serving и высокой плотности одновременных agentic- и RAG-запросов. |
| GLM-5.2 | Нет | Примерно 1.51TB | ✅ | Модель такого класса комфортно размещается в 20.7TB HBM4 системы, оставляя большой резерв под KV-cache, параллельные сессии, длинный контекст и масштабный production-инференс. |
| Gemma-4-31B-IT-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 32.7GB | ✅ | Для GIGABYTE Vera Rubin NVL72 это крайне лёгкая NVFP4-модель, которую удобно разворачивать в большом числе параллельных инстансов для высокоплотного и энергоэффективного inference-serving. |
| NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 80.4GB | ✅ | Платформа запускает модель с огромным запасом по HBM4 и NVFP4-производительности, что удобно для множества одновременных инстансов, длинного контекста и высоконагруженного agentic serving. |
| Модель | Тип | Совместимость | Примечание |
| Stable Diffusion XL 1.0 | Текст в изображение | ✅ | GIGABYTE Vera Rubin NVL72 легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском генеративных пайплайнов уровня AI-фабрики. |
| Flux.2-dev | Текст в изображение | ✅ | 20.7TB HBM4 и масштаб 72 Rubin GPU позволяют одновременно обслуживать большое число тяжёлых генеративных очередей, повышать разрешение и увеличивать throughput. |
| SD Turbo | Быстрые предпросмотры | ✅ | Для этой платформы модель очень лёгкая и подходит для экстремально высокой параллельности, мгновенных предпросмотров и массовой генерации изображений в production-среде. |
| Kandinsky-5.0-T2I-Lite-sft-Diffusers | Текст в изображение | ✅ | Можно одновременно запускать множество независимых T2I-пайплайнов, используя большой запас HBM4 и высокоскоростную связность NVLink 6 для масштабных генеративных нагрузок. |
| Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers | Текст в видео | ✅ | Платформа подходит для массовой параллельной генерации видео, тяжёлых T2V-пайплайнов и production-сценариев, где требуется высокая пропускная способность и большое число одновременных задач. |
| NVIDIA-Cosmos3-Super | Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями | ✅ | GIGABYTE Vera Rubin NVL72 особенно хорошо подходит для модели такого класса: 72 Rubin GPU, HBM4 и NVLink 6 рассчитаны на тяжёлые мультимодальные world-model сценарии, физический AI, видео, действия и масштабные симуляции. |
Мы отправляем заказы ведущими транспортными компаниями:
Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.
Ориентировочные сроки сборки заказов:
В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.
Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:
ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.
Также мы можем предложить расширенный срок гарантийных отношений:
Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.
ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.
Почему Trade-in в ServerFlow — это удобно:
Поделитесь впечатлением о работе ServerFlow после получения заказа.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.