Цена с учетом расширенной гарантии
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
| Тип | Новые |
| Парт.№ | VR200 |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг |
| Процессор (CPU) | NVIDIA Vera |
| Видеокарта (GPU) | NVIDIA Rubin |
| Количество GPU, шт | 72 |
| Общий объем видеопамяти (VRAM), ГБ | 21197 |
| Тип памяти GPU | HBM4 |
| Объем оперативной памяти (RAM), ГБ | 55296 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | 48U |
NVIDIA Vera Rubin NVL72 - это стоечный AI-суперкомпьютер нового поколения для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Платформа объединяет 36 Vera Rubin Superchip, внутри которых работают 72 NVIDIA Rubin GPU и 36 NVIDIA Vera CPU, формируя rack-scale систему для агентного ИИ, reasoning-моделей, триллионных LLM и длинных контекстов.
Ключевая особенность Vera Rubin NVL72 - переход на HBM4 и шестое поколение NVIDIA NVLink. Система располагает 20,7 ТБ HBM4 GPU-памяти с суммарной пропускной способностью до 1580 ТБ/с, а также 54 ТБ LPDDR5X CPU-памяти для обслуживания больших контекстов, KV-cache, data movement и агентных AI-нагрузок. NVLink 6 обеспечивает до 260 ТБ/с межGPU-связности на уровне стойки, что особенно важно для распределённого обучения, крупного inference-serving и моделей с сотнями миллиардов или триллионами параметров.
Rubin GPU поддерживает современные режимы точности NVFP4, FP8/FP6, FP16/BF16, TF32, INT8, FP32 и FP64. Для всей стойки NVIDIA заявляет до 3600 PFLOPS NVFP4 Inference, 2520 PFLOPS NVFP4 Training, 1260 PFLOPS FP8/FP6 Training и 288 PFLOPS FP16/BF16. При этом Vera Rubin NVL72 не является системой для классической визуализации, локального рендеринга или видеонаблюдения: её основной профиль - AI-фабрики, обучение, inference на триллионных моделях, agentic AI, RAG, HPC и масштабные корпоративные AI-сервисы.
| Тип точности | Совокупная мощность системы |
| FP4 (NVFP4) | 2520 PFLOPS |
| FP8 | 1260 PFLOPS |
| FP6 | 1260 PFLOPS |
| FP16 | 288 PFLOPS |
| BF16 | 288 PFLOPS |
| FP32 | 9360 TFLOPS |
| TF32 | 144 PFLOPS |
| FP32* | 28800 TFLOPS |
| FP64* | 14400 TFLOPS |
| INT8 | 18 POPS |
* - Максимальная производительность достигается за счет использования алгоритмов эмуляции на базе NVIDIA Tensor Core.
| Модель | Тип квантизации | Требуется VRAM | Совместимость | Примечание |
| DeepSeek-V4-Pro | Нет | Примерно 865GB | ✅ | VR200 NVL72 уверенно запускает модель с огромным запасом HBM4 под длинный контекст, KV-cache, крупные батчи и высокий параллелизм reasoning-запросов. |
| Qwen3.5-397B-A17B / Qwen3.6-35B-A3B | Нет | Примерно 807GB / 71.9 GB | ✅ | Первая модель подходит для тяжёлого распределённого serving и RAG-нагрузок, а вторую можно разворачивать в большом числе параллельных инстансов с высокой плотностью запросов. |
| Gpt-oss:120b | Нет | Примерно 196GB | ✅ | Для VR200 NVL72 это сравнительно лёгкая модель: система позволяет держать множество инстансов, длинный контекст, высокий concurrency и большой запас под KV-cache. |
| GigaChat3.5-432B-A28B-bf16 | Нет | Примерно 868GB | ✅ | VR200 NVL72 подходит для крупномасштабного инференса этой модели, включая BF16-serving, длинный контекст, большие батчи и параллельное обслуживание множества пользователей. |
| Mistral-Large-3-675B-Instruct-251 | Нет | Примерно 682GB | ✅ | Платформа даёт большой резерв для корпоративного serving, длинных контекстных окон, крупных батчей и высокой плотности одновременных agentic- и RAG-запросов. |
| GLM-5.2 | Нет | Примерно 1.51TB | ✅ | VR200 NVL72 рассчитан на модели такого класса и сохраняет крупный запас HBM4 под KV-cache, параллельные сессии, большие контексты и масштабный production-инференс. |
| Gemma-4-31B-IT-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 32.7GB | ✅ | Для VR200 NVL72 это крайне лёгкая модель, которую удобно масштабировать на большое число параллельных NVFP4-инстансов с длинным контекстом и очень высокой плотностью запросов. |
| NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 80.4GB | ✅ | VR200 NVL72 запускает такую модель с огромным запасом по памяти и производительности, что удобно для большого числа одновременных инстансов, длинного контекста и высоконагруженного agentic serving. |
| Модель | Тип | Совместимость | Примечание |
| Stable Diffusion XL 1.0 | Текст в изображение | ✅ | VR200 NVL72 легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском графических пайплайнов на уровне AI-фабрики. |
| Flux.2-dev | Текст в изображение | ✅ | Масштаб Vera Rubin NVL72 позволяет повышать разрешение, ускорять обработку и одновременно обслуживать большое число генеративных очередей. |
| SD Turbo | Быстрые предпросмотры | ✅ | Подходит для экстремально высокой параллельности, быстрых предпросмотров и генерации большого количества изображений в production-потоке. |
| Kandinsky-5.0-T2I-Lite-sft-Diffusers | Текст в изображение | ✅ | Можно одновременно запускать множество независимых генеративных пайплайнов с большим запасом HBM4, вычислительной мощности и межGPU-связности. |
| Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers | Текст в видео | ✅ | Платформа хорошо подходит для параллельной генерации коротких роликов, ускорения T2V-пайплайнов и масштабных видеодиффузионных сценариев. |
| NVIDIA-Cosmos3-Super | Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями | ✅ | Модель объёмом 133GB хорошо подходит для VR200 NVL72: система рассчитана на мультимодальные world-model сценарии, видео, действия, симуляцию физического мира и параллельный запуск сложных AI-пайплайнов. |
Мы отправляем заказы ведущими транспортными компаниями:
Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.
Ориентировочные сроки сборки заказов:
В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.
Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:
ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.
Также мы можем предложить расширенный срок гарантийных отношений:
Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.
ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.
Почему Trade-in в ServerFlow — это удобно:
Поделитесь впечатлением о работе ServerFlow после получения заказа.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.