Цена с учетом расширенной гарантии
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
| Тип | Новые |
| Основная задача | Обучение моделей / Инференс / Дообучение моделей / RAG-системы / Анализ данных / Научные расчеты (HPC) / Визуализация и рендеринг |
| Процессор (CPU) | NVIDIA GB200 (Grace) |
| Видеокарта (GPU) | NVIDIA GB200 (Blackwell) |
| Количество GPU, шт | 72 |
| Общий объем видеопамяти (VRAM), ГБ | 13392 |
| Тип памяти GPU | HBM3e |
| Объем оперативной памяти (RAM), ГБ | 17856 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | 48U |
Inventec Artemis Rack GB200 NVL72 - это полностью интегрированная rack-scale AI-платформа на базе 36 NVIDIA GB200 Grace Blackwell Superchip, объединяющая 72 Blackwell GPU и 36 Grace CPU. Система предназначена для Обучения моделей (Training), Дообучения моделей (Fine-tuning), Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Анализа данных (Data Science) и HPC / Научных расчётов. Архитектура рассчитана на крупные LLM, MoE- и reasoning-модели, агентные AI-системы и высоконагруженные корпоративные сервисы.
Платформа располагает суммарно 13,4 ТБ HBM3e GPU-памяти с пропускной способностью до 576 ТБ/с и 17 ТБ LPDDR5X CPU-памяти. Пятое поколение NVIDIA NVLink объединяет все 72 GPU в единый высокоскоростной домен с пропускной способностью до 130 ТБ/с, что особенно важно для распределённого обучения, длинных контекстов, больших KV-cache и масштабного inference-serving. Архитектура Blackwell поддерживает NVFP4, FP8/FP6, FP16/BF16, INT8, TF32, FP32 и FP64, позволяя оптимизировать систему как под высокоплотный инференс, так и под обучение и HPC.
Inventec Artemis построен на NVIDIA MGX и рассчитан на высокую плотность вычислений до 125 кВт на стойку. Для отвода тепла предусмотрены различные варианты жидкостного охлаждения, включая rack-mounted, sidecar и row-based схемы, а также собственный CDU Inventec и контроль утечек. Система не ориентирована на классическую рабочую визуализацию или обычное видеонаблюдение: её основной профиль - масштабный AI, обучение и дообучение LLM, RAG, agentic AI, production-serving и научные вычисления.
| Тип точности | Совокупная мощность системы |
| FP4 (NVFP4) Tensor core | 1440 PFLOPS |
| FP8 Tensor core | 720 PFLOPS |
| FP6 Tensor core | 720 PFLOPS |
| FP16 Tensor core | 360 PFLOPS |
| BF16 Tensor core | 360 PFLOPS |
| FP32 | 6 PFLOPS |
| TF32 Tensor core | 180 PFLOPS |
| FP64 Tensor core | 3 PFLOPS |
| INT8 | 720 POPS |
| Модель | Тип квантизации | Требуется VRAM | Совместимость | Примечание |
| DeepSeek-V4-Pro | Нет | Примерно 865GB | ✅ | Inventec Artemis Rack уверенно запускает модель с большим запасом HBM3e под длинный контекст, KV-cache, крупные батчи и высокий параллелизм reasoning-запросов. |
| Qwen3.5-397B-A17B / Qwen3.6-35B-A3B | Нет | Примерно 807GB / 71.9 GB | ✅ | Первая модель подходит для тяжёлого распределённого serving и RAG на NVLink-домене, а вторую удобно масштабировать на большое число параллельных инстансов с высокой плотностью запросов. |
| Gpt-oss:120b | Нет | Примерно 196GB | ✅ | Для Artemis Rack это сравнительно лёгкая модель: платформа позволяет одновременно обслуживать множество инстансов, длинные контексты и высокий concurrency с большим запасом под KV-cache. |
| GigaChat3.5-432B-A28B-bf16 | Нет | Примерно 868GB | ✅ | Inventec Artemis Rack подходит для крупномасштабного BF16-инференса этой модели, включая длинный контекст, большие батчи, RAG и параллельное обслуживание корпоративных пользователей. |
| Mistral-Large-3-675B-Instruct-251 | Нет | Примерно 682GB | ✅ | Платформа даёт большой резерв GPU-памяти для длинных контекстных окон, крупных батчей, корпоративного serving и высокой плотности одновременных RAG- и agentic-запросов. |
| GLM-5.2 | Нет | Примерно 1.51TB | ✅ | Модель такого класса комфортно размещается в суммарной HBM3e-памяти Artemis Rack, оставляя значительный резерв под KV-cache, длинные контексты и масштабный production-инференс. |
| Gemma-4-31B-IT-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 32.7GB | ✅ | Для Inventec Artemis Rack это крайне лёгкая модель, которую удобно разворачивать в большом числе параллельных NVFP4-инстансов с длинным контекстом и высокой плотностью запросов. |
| NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 80.4GB | ✅ | Artemis Rack запускает модель с огромным запасом по памяти и NVFP4-производительности, что удобно для множества инстансов, длинного контекста и высоконагруженного agentic serving. |
| Kimi-K3 | Нет | Примерно 1.56TB | ✅ | Полноразмерная модель хорошо подходит для 72-GPU NVLink-домена Artemis Rack и может использоваться для тяжёлых reasoning-задач, RAG, агентных процессов и production-serving. |
| MiniMax-M3 | Нет | Примерно 854GB | ✅ | Inventec Artemis Rack позволяет запускать полноразмерную модель без агрессивной квантизации, сохраняя большой запас под контекст, KV-cache и высокую параллельность production-запросов. |
| MiMo-V2.5-Pro | Нет | Примерно 1.03TB | ✅ | Крупная Pro-версия комфортно размещается на Artemis Rack и подходит для сложных reasoning-задач, RAG, агентных сценариев и масштабного инференса с большим запасом HBM3e. |
| Модель | Тип | Совместимость | Примечание |
| Stable Diffusion XL 1.0 | Текст в изображение | ✅ | Inventec Artemis Rack легко справляется с high-res генерацией, крупными батчами и массовым параллельным запуском генеративных пайплайнов уровня AI-фабрики. |
| Flux.2-dev | Текст в изображение | ✅ | Большой объём HBM3e и 72 Blackwell GPU позволяют одновременно обслуживать множество тяжёлых генеративных очередей, повышать разрешение и увеличивать production-throughput. |
| SD Turbo | Быстрые предпросмотры | ✅ | Для этой платформы модель очень лёгкая и подходит для высокой плотности параллельных генераций, быстрых предпросмотров и массовой обработки запросов. |
| Kandinsky-5.0-T2I-Lite-sft-Diffusers | Текст в изображение | ✅ | Система позволяет одновременно запускать множество независимых T2I-пайплайнов с большим запасом HBM3e, вычислительной мощности и межGPU-пропускной способности. |
| Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers | Текст в видео | ✅ | Artemis Rack подходит для параллельной генерации коротких роликов, тяжёлых T2V-пайплайнов и production-сценариев с большим числом одновременных видеозадач. |
| NVIDIA-Cosmos3-Super | Генерации, анализа и симуляции физического мира, которая может работать с текстом, изображениями, видео и действиями | ✅ | Inventec Artemis Rack хорошо подходит для модели такого класса: 72 Blackwell GPU и NVLink-домен дают большой запас для мультимодальных world-model сценариев, видео, действий и симуляции физического мира. |
Мы отправляем заказы ведущими транспортными компаниями:
Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.
Ориентировочные сроки сборки заказов:
В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.
Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:
ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.
Также мы можем предложить расширенный срок гарантийных отношений:
Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.
ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.
Почему Trade-in в ServerFlow — это удобно:
Поделитесь впечатлением о работе ServerFlow после получения заказа.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.