Цена с учетом расширенной гарантии
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
| Тип | Новые |
| Основная задача | Инференс / Дообучение моделей / RAG-системы / Анализ данных / Визуализация и рендеринг |
| Процессор (CPU) | NVIDIA Grace |
| Видеокарта (GPU) | NVIDIA Blackwell RTX |
| Количество GPU, шт | 1 |
| Общий объем видеопамяти (VRAM), ГБ | 128 |
| Тип памяти GPU | LPDDR5x |
| Объем оперативной памяти (RAM), ГБ | 128 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | SFF |
Lenovo SFF RTX Spark - компактная AI-рабочая станция на базе NVIDIA RTX Spark N1X Superchip, объединяющего 20-ядерный NVIDIA Grace CPU архитектуры ARM v9.2 и интегрированный NVIDIA Blackwell RTX GPU с 6144 CUDA-ядрами. Процессор использует комбинацию производительных Cortex-X925 и энергоэффективных Cortex-A725 ядер, а GPU берёт на себя основные параллельные AI- и графические вычисления. Такая конфигурация подходит для Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Дообучения моделей (Fine-tuning), Анализа данных (Data Science), Визуализации и рендеринга и Видеоаналитики / Видеонаблюдения.
Главное преимущество платформы - 128GB LPDDR5X unified memory, общей для CPU и GPU, с пропускной способностью до 300 GB/s. Благодаря единому пулу памяти система может локально размещать значительно более крупные LLM и мультимодальные модели, чем обычные ПК с дискретными видеокартами на 16-32GB VRAM. RTX Spark N1X обеспечивает до 1 PFLOP FP4 AI-производительности, а архитектура Blackwell поддерживает современные Tensor Core вычисления и полный NVIDIA CUDA-стек. Это делает систему особенно удобной для локальных AI-агентов, RAG, coding assistants, генеративных моделей и работы с длинным контекстом.
Платформа работает под Windows 11 on ARM и при этом нативно поддерживает CUDA, что заметно отличает её от большинства ARM-компьютеров. NVIDIA также ориентирует RTX Spark на творческие задачи, включая AI-графику, локальную генерацию видео, рендеринг крупных сцен и работу с NVIDIA Studio.
| Тип точности | Мощность |
| FP4 * | 1 PFLOP |
| FP4 | 0.5 PFLOP |
| FP8 * | 0.5 PFLOP |
| FP8 | 0.25 PFLOP |
| FP16 * | 0.25 PFLOP |
| FP16 | 0.125 PFLOP |
* - С структурной разреженностью
| Модель | Тип квантизации | Требуется VRAM | Совместимость | Примечание |
| DeepSeek-R1-Distill-Qwen-32B | Нет | Примерно 65.5GB | ✅ | На Lenovo SFF RTX Spark модель уверенно размещается в 128GB unified memory и подходит для reasoning, программирования, RAG и локальных AI-агентов. Остаётся хороший запас памяти под KV-cache, контекст и системные процессы. |
| gpt-oss-120b-Derestricted.MXFP4_MOE-gguf | MXFP4_MOE (FP4 смешанный MoE) | Примерно 63GB | ✅ | FP4-версия хорошо соответствует возможностям RTX Spark N1X и комфортно помещается в 128GB unified memory. Подходит для сложного reasoning, RAG и agentic AI с запасом под KV-cache и длинный контекст. |
| Qwen3.8-27B-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 21.9GB | ✅ | Для Lenovo SFF RTX Spark это сравнительно лёгкая NVFP4-модель, которую удобно использовать для локальных чат-ботов, AI-кодинга, RAG и агентных сценариев с длинным контекстом и повышенным batch. |
| GLM-4.5-Air-nvfp4 | NVFP4 (FP4 для NVIDIA) | Примерно 62GB | ✅ | Хорошо подходит для локального inference на RTX Spark N1X. Объём 128GB unified memory оставляет запас под потоковый вывод, длинный контекст, RAG и несколько параллельных пользовательских сессий. |
| Gemma-4-31B-IT-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 32.7GB | ✅ | Модель запускается с большим запасом unified memory и хорошо подходит для локальных ассистентов, RAG, AI-кодинга и параллельной работы нескольких сервисов. |
| NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 | NVFP4 (FP4 для NVIDIA) | Примерно 80.4GB | ✅ | Модель помещается в 128GB unified memory и подходит для сложных reasoning-, RAG- и agentic-задач. Для стабильной работы желательно оставлять резерв под KV-cache, длинный контекст, Windows и другие системные процессы. |
| Модель | Тип | Совместимость | Примечание |
| Stable Diffusion 3 Medium (SD3-M) | Текст в изображение | ✅ | Blackwell RTX GPU в Lenovo SFF RTX Spark хорошо подходит для локальной генерации изображений высокого разрешения, а 128GB unified memory дают большой запас под ControlNet, дополнительные модели и сложные графические пайплайны. |
| FLUX.1-schnell-onnx | Текст в изображение | ✅ | Хороший вариант для быстрого локального inference. RTX Spark N1X позволяет использовать NVIDIA-оптимизированные backend, ONNX Runtime и CUDA-ускорение для снижения задержки и стабильной генерации изображений. |
| Stable Video Diffusion 1.1 (SVD 1.1) | Видео (img2vid) | ✅ | 128GB unified memory позволяют размещать видеобуферы, латенты и промежуточные данные без жёсткого дефицита памяти. Lenovo SFF RTX Spark подходит для локальной генерации коротких роликов, а скорость зависит от разрешения, длины видео и используемого backend. |
| Kandinsky-5.0-T2I-Lite-sft-Diffusers | Текст в изображение | ✅ | Для Lenovo SFF RTX Spark это сравнительно лёгкая генеративная модель. Большой объём unified memory позволяет использовать высокое разрешение, дополнительные стадии обработки и более сложные T2I-пайплайны. |
| Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers | Текст в видео | ✅ | Платформа подходит для локальной генерации коротких T2V-роликов. 128GB unified memory дают запас под кэши, промежуточные буферы и многостадийные видеопайплайны, а CUDA ускоряет поддерживаемые операции. |
| Wan-NVFP4 | Текст в изображение | ✅ | NVFP4-версия хорошо соответствует архитектуре Blackwell RTX и возможностям RTX Spark N1X. Низкое потребление памяти оставляет большой запас под разрешение, дополнительные модели и сложные production-пайплайны. |
Мы отправляем заказы ведущими транспортными компаниями:
Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.
Ориентировочные сроки сборки заказов:
В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.
Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:
ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.
Также мы можем предложить расширенный срок гарантийных отношений:
Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.
ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.
Почему Trade-in в ServerFlow — это удобно:
Поделитесь впечатлением о работе ServerFlow после получения заказа.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.