Цена с учетом расширенной гарантии
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
| Тип | Новые |
| Основная задача | Инференс / Дообучение моделей / RAG-системы / Анализ данных / Визуализация и рендеринг |
| Процессор (CPU) | AMD Ryzen AI Max+ 495 |
| Видеокарта (GPU) | AMD Radeon 8065S (Встроенная) |
| Количество GPU, шт | 1 |
| Общий объем видеопамяти (VRAM), ГБ | 192 |
| Тип памяти GPU | LPDDR5x |
| Объем оперативной памяти (RAM), ГБ | 192 |
| Тип оперативной памяти | LPDDR5x |
| Форм-фактор | SFF |
MINISFORUM MS-S1 MAX-P495 - компактная AI-рабочая станция на базе AMD Ryzen AI Max+ PRO 495, объединяющего 16-ядерный процессор Zen 5, встроенную графику Radeon 8065S с 40 вычислительными блоками RDNA 3.5 и отдельный NPU AMD Ryzen AI. Такая архитектура позволяет распределять задачи между CPU, GPU и NPU: процессор отвечает за подготовку данных и общую логику приложений, Radeon 8065S - за параллельные AI-вычисления и графику, а NPU - за энергоэффективные нейросетевые нагрузки. Система подходит для Инференса / Развертывания (Inference), RAG-систем (Retrieval-Augmented Generation), Дообучения моделей (Fine-tuning), Анализа данных (Data Science), Визуализации и рендеринга и Видеоаналитики / Видеонаблюдения.
Главное преимущество этой конфигурации - 192GB LPDDR5X-8533 unified memory, общей для CPU и GPU, из которой MINISFORUM позволяет выделять под графические задачи до 160GB VRAM. Благодаря этому MS-S1 MAX-P495 способен локально размещать значительно более крупные LLM, чем обычные рабочие станции с дискретными видеокартами на 16-32GB. Система обеспечивает до 131 TOPS общей AI-производительности и до 55 TOPS на NPU, а большой единый пул памяти особенно полезен для локальных LLM, длинного контекста, RAG, мультимодальных моделей и нескольких одновременно работающих AI-сервисов.
Для AI-задач платформа ориентирована на экосистему AMD ROCm, а также совместимые сборки llama.cpp, Ollama, LM Studio, ONNX Runtime, PyTorch и других инструментов. При этом unified memory не является серверной HBM-памятью, поэтому большая ёмкость не означает производительность уровня многопроцессорных GPU-серверов с H100/B200. MS-S1 MAX-P495 лучше всего подходит для локального inference, разработки AI-агентов, RAG, LoRA/QLoRA fine-tuning, генерации изображений и видео, а не для полноценного обучения крупных LLM с нуля.
| Категория | Мощность |
| Overall | 131 TOPS |
| NPU | 55 TOPS |
| Модель | Тип квантизации | Требуется VRAM | Совместимость | Примечание |
| Qwen3.8-27B | Нет | Примерно 55.6GB | ✅ | Модель уверенно размещается в памяти MINISFORUM MS-S1 MAX-P495 и подходит для reasoning, программирования, RAG и локальных AI-агентов. Большой объём unified memory оставляет хороший запас под длинный контекст, KV-cache и дополнительные сервисы. |
| DeepSeek-V4-Flash-0731-GGUF | UD-Q4_K_XL | Примерно 155 | ✅ | Модель находится близко к верхней границе доступной графике unified memory, поэтому лучше использовать оптимизированный GGUF-бэкенд, умеренный контекст и небольшой batch. При корректном распределении памяти подходит для локального reasoning, RAG и агентных сценариев. |
| gpt-oss-120b-GGUF | Q4_K_M | Примерно 62.8GB | ✅ | Q4-версия комфортно размещается в 192GB unified memory и подходит для reasoning, RAG и локального production-инференса. Остаётся заметный запас под KV-cache, длинный контекст и системные процессы. |
| GLM-5.3-Flash-GGUF | UD-IQ4_XS | Примерно 157GB | ✅ | Модель практически полностью использует доступный графике объём памяти, поэтому для стабильного запуска желательно ограничивать контекст и batch, а также использовать оптимизированный GGUF-рантайм. Подходит для диалогов, RAG и локального inference при аккуратной настройке памяти. |
| Gemma-4-31B-it | Нет | Примерно 62.6GB | ✅ | Модель уверенно помещается в unified memory и оставляет большой запас под контекст, KV-cache и дополнительные AI-сервисы. Хорошо подходит для локальных ассистентов, RAG и повседневного inference. |
| NVIDIA-Nemotron-3-Super-120B-A12B-GGUF | UD-Q4_K_M | Примерно 82.5GB | ✅ | Модель хорошо помещается в 192GB unified memory и подходит для reasoning, RAG и агентных задач. Запаса памяти достаточно для одного полноценного инстанса с контекстом и KV-cache, а скорость зависит от оптимизации backend под Radeon 8065S. |
| Модель | Тип | Совместимость | Примечание |
| Stable Diffusion 3 Medium (SD3-M) | Текст в изображение | ✅ | Radeon 8065S и большой пул unified memory хорошо подходят для локальной генерации изображений высокого разрешения, ControlNet и сложных пайплайнов. Скорость зависит от используемого AMD-бэкенда, разрешения и размера batch. |
| FLUX.2-klein-9B | Текст в изображение | ✅ | Модель хорошо подходит для локальной генерации и прототипирования. 192GB unified memory дают большой запас под дополнительные энкодеры, upscale-модели и сложные ComfyUI-пайплайны без жёстких ограничений по памяти. |
| Stable Video Diffusion 1.1 (SVD 1.1) | Видео (img2vid) | ✅ | Большой объём unified memory удобен для хранения кадров, латентов и промежуточных буферов при img2vid-генерации. Платформа подходит для локального создания коротких роликов, а итоговая скорость зависит от разрешения и оптимизации Radeon 8065S. |
| Kandinsky-5.0-T2I-Lite-sft-Diffusers | Текст в изображение | ✅ | Для MS-S1 MAX-P495 это относительно лёгкая генеративная модель. Большой запас unified memory позволяет использовать повышенное разрешение, дополнительные стадии обработки и более сложные T2I-пайплайны. |
| Kandinsky-5.0-T2V-Lite-sft-5s-Diffusers | Текст в видео | ✅ | Платформа подходит для локальной генерации короткого видео и многостадийных T2V-пайплайнов. 192GB unified memory дают большой запас под кэши и промежуточные буферы, хотя скорость рендера определяется производительностью Radeon 8065S и выбранного backend. |
Мы отправляем заказы ведущими транспортными компаниями:
Все отправления тщательно упаковываются и скорейшие сроки передаются в ТК.
Ориентировочные сроки сборки заказов:
В случае если оборудование требуется в срочном порядке сообщите менеджеру и мы организуем приоритетную обработку вашего заказа с учетом выбора тарифа “Экспресс” со стороны ТК.
Оплата заказа доступна после подтверждения менеджером посредством следующих способов оплаты:
ServerFlow — это интернет магазин специализирующийся на продаже Б/У и новой серверной техники. Все наше оборудование проходит строгий процесс предпродажной подготовки. Мы уделяем большое внимание тестированию всех компонентов, чтобы минимизировать вероятность возникновения гарантийных случаев и обеспечить высокое качество продукции.
Также мы можем предложить расширенный срок гарантийных отношений:
Мы верим, что сможем обеспечить наилучший пользовательский опыт и ценим ваше доверие. Если у вас остались дополнительные вопросы, вы можете адресовать их в онлайн чате на сайте или задать в Telegram @serverflow.
ServerFlow активно занимается б/у оборудованием, поэтому мы готовы рассмотреть ваше оборудование в качестве основания для предоставления скидки в рамках “Trade-in”. Чтобы произвести оценку оборудования обратитесь в онлайн чат на сайте или в Telegram @serverflow.
Почему Trade-in в ServerFlow — это удобно:
Поделитесь впечатлением о работе ServerFlow после получения заказа.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена
бесплатная доставка до ПВЗ СДЭК.
Цена включает НДС 7%
Узнать сроки доставки
40-60 раб. дней —
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.