Компания Liqid в партнерстве с AMD представила новую аппаратную платформу UltraStack 30, спроектированную для крупномасштабного ИИ-инференса. Решение базируется на 30 ускорителях AMD Instinct MI350P в составе единого серверного узла под управлением 2 центральных процессоров AMD EPYC 9005 Turin, устраняя накладные расходы многоузловых кластеров и принципиально меняя экономику генерации токенов. Платформа нацелена на обслуживание больших языковых моделей, работу с длинными контекстами, мультимодельный сервинг, агентный ИИ, RAG и векторный поиск, а также на высокопроизводительные научные вычисления. Заявленные характеристики включают 4,3 ТБ агрегированной памяти HBM3E, пиковую производительность 69 PFLOPS в формате FP8 и суммарное энергопотребление около 22 кВт.
Подробнее о Liqid UltraStack 30
Архитектура UltraStack 30 построена вокруг центрального двухсокетного сервера на базе CPU AMD EPYC 9005, который через коммутатор Liqid PCIe Fabric Switch соединяется с 3 внешними шасси. В каждом внешнем шасси размещено по 10 ИИ-ускорителей Instinct MI350P с 144 ГБ памяти HBM3E, 4096-битной шиной и интерфейсом PCIe, что дает суммарный объем видеопамяти 4,3 ТБ. Все 30 GPU объединяются в единый пул, управляемый программным обеспечением Liqid Matrix. Matrix в реальном времени распределяет ИИ-ускорители между рабочими нагрузками по высокоскоростной шине PCIe. Это исключает многоузловые задержки, обеспечивает предсказуемое линейное масштабирование и доводит загрузку GPU практически до 100%. Платформа поддерживает Kubernetes для мультимодельного сервинга из коробки и готова к подключению пулов памяти CXL 3.0, что в перспективе открывает путь к расширению общего пула памяти до терабайтных значений, который будет использоваться для хранения KV-кэша и других ресурсоемких нагрузок. Взаимодействие между ускорителями реализовано через традиционную peer-to-peer коммуникацию.
Liqid приводит детальные метрики превосходства над традиционными серверными архитектурами, в которых обычно установлено от 2 до 8 GPU и которые вынуждают разносить большие модели по нескольким системам. UltraStack 30 демонстрирует до 3,7 раза больше токенов в секунду, в 2,1 раза больше токенов на доллар и в 1,8 раза больше токенов на ватт по сравнению с базовыми многоузловыми конфигурациями. Затраты на развертывание сокращаются на 65%, а энергопотребление — на 50%. Удельная производительность достигает 3,14 PFLOPS/кВт, а плотность HBM — 195 ГБ/кВт и 62 ГБ/PFLOPS. Таким образом, одна система UltraStack 30 способна заменить 4 и более обычных серверов при обработке аналогичных по масштабу ИИ-моделей.
Выводы
Несмотря на то, что AMD уже представила новое поколение центральных процессоров и графичесих ускорителей, спрос на решения EPYC 9005 Turin и ИИ-ускорители Instinct MI350P с интерфейсом PCIe не только не падает, но и растет по экспоненте, и Liqid со своей системой UltraStack 30 готова максимально удовлетворить потребности клиентов, ищущих новый, более эффективный способ конвертировать оборудование AMD в прибыль. Liqid UltraStack 30 решает главную проблему современных инференсных инфраструктур — фрагментацию GPU-памяти по множеству физических узлов. Консолидация 30 ускорителей в единый пул под управлением одного сервера позволяет обслуживать тяжелые LLM и контекстно-зависимые сценарии без дорогих межсерверных сетей и с практически полной загрузкой ускорителей. При производительности 69 PFLOPS FP8 и 4,3 ТБ HBM3E на 22 кВт UltraStack 30 задает новый ориентир плотности и экономической эффективности для инференса больших моделей в частных дата-центрах.
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Скидка 1 500 ₽ или бесплатная доставка - уже сейчас 🔥
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.
Продолжная использовать наш сайт, вы даете согласие на использование файлов Cookie, пользовательских данных (IP-адрес, вид операционной системы, тип браузера, сведения о местоположении, источник, откуда пришел на сайт пользователь, с какого сайта или по какой рекламе, какие страницы
открывает и на какие страницы нажимает пользователь) в целях функционирования сайта, проведения статистических исследований и обзоров. Если вы не хотите, чтобы ваши данные обрабатывались, покиньте сайт.
При оформлении заказа в ServerFlow вы можете сообщить о намерении оставить отзыв о нашей работе после получения товара.
Нам важно ваше честное мнение. Оно помогает развивать сервис и даёт другим клиентам представление о нашей работе.
Вы можете оставить отзыв на удобной для вас платформе:
Google Maps
2GIS
Яндекс Карты
Как работает акция
Применяя промокод, вы подтверждаете намерение поделиться впечатлением о работе ServerFlow после получения заказа. Мы применяем бонус уже к текущему заказу в знак благодарности за обратную связь.
Условия акции:
скидка 1 500 ₽ при заказе от 30 000 ₽
или бесплатная доставка* при заказе до 30 000 ₽
* Бесплатная доставка заказа осуществляется до ПВЗ СДЭК.