Компании AMD и Cerebras объявили о техническом партнерстве, в рамках которого они создадут совершенно новые дезагрегированные ИИ-решения для инференса с рекордно низкой задержкой. Представленные на Advancing AI 2026, новые стоечные системы будут совмещать графические ускорители AMD Instinct MI455X и тензорные ускорители Cerebras Wafer-Scale Engine 3 в едином кластере и рабочем процессе. Разработка нацелена на сегмент наиболее чувствительных к задержкам приложений, от real-time-ассистентов и агентных систем до робототехники и научных расчетов, и обещает 5-кратное повышение производительности на ватт по сравнению с традиционными GPU-подходами. Доступ к решению откроется во второй половине 2026 года через облачную платформу Cerebras Cloud.
Подробнее о сотрудничестве AMD и Cerebras
Современные нагрузки инференса искусственного интеллекта все сильнее поляризуются: более массовые ИИ-сценарии требуют максимальной скорости генерации токенов, тогда как задачи кодинга ИИ-ассистентов, агентов реального времени требуют минимального времени отклика. Это расслоение формирует спрос на гетерогенную инфраструктуру, способную адресовать разные стадии обработки запросов разными вычислительными архитектурами. AMD и Cerebras ответили на этот вызов концепцией дезагрегированного инференса, подобно тому, как Nvidia объединила мощности Rubin с решениями Groq.
В основе ИИ-стоек AMD и Cerebras лежит принцип разделения классического конвейера на два этапа. Первый — обработка промптов, больших контекстных окон и массивных параллельных запросов, который закрепляется за стойками AMD Helios, построенными на базе AMD EPYC 9006 Venice и Instinct MI455X. Helios будут выступать в роли высокопроизводительного движка пропускной способности и обеспечивает масштабируемую обработку сложных запросов. Второй этап — генерация токенов с минимальной задержкой, узким местом которого традиционно является пропускная способность памяти, который передается “Царь-чипам” Cerebras Wafer-Scale Engine 3, спроектированных для сверхбыстрой потоковой выдачи данных.
Характеристики AMD Instinct MI455X и Cerebras WSE-3. Источник: .
Интеграция двух машин в единый инференс-пайплайн позволяет достичь характеристик, недоступных при использовании каждого из решений по отдельности. AMD подчеркивает, что Helios обеспечивает лидирующую в отрасли масштабируемость и производительность для самого широкого спектра инференс-нагрузок, а Cerebras добавляет уникальные показатели по скорости декодирования. Суммарный выигрыш — пятикратное увеличение токенов в секунду на ватт. Cerebras уже планирует развертывание систем AMD Helios в собственных ЦОД, и уже во второй половине 2026 года совместные решения будут доступны в облаке Cerebras Cloud.
Снижение задержек и увеличение токенов/с на ватт за счет совместного использования AMD Helios и Cerebras WSE. Источник: .
Выводы
Партнерство AMD и Cerebras можно расценивать как прямой ответ на стратегию Nvidia с ее интеграцией ИИ-чипов Groq в экосистему Rubin, и оба подхода выполняют буквально одну и ту же задачу — свести задержки к минимуму. Примечательно, что именно чипы WSE-3 обладают наибольшей скоростью генерации токенов, и с ней не могут сравниться даже передовые чипы Groq 3 LPU, поэтому у AMD есть явное преимущество в этом секторе. Однако точно ли у красной компании удастся утереть нос своему главному зеленому конкуренту в сегменте дезагрегированного ультралатентного инференса — узнаем лишь во второй половине 2026 года, когда совмещенные ИИ-стойки появятся в облаке Cerebras.
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Скидка 1 500 ₽ или бесплатная доставка - уже сейчас 🔥
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.
Продолжная использовать наш сайт, вы даете согласие на использование файлов Cookie, пользовательских данных (IP-адрес, вид операционной системы, тип браузера, сведения о местоположении, источник, откуда пришел на сайт пользователь, с какого сайта или по какой рекламе, какие страницы
открывает и на какие страницы нажимает пользователь) в целях функционирования сайта, проведения статистических исследований и обзоров. Если вы не хотите, чтобы ваши данные обрабатывались, покиньте сайт.
При оформлении заказа в ServerFlow вы можете сообщить о намерении оставить отзыв о нашей работе после получения товара.
Нам важно ваше честное мнение. Оно помогает развивать сервис и даёт другим клиентам представление о нашей работе.
Вы можете оставить отзыв на удобной для вас платформе:
Google Maps
2GIS
Яндекс Карты
Как работает акция
Применяя промокод, вы подтверждаете намерение поделиться впечатлением о работе ServerFlow после получения заказа. Мы применяем бонус уже к текущему заказу в знак благодарности за обратную связь.
Условия акции:
скидка 1 500 ₽ при заказе от 30 000 ₽
или бесплатная доставка* при заказе до 30 000 ₽
* Бесплатная доставка заказа осуществляется до ПВЗ СДЭК.