Huawei заявила, что новое поколение ИИ-чипов Ascend 960DT и Ascend 960PR выйдет уже в 2027 году — компания выпустит передовые NPU ранее, чем ожидалось. Как сообщил сменный председатель совета директоров компании Дэвид Ван, в первом квартале 2027 года будет представлен Ascend 960DT, а в третьем квартале того же года — Ascend 960PR. Первоначально Ascend 960DT должен был выйти на три квартала позже, так что Huawei явно сокращает цикл разработки. Компания также раскрыла планы на будущее: в 2028 году ожидается релиз семейства ИИ-ускорителей Ascend 970, а еще через год — выпуск NPU Ascend 980.
Подробнее о решениях Huawei
ИИ-ускоритель Ascend 960DT, который выйдет в первом квартале 2027 года, поддерживает режимы вычислений FP32, FP16, FP8, а также передовые MXFP8, MXFP4 и собственные форматы HF32, HF8 и HiF4. В режиме FP4 NPU-ускоритель обеспечивает 2 PFLOPS производительности и 4 PFLOPS в режиме MXFP4. При этом решение оснащено 288 ГБ памяти HBM собственной разработки с пропускной способностью 9,6 ТБ/с. Ascend 960DT ориентирован в первую очередь на задачи ИИ-обучения, и он будет использоваться в новейших ИИ-кластерах Huawei SuperPod 960. Позднее, в третьем квартале 2027 года, выйдет ускоритель инференса Ascend 960PR, поддерживающий те же режимы вычислений, но обеспечивающий 2 PFLOPS в FP8 и уже 8 PFLOPS в MXFP4, при этом имеющий 192 ГБ памяти HBM с пропускной способностью 2,4 ТБ/с. Это все еще ниже производительности передовых ИИ-решений Nvidia B300 с производительностью 18 PFLOPS в режиме FP4, зато по объему памяти Ascend 960DT все-таки догнал конкурента.
В 2028 году компания также представит новое поколение ИИ-ускорителей Ascend 970 с 3,5 PFLOPS в FP8, 14 PFLOPS в MXFP4, 288 ГБ HBM с пропускной способностью 14,4 ТБ/с, а в 2029 году Huawei выпустит NPU Ascend 980 с очередным приростом характеристик: производительность до 7,2 FLOPS в FP8, до 28 PFLOPS в MXFP4, 384 ГБ памяти HBM с пропускной способностью 38,4 ТБ/с.
Ключевая особенность стратегии Huawei — ставка на объединение ИИ-ускорителей в крупные вычислительные кластеры. Для этого используется фирменный интерконнект UnifiedBus, которая упрощает соединение чипов в рамках одной стойки и для межстрочного соединения. Сейчас Huawei имеет для формирования полноценной ИИ-инфраструктуры 11 моделями процессоров для различных целей, от CPU Kunpeng и NPU Ascend до различных коммутационных чипов и контроллеров для хранения данных, и все они поддерживают интерфейс UnifiedBus, что позволяет компании формировать суперкластеры, объединяющие до 1 млн ИИ-чипов в системе. Это прямой ответ на западные санкции: вместо наращивания производительности отдельного ИИ-ускорителя компания компенсирует ограничения экстенсивным масштабированием инфраструктуры.
Уже более 1000 ИИ-систем Huawei SuperPod на основе Ascend 910C поставлены клиентам, а число покупателей серверных систем компании превысило 370. Со стороны программной экосистемы поддержку обеспечивают 5270 активных разработчиков, работающих с ускорителями Huawei ежемесячно.
Однако из-за нехватки памяти HBM компания была вынуждена поднять цены на Ascend — вплоть до 60%. Это ограничивает конкурентоспособность по стоимости, но Huawei компенсирует ее масштабом и доступностью там, где западные поставщики ограничены санкциями. Помимо внутреннего рынка Китая, компания готова поставлять ускорители в Южную Корею и Египет.
Выводы
Huawei выстраивает альтернативную экосистему ИИ-вычислений, где главный козырь — не отдельный чип, а способность соединять миллионы ускорителей в единую сеть через UnifiedBus. Это осознанный обход санкционных ограничений: если нельзя догнать Nvidia по производительности одного кристалла, можно превзойти ее по масштабу кластеров и гибкости развертывания. Ускоренный выпуск двух моделей Ascend в 2027 году и публичная дорожная карта до поколения Ascend 980 показывают, что Huawei больше не догоняет, а задает собственный темп.
Почему для Ascend 960DT в статье указаны 2 PFLOPS в FP4, а для 960PR в MXFP4: 8 PFLOPS? Это разница режимов или реальное превосходство инференс-чипа над обучающим?
Serverflow
Да, это разница в режимах: FP4 точнее и медленнее, MXFP4: миксовый формат с меньшей точностью, но выше производительностью. Для инференса такая оптимизация оправдана.
Скидка 1 500 ₽ или бесплатная доставка - уже сейчас 🔥
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.
Продолжная использовать наш сайт, вы даете согласие на использование файлов Cookie, пользовательских данных (IP-адрес, вид операционной системы, тип браузера, сведения о местоположении, источник, откуда пришел на сайт пользователь, с какого сайта или по какой рекламе, какие страницы
открывает и на какие страницы нажимает пользователь) в целях функционирования сайта, проведения статистических исследований и обзоров. Если вы не хотите, чтобы ваши данные обрабатывались, покиньте сайт.
При оформлении заказа в ServerFlow вы можете сообщить о намерении оставить отзыв о нашей работе после получения товара.
Нам важно ваше честное мнение. Оно помогает развивать сервис и даёт другим клиентам представление о нашей работе.
Вы можете оставить отзыв на удобной для вас платформе:
Google Maps
2GIS
Яндекс Карты
Как работает акция
Применяя промокод, вы подтверждаете намерение поделиться впечатлением о работе ServerFlow после получения заказа. Мы применяем бонус уже к текущему заказу в знак благодарности за обратную связь.
Условия акции:
скидка 1 500 ₽ при заказе от 30 000 ₽
или бесплатная доставка* при заказе до 30 000 ₽
* Бесплатная доставка заказа осуществляется до ПВЗ СДЭК.