Top.Mail.Ru
Alibaba представила Zhenwu V900 — новейший ИИ-ускоритель с 216 ГБ HBM и поддержкой вычислений FP8 и FP4 | Блог Serverflow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

Alibaba представила Zhenwu V900 — новейший ИИ-ускоритель с 216 ГБ HBM и поддержкой вычислений FP8 и FP4

~ 2 мин
28
Простой
Новости
Alibaba представила Zhenwu V900 — новейший ИИ-ускоритель с 216 ГБ HBM и поддержкой вычислений FP8 и FP4

Введение

Компания T-Head (дочернее подразделение Alibaba) представила ИИ-ускоритель Zhenwu V900, который представители корпорации назвали самым мощным ИИ-чипом в Китае на сегодняшний день. По данным Alibaba, новинка в 3 раза превосходит по производительности своего предшественника Zhenwu M890, имеет 216 ГБ быстрой памяти HBM и поддерживает вычисления FP8 и FP4. Помимо этого, Alibaba раскрыла планы на выпуск следующего поколения ИИ-ускорителей Zhenwu J900 и центральных процессоров Yitian для обучения моделей семейства Qwen нового поколения объемом 5-10 триллионов параметров.

Подробнее о Alibaba Zhenwu V900

Ускоритель Zhenwu V900 оснащен 216 ГБ памяти HBM местного производства — компания не раскрывает, кто именно выпускает HBM память для V900, однако известно, что у Huawei есть технологии разработки аналога быстрой памяти HBM, а также компания CXMT имеет производственные линии по выпуску чипов HBM3. Скорее всего, Zhenwu V900 использует HBM-память одного из этих партнеров, но не исключено, что в новейшем решении применяются зарубежные чипы памяти или микросхемы собственной разработки. Помимо этого, Zhenwu V900 поддерживает вычисления в форматах FP8 и FP4 — Alibaba не приводит конкретных цифр производительности, поэтому судить об ИИ-вычислений в этих форматах пока рано. Пропускная способность межчипового интерконнекта достигает 1,2 ТБ/с, а за счет использования коммутационных чипов ICN Switch ИИ-ускорители Zhenwu V900 могут объединяться в стоечные системы и масштабироваться до 500 000 чипов в рамках одной вычислительной инфраструктуры. Серийное производство и выход Zhenwu V900 на рынок запланированы на первый квартал 2027 года. 

Следующее поколение ускорителей, Zhenwu J900, ожидается в третьем квартале 2028 года. Параллельно T-Head работает над собственными центральными процессорами Yitian 720 и Yitian 730, ориентированными на агентный искусственный интеллект. Их выпуск намечен на 2027 год, причем Yitian 730 станет первым процессором T-Head, построенным на собственной микроархитектуре. Точные характеристики этих решений пока не раскрываются.

Отдельное направление — развитие моделей Qwen. Команда разработчиков планирует нарастить вычислительные мощности и выпустить новое поколение ИИ-моделей Qwen. Следующим поколением станут нейросети семейства Qwen 4, в которое войдут Qwen4-27B, Qwen4-Flash, Qwen4-Max и Qwen4-Plus. В дальнейшем Alibaba выпустит следующее поколение LLM Qwen, в котором объем параметров флагманской версии нейросети достигнет 5-10 триллионов параметров, что станет абсолютным рекордом в сегменте китайских ИИ-моделей.

Выводы

Alibaba выстраивает полный стэк, от ИИ-ускорителей и центральных процессоров до ИИ-моделей и облачной инфраструктуры, стремясь занять позицию, аналогичную той, что занимает Nvidia с ее вертикальной интеграцией ПО и аппаратных решений. Zhenwu V900 с 216 ГБ HBM и поддержкой FP4 выглядит как серьезная заявка на выдавливание Nvidia с рынка Китая — решения зеленой компании все еще пользуются огромным спросом в КНР, однако с каждым новым поколением местные разработчики совершенствуют свой аппаратный стэк, сокращая разрыв с ведущими поставщиками железа.
Автор: Serverflow Serverflow
Поделиться

Комментарии 0

Написать комментарий
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)