Top.Mail.Ru
Nvidia B30A — новые подробности о Blackwell для Китая | Блог Serverflow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

Nvidia B30A — новые подробности о Blackwell для Китая

~ 2 мин
469
Простой
Новости
Nvidia B30A — новые подробности о Blackwell для Китая

Введение

Несмотря на послабление экспортных ограничений США, Nvidia все еще не может поставлять в Китай полноценные ИИ-ускорители. Чтобы не терять рынок КНР, который дает Nvidia до 40% доходов, компания активно разрабатывает новую версию ИИ-ускорителя B30A на архитектуре Blackwell. Фактически, это решение представляет собой адаптированный вариант модели B300 “Blackwell Ultra”.

Подробнее о B30A

В отличие от двухчипового оригинала B300 “Blackwell Ultra”, ускоритель B30A базируется лишь на кристалле в корпусе, что обеспечивает половину производительности от эффективности полной версии. При этом сохраняются все ключевые технологические преимущества архитектуры, включая высокоскоростную память HBM3e и интерконнект NVLink, которые критически важны для эффективного обучения нейросетей и выполнения их инференса. Согласно расчетам, производительность B30A составит примерно 7,5 PFLOPS в режиме FP4, 3,75 петафлопс в режиме FP6/FP8, 1,88 PFLOPS режиме FP16/BF16 и 0,94 PFLOPS для TF32. Несмотря на снижение вычислительной мощности, эти чипы сохраняют конкурентное преимущество за счет более совершенного программного стека и оптимизированной архитектуры. 

Выводы

Стоит отметить, что решение о выпуске адаптированной версии стало возможным после получения Nvidia соответствующей экспортной лицензии от властей США. Это позволяет компании продолжать поставки высокопроизводительных решений для китайских исследовательских центров искусственного интеллекта и внутренних разработчиков, сохраняя присутствие на ключевом рынке. Однако у Китая крайне неоднозначная позиция насчет возобновления поставок ИИ-ускорителей Nvidia. С одной стороны, местные чипмейкеры, такие как Huawei, активно развивают свои производственные мощности и ведут разработки новых, более совершенных ИИ-чипов. С другой стороны, производительности отечественных ИИ-ускорителей недостаточно для обучения новых моделей искусственного интеллекта, вследствие чего Китай все еще остается зависимым от западных технологий. 

Автор: Serverflow Serverflow
Поделиться

Комментарии 1

Написать комментарий
Пётр
Половина производительности при сохранении HBM3e и NVLink: значит, основное узкое место в крупных кластерах будет не в памяти или связности, а именно в вычислениях. Для инференса это может быть менее критично, чем для обучения.
Serverflow
Да, для инференса такая конфигурация действительно часто оказывается сбалансированной, особенно если узким местом была память или каналы.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)