Top.Mail.Ru
Qwen3.5 Medium: Alibaba выпустила новые ИИ-модели Qwen3.5-35B-A3B, Qwen3.5-122B-A10B и Qwen3.5-27B | Блог Serverflow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

Qwen3.5 Medium: Alibaba выпустила новые ИИ-модели Qwen3.5-35B-A3B, Qwen3.5-122B-A10B и Qwen3.5-27B

~ 2 мин
2040
Простой
Новости
Qwen3.5 Medium: Alibaba выпустила новые ИИ-модели Qwen3.5-35B-A3B, Qwen3.5-122B-A10B и Qwen3.5-27B

Введение

Спустя неделю после релиза передовой ИИ-модели Qwen3.5-397B-A17B, китайский ИИ-гигант Alibaba выпустила новую серию ИИ-моделей Qwen 3.5 Medium, в которую вошли нейросети Qwen3.5-35B-A3B, Qwen3.5-122B-A10B и Qwen3.5-27B. Семейство на базе модели Qwen3.5-397B-A17B ориентировано не на увеличение количества параметров самих моделей, а на оптимизации архитектуры, качества датасетов и методов обучения, что позволяет задействовать их в более экономичных сценариях использования без потери производительности, что особенно актуально для продакшн-развертываний и агентных сценариев.

Подробнее о Qwen3.5 Medium

Qwen3.5-35B-A3B — центральная модель линейки, имеющая 35 миллиардов общих и 3 миллиарда активных параметров. При относительно умеренном объеме она демонстрирует прирост в задачах логического вывода, кодирования и комплексных сценариях размышления. Alibaba подчеркивает, что даже Qwen3.5-35B-A3B среднего размера уже превосходит более крупные модели предыдущего поколения, включая Qwen3-235B-A22B-2507 и Qwen3-VL-235B-A22B при существенно более низких требованиях к вычислительной инфраструктуре. Доступна как предобученная, так и Base версия модели Qwen3.5-35B-A3B для выполнения тонкой настройки.

Qwen3.5-122B-A10B — самая крупная модель в семействе. Модель со 122 миллиардами общих и 10 миллиардами активных параметров рассчитана на сценарии повышенной сложности — агентные пайплайны, многозадачность, продвинутые инструменты рассуждения. При этом акцент делается на эффективности: благодаря выборочной активации экспертов достигается баланс между качеством и TCO при развертывании в ЦОД или гибридных средах. 

Qwen3.5-27B — самая компактная модель с 27 миллиардами параметров без архитектуры MoE ,которая позиционируется как компромисс между производительностью и доступностью, что открывает путь к использованию в корпоративных решениях среднего масштаба и периферийных сценариях. Несмотря на свои компактные габариты, Qwen3.5-27B поддерживает контекстное окно от 256 тысяч до 1 миллиона параметров, как и другие модели линейки Qwen3.5 Medium.

Вместе с открытыми моделями Alibaba также запустила Qwen3.5-Flash — продакшн-версию 35B-A3B, доступную в API компании. Она поставляется с контекстным окном по умолчанию до 1 миллиона токенов, что значительно расширяет возможности при обработке длинных документов, репозиториев кода и многошаговых диалогов. Кроме того, заявлена официальная поддержка встроенных инструментов, что упрощает реализацию агентных сценариев и интеграцию с внешними системами. 

ИИ-производительность Qwen 3.5 Medium
ИИ-производительность моделей Qwen 3.5 Medium. Источник: X.

Выводы

Запуск Qwen 3.5 Medium отражает зрелость подхода к разработке LLM: ключевым фактором становится не экстенсивное наращивание параметров, а оптимизация архитектуры, обучение с подкреплением и улучшение качества данных. Если заявленные показатели подтвердятся в независимых тестах, модели уровня 35B и 122B могут стать новым стандартом для продакшн-инференса, особенно в агентных и корпоративных сценариях. Все модели серии Qwen3.5 Medium уже доступны на платформе Hugging Face.
Автор: Serverflow Serverflow
Поделиться

Комментарии 4

Написать комментарий
Вадим
Для эксплуатации важна не только цена токена, но и TCO. Если 122B-A10B даёт баланс качества и стоимости при развёртывании в ЦОД, это может вытеснить более тяжёлые модели из продакшна.
Serverflow
Снижение TCO при сохранении качества: основная цель этой линейки, особенно в агентных сценариях.
Andrey
27B без MoE с окном от 256K до 1M токенов: это редкий компромисс. Обычно плотные модели такого размера ограничены 128K. Интересно, падает ли скорость на длинных сессиях.
Serverflow
Плотная архитектура без экспертов действительно упрощает инференс, но пропускная способность на 1M токенов пока под вопросом.
Валерий
Контекстное окно до 1 млн токенов у Flash-версии напрямую меняет обработку целых репозиториев кода. Раньше для этого нужны были RAG или чанкинг с потерей связности.
Serverflow
Именно так: длинный контекст упрощает аудит и рефакторинг без внешних инструментов.
Леонид
35B-A3B превосходит Qwen3-235B-A22B при в 6 раз меньших общих параметрах. Значит, ключевой выигрыш не в самом MoE, а в качестве данных и обучении с подкреплением.
Serverflow
Да, на это и указывает компания: архитектура и данные дают больше, чем просто увеличение размера.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)