Спустя неделю после релиза передовой ИИ-модели Qwen3.5-397B-A17B, китайский ИИ-гигант Alibaba выпустила новую серию ИИ-моделей Qwen 3.5 Medium, в которую вошли нейросети Qwen3.5-35B-A3B, Qwen3.5-122B-A10B и Qwen3.5-27B. Семейство на базе модели Qwen3.5-397B-A17B ориентировано не на увеличение количества параметров самих моделей, а на оптимизации архитектуры, качества датасетов и методов обучения, что позволяет задействовать их в более экономичных сценариях использования без потери производительности, что особенно актуально для продакшн-развертываний и агентных сценариев.
Подробнее о Qwen3.5 Medium
Qwen3.5-35B-A3B — центральная модель линейки, имеющая 35 миллиардов общих и 3 миллиарда активных параметров. При относительно умеренном объеме она демонстрирует прирост в задачах логического вывода, кодирования и комплексных сценариях размышления. Alibaba подчеркивает, что даже Qwen3.5-35B-A3B среднего размера уже превосходит более крупные модели предыдущего поколения, включая Qwen3-235B-A22B-2507 и Qwen3-VL-235B-A22B при существенно более низких требованиях к вычислительной инфраструктуре. Доступна как предобученная, так и Base версия модели Qwen3.5-35B-A3B для выполнения тонкой настройки.
Qwen3.5-122B-A10B — самая крупная модель в семействе. Модель со 122 миллиардами общих и 10 миллиардами активных параметров рассчитана на сценарии повышенной сложности — агентные пайплайны, многозадачность, продвинутые инструменты рассуждения. При этом акцент делается на эффективности: благодаря выборочной активации экспертов достигается баланс между качеством и TCO при развертывании в ЦОД или гибридных средах.
Qwen3.5-27B — самая компактная модель с 27 миллиардами параметров без архитектуры MoE ,которая позиционируется как компромисс между производительностью и доступностью, что открывает путь к использованию в корпоративных решениях среднего масштаба и периферийных сценариях. Несмотря на свои компактные габариты, Qwen3.5-27B поддерживает контекстное окно от 256 тысяч до 1 миллиона параметров, как и другие модели линейки Qwen3.5 Medium.
Вместе с открытыми моделями Alibaba также запустила Qwen3.5-Flash — продакшн-версию 35B-A3B, доступную в API компании. Она поставляется с контекстным окном по умолчанию до 1 миллиона токенов, что значительно расширяет возможности при обработке длинных документов, репозиториев кода и многошаговых диалогов. Кроме того, заявлена официальная поддержка встроенных инструментов, что упрощает реализацию агентных сценариев и интеграцию с внешними системами.
ИИ-производительность моделей Qwen 3.5 Medium. Источник: .
Выводы
Запуск Qwen 3.5 Medium отражает зрелость подхода к разработке LLM: ключевым фактором становится не экстенсивное наращивание параметров, а оптимизация архитектуры, обучение с подкреплением и улучшение качества данных. Если заявленные показатели подтвердятся в независимых тестах, модели уровня 35B и 122B могут стать новым стандартом для продакшн-инференса, особенно в агентных и корпоративных сценариях. Все модели серии Qwen3.5 Medium уже доступны на платформе Hugging Face.
Для эксплуатации важна не только цена токена, но и TCO. Если 122B-A10B даёт баланс качества и стоимости при развёртывании в ЦОД, это может вытеснить более тяжёлые модели из продакшна.
Serverflow
Снижение TCO при сохранении качества: основная цель этой линейки, особенно в агентных сценариях.
Andrey
02.03.2026
27B без MoE с окном от 256K до 1M токенов: это редкий компромисс. Обычно плотные модели такого размера ограничены 128K. Интересно, падает ли скорость на длинных сессиях.
Serverflow
Плотная архитектура без экспертов действительно упрощает инференс, но пропускная способность на 1M токенов пока под вопросом.
Валерий
28.02.2026
Контекстное окно до 1 млн токенов у Flash-версии напрямую меняет обработку целых репозиториев кода. Раньше для этого нужны были RAG или чанкинг с потерей связности.
Serverflow
Именно так: длинный контекст упрощает аудит и рефакторинг без внешних инструментов.
Леонид
26.02.2026
35B-A3B превосходит Qwen3-235B-A22B при в 6 раз меньших общих параметрах. Значит, ключевой выигрыш не в самом MoE, а в качестве данных и обучении с подкреплением.
Serverflow
Да, на это и указывает компания: архитектура и данные дают больше, чем просто увеличение размера.
Скидка 1 500 ₽ или бесплатная доставка - уже сейчас 🔥
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.
Продолжная использовать наш сайт, вы даете согласие на использование файлов Cookie, пользовательских данных (IP-адрес, вид операционной системы, тип браузера, сведения о местоположении, источник, откуда пришел на сайт пользователь, с какого сайта или по какой рекламе, какие страницы
открывает и на какие страницы нажимает пользователь) в целях функционирования сайта, проведения статистических исследований и обзоров. Если вы не хотите, чтобы ваши данные обрабатывались, покиньте сайт.
При оформлении заказа в ServerFlow вы можете сообщить о намерении оставить отзыв о нашей работе после получения товара.
Нам важно ваше честное мнение. Оно помогает развивать сервис и даёт другим клиентам представление о нашей работе.
Вы можете оставить отзыв на удобной для вас платформе:
Google Maps
2GIS
Яндекс Карты
Как работает акция
Применяя промокод, вы подтверждаете намерение поделиться впечатлением о работе ServerFlow после получения заказа. Мы применяем бонус уже к текущему заказу в знак благодарности за обратную связь.
Условия акции:
скидка 1 500 ₽ при заказе от 30 000 ₽
или бесплатная доставка* при заказе до 30 000 ₽
* Бесплатная доставка заказа осуществляется до ПВЗ СДЭК.