Meta* Superintelligence Labs представила Muse Glimmer — новую ИИ-модель объемом 30 миллиардов параметров с открытыми весами под лицензией Apache 2.0, оптимизированную для постоянной автономной агентной работы на потребительском оборудовании. Модель способна выполнять многошаговые задачи, вызывать инструменты, понимать изображения и восстанавливаться после сбоев. Благодаря квантованию и спекулятивному декодированию Muse Glimmer умещается в 24 ГБ видеопамяти и выдает до 233 токенов в секунду на RTX 5090, что делает возможным инференс эффективных локальных агентов на обычных ПК и ноутбуках.
Подробнее о Muse Glimmer
Muse Glimmer представляет из себя классический трансформер объемом 30 миллиардов параметров с плотной архитектурой без MoE-примесей, а в ее основе лежит недавно представленная закрытая модель Meta* Spark 1.2. Так как модель позиционируется как легковесная агентная система, вместо прожорливого стандартного механизма внимания используется оптимизированный механизм Grouped-Query Attention, а для восприятия визуального контента в архитектуру вшит кодировщик ViT-G/14 с 1,8 миллиардами параметров параметров, способный обрабатывать до 4096 токенов на изображение. Контекстное окно составляет 131 072 токена, а словарь модели — 202 048 токенов, причем поддерживается около 100 языков, включая русский.
Обучение Muse Glimmer проходило в три фазы. На этапе предобучения использовалась дистилляция логитов с выходами модели Muse Spark, выступающей в роли учителя. Затем, в средней фазе, модель тренировалась на более длинных контекстах и агентно-ориентированных данных с развернутыми цепочками рассуждений. Посттренинг объединил supervised fine-tuning, дистилляцию на политиках и reinforcement learning в доменах общего назначения, рассуждений, кодирования и агентного поведения.
Но главное в новой LLM Meta* — ее компактность, которую удалось достичь благодаря нескольким архитектурным ухищрениям. Во-первых, квантование весов примерно до 4 бит сжимает языковую модель с исходных 55+ ГБ до менее чем 20 ГБ, оставляя достаточно памяти под KV-кэш, зрительный кодировщик и драфтер для спекулятивного декодирования. Meta* валидировала, что такое сжатие снижает точность на агентских задачах не более чем на 1% в конфигурации K-Quant-17GB. Во-вторых, Muse Glimmer поставляется с легкой моделью-драфтером на базе DFlash — небольшой диффузионной сетью, предсказывающей блоки из 16 токенов за один зарос. Основная модель параллельно верифицирует предложенные блоки, принимая верные токены и исправляя ошибочные. Это дает трехкратный прирост скорости на RTX 5090 (с 74,9 до 233,4 ток/с), 1,8-кратный на Apple M5 Max и 1,5-кратный на M4 Max.
Muse Glimmer сравнивали с моделями схожего размера: Gemma4-31B от Google и Qwen3.6-27B от Alibaba. В тесте MCP-Atlas она набирает 63,2%, опережая Gemma4 (44,5%) и Qwen (45,5%). В тесте τ-Bank результат 62,9% против 48,5% у Gemma4 и 37,6% у Qwen. В бенчмарке DeepSearch QA Muse Glimmer также впереди: 39,1% против 29,5% у Gemma4 и 33,2% у Qwen. В задачах на программирование модель показывает уровень, близкий к лидерам: на SWE-Bench Verified она набирает 46,2%, уступая Qwen3.6 (48,3%), но опережая Gemma4 (43,1%). В тесте Terminal-Bench 2.1 результат 75,4% — выше, чем у Gemma4 (67,1%) и Qwen (71,4%). Мультимодальные способности также сильны: на бенчмарке MMMU Pro, проверяющем понимание изображений, Muse Glimmer получает 63,0%, обходя Qwen (59,8%) и значительно опережая Gemma4 (53,3%). На тесте CharXiv результат 70,4% — выше, чем у обоих конкурентов.
Muse Glimmer уже доступна для загрузки на Hugging Face. В ближайшие дни появятся интеграции с Ollama, LM Studio, Unsloth, а также поддержка в vLLM и SGLang для серверного развертывания и OpenClaw для оркестрации агентных процессов. Meta* сотрудничает с AMD, Arm, Dell, Intel и NVIDIA для оптимизации производительности на различных устройствах.
Выводы
Muse Glimmer наглядно показала, что Meta* — компания, которая действительно поддерживает open-source ИИ, и организация Цукерберга всего лишь копила силы чтобы представить действительно полезную и эффективную модель после провального релиза Llama4. Muse Glimmer — это не урезанный прототип, а полноценный агентный движок с функциями вызова инструментов, мультимодальности и самовосстановления после ошибок, упакованный в 30 миллиардов параметров и способный работать даже на игровой видеокарте. Выбор Apache 2.0 снимает лицензионные барьеры с интеграторов, а синхронизация с популярными рантаймами и движками значительно увеличит шансы LLM стать одним из самых популярных ИИ-продуктов последнего времени.
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Скидка 1 500 ₽ или бесплатная доставка - уже сейчас 🔥
Мы ценим обратную связь от клиентов. При оформлении заказа вы можете сообщить о своём намерении поделиться впечатлением о работе ServerFlow после получения товара.
* - скидка предоставляется при покупке от 30 000 рублей, в ином случае предусмотрена бесплатная доставка до ПВЗ СДЭК.
Продолжная использовать наш сайт, вы даете согласие на использование файлов Cookie, пользовательских данных (IP-адрес, вид операционной системы, тип браузера, сведения о местоположении, источник, откуда пришел на сайт пользователь, с какого сайта или по какой рекламе, какие страницы
открывает и на какие страницы нажимает пользователь) в целях функционирования сайта, проведения статистических исследований и обзоров. Если вы не хотите, чтобы ваши данные обрабатывались, покиньте сайт.
При оформлении заказа в ServerFlow вы можете сообщить о намерении оставить отзыв о нашей работе после получения товара.
Нам важно ваше честное мнение. Оно помогает развивать сервис и даёт другим клиентам представление о нашей работе.
Вы можете оставить отзыв на удобной для вас платформе:
Google Maps
2GIS
Яндекс Карты
Как работает акция
Применяя промокод, вы подтверждаете намерение поделиться впечатлением о работе ServerFlow после получения заказа. Мы применяем бонус уже к текущему заказу в знак благодарности за обратную связь.
Условия акции:
скидка 1 500 ₽ при заказе от 30 000 ₽
или бесплатная доставка* при заказе до 30 000 ₽
* Бесплатная доставка заказа осуществляется до ПВЗ СДЭК.