Top.Mail.Ru
Meta* представила Muse Glimmer — открытая агентная 30B-модель для локального запуска на одном GPU | Блог Serverflow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

Meta* представила Muse Glimmer — открытая агентная 30B-модель для локального запуска на одном GPU

~ 2 мин
95
Простой
Новости
Meta* представила Muse Glimmer — открытая агентная  30B-модель для локального запуска на одном GPU

Введение

Meta* Superintelligence Labs представила Muse Glimmer — новую ИИ-модель объемом 30 миллиардов параметров с открытыми весами под лицензией Apache 2.0, оптимизированную для постоянной автономной агентной работы на потребительском оборудовании. Модель способна выполнять многошаговые задачи, вызывать инструменты, понимать изображения и восстанавливаться после сбоев. Благодаря квантованию и спекулятивному декодированию Muse Glimmer умещается в 24 ГБ видеопамяти и выдает до 233 токенов в секунду на RTX 5090, что делает возможным инференс эффективных локальных агентов на обычных ПК и ноутбуках.

Подробнее о Muse Glimmer

Muse Glimmer представляет из себя классический трансформер объемом 30 миллиардов параметров с плотной архитектурой без MoE-примесей, а в ее основе лежит недавно представленная закрытая модель Meta* Spark 1.2. Так как модель позиционируется как легковесная агентная система, вместо прожорливого стандартного механизма внимания используется оптимизированный механизм Grouped-Query Attention, а для восприятия визуального контента в архитектуру вшит кодировщик ViT-G/14 с 1,8 миллиардами параметров параметров, способный обрабатывать до 4096 токенов на изображение. Контекстное окно составляет 131 072 токена, а словарь  модели — 202 048 токенов, причем поддерживается около 100 языков, включая русский.

Обучение Muse Glimmer проходило в три фазы. На этапе предобучения использовалась дистилляция логитов с выходами модели Muse Spark, выступающей в роли учителя. Затем, в средней фазе, модель тренировалась на более длинных контекстах и агентно-ориентированных данных с развернутыми цепочками рассуждений. Посттренинг объединил supervised fine-tuning, дистилляцию на политиках и reinforcement learning в доменах общего назначения, рассуждений, кодирования и агентного поведения.

Но главное в новой LLM Meta* — ее компактность, которую удалось достичь благодаря нескольким архитектурным ухищрениям. Во-первых, квантование весов примерно до 4 бит сжимает языковую модель с исходных 55+ ГБ до менее чем 20 ГБ, оставляя достаточно памяти под KV-кэш, зрительный кодировщик и драфтер для спекулятивного декодирования. Meta* валидировала, что такое сжатие снижает точность на агентских задачах не более чем на 1% в конфигурации K-Quant-17GB. Во-вторых, Muse Glimmer поставляется с легкой моделью-драфтером на базе DFlash — небольшой диффузионной сетью, предсказывающей блоки из 16 токенов за один зарос. Основная модель параллельно верифицирует предложенные блоки, принимая верные токены и исправляя ошибочные. Это дает трехкратный прирост скорости на RTX 5090 (с 74,9 до 233,4 ток/с), 1,8-кратный на Apple M5 Max и 1,5-кратный на M4 Max.

Muse Glimmer сравнивали с моделями схожего размера: Gemma4-31B от Google и Qwen3.6-27B от Alibaba. В тесте MCP-Atlas она набирает 63,2%, опережая Gemma4 (44,5%) и Qwen (45,5%). В тесте τ-Bank результат 62,9% против 48,5% у Gemma4 и 37,6% у Qwen. В бенчмарке DeepSearch QA Muse Glimmer также впереди: 39,1% против 29,5% у Gemma4 и 33,2% у Qwen. В задачах на программирование модель показывает уровень, близкий к лидерам: на SWE-Bench Verified она набирает 46,2%, уступая Qwen3.6 (48,3%), но опережая Gemma4 (43,1%). В тесте Terminal-Bench 2.1 результат 75,4% — выше, чем у Gemma4 (67,1%) и Qwen (71,4%). Мультимодальные способности также сильны: на бенчмарке MMMU Pro, проверяющем понимание изображений, Muse Glimmer получает 63,0%, обходя Qwen (59,8%) и значительно опережая Gemma4 (53,3%). На тесте CharXiv результат 70,4% — выше, чем у обоих конкурентов.

Muse Glimmer уже доступна для загрузки на Hugging Face. В ближайшие дни появятся интеграции с Ollama, LM Studio, Unsloth, а также поддержка в vLLM и SGLang для серверного развертывания и OpenClaw для оркестрации агентных процессов. Meta* сотрудничает с AMD, Arm, Dell, Intel и NVIDIA для оптимизации производительности на различных устройствах.

Выводы

Muse Glimmer наглядно показала, что Meta* — компания, которая действительно поддерживает open-source ИИ, и организация Цукерберга всего лишь копила силы чтобы представить действительно полезную и эффективную модель после провального релиза Llama4. Muse Glimmer — это не урезанный прототип, а полноценный агентный движок с функциями вызова инструментов, мультимодальности и самовосстановления после ошибок, упакованный в 30 миллиардов параметров и способный работать даже на игровой видеокарте. Выбор Apache 2.0 снимает лицензионные барьеры с интеграторов, а синхронизация с популярными рантаймами и движками значительно увеличит шансы LLM стать одним из самых популярных ИИ-продуктов последнего времени.

*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
Автор: Serverflow Serverflow
Поделиться

Комментарии 0

Написать комментарий
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)