Top.Mail.Ru
LM Studio 0.4.0 — новый headless-режим для запуска на серверах | Новости ServerFlow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

LM Studio 0.4.0: новый headless-режим для запуска на серверах

~ 2 мин
1140
Простой
Новости
LM Studio 0.4.0: новый headless-режим для запуска на серверах

Введение

Команда LM Studio представила версию 0.4.0, которая переводит продукт из категории десктопных приложений для локальных языковых моделей в полноценную серверную платформу инференса. Обновление затрагивает архитектуру, API и обработку запросов, позволяя использовать LM Studio в headless-режиме, на серверах, в облаке и в CI-пайплайнах без графического интерфейса.

Подробнее о LM Studio 0.4.0

Главное новшество — серверное ядро llmster, работающее независимо от пользовательского интерфейса. Это позволяет запускать модели локально на Linux, в облаке или на любом GPU, полностью отделяя вычислительную часть от десктопного клиента.

Команда для запуска llmster
Команда для запуска серверного ядра llmster. Источник: LM Studio Blog.

Параллельные запросы с непрерывной пакетной обработкой заменяют классическую очередь, повышая пропускную способность и снижая простой оборудования. Новый REST API с эндпоинтом /v1/chat поддерживает отслеживание состояния диалогов и интеграцию с локальными MCP, делая платформу удобной для агентных и инструментальных сценариев.

Интеграция MCP в LM Studio 0.4.0
Интеграция с локальными MCP в LM Studio 0.4.0. Источник: LM Studio Blog.

Десктопное приложение тоже получило обновления: разделенный экран, режим разработчика, встроенная документация и возможность экспорта чатов. UI теперь выступает скорее как клиент к серверному ядру, а не как монолитное приложение.

Выводы

Релиз LM Studio 0.4.0 формально превращает продукт в универсальный инфраструктурный инструмент для развертывания ИИ на серверах. Поддержка headless-режима, параллельного инференса и расширенного API позволяет использовать LM Studio как основу для локальных агентных систем и серверного инференса, закрывая нишу между простыми десктопными клиентами и тяжелыми серверными решениями.
Автор: Serverflow Serverflow
Поделиться

Комментарии 2

Написать комментарий
Владислав
Отделение серверного ядра от UI логично для серверов, но для обычного пользователя это означает, что десктопное приложение становится просто клиентом, который может не запуститься, если ядро уже занято другим процессом.
Serverflow
Да, в такой архитектуре действительно появляется зависимость от внешнего серверного процесса, что может усложнить диагностику для пользователя, привыкшего к монолитному запуску.
Ирина
Непрерывная пакетная обработка вместо очереди действительно повышает утилизацию GPU, но как при этом регулируется задержка для первого токена, когда одновременно приходит много коротких запросов?
Serverflow
Это хороший вопрос, и он напрямую связан с тем, как именно lm_studio реализует внутреннее планирование пакетов. В статье не приводится деталей по алгоритму выбора пакета, но это действительно компромисс между пропускной способностью и задержкой.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)