LM Studio
Локальные модели на ПК
LM Studio - приложение для загрузки и запуска языковых моделей на собственном компьютере. Оно объединяет каталог моделей, чат, настройки запуска и локальный сервер. Подход подходит тем, кто хочет работать с моделью без постоянной передачи запросов внешнему провайдеру.
Программа поддерживает модели семей Llama, Qwen, DeepSeek, Mistral и другие совместимые варианты. Возможность запуска конкретной модели зависит от памяти, процессора и видеокарты устройства.
Загрузка и управление
Модели можно искать и скачивать внутри LM Studio через Hugging Face. Документация подтверждает загрузку, запуск, выгрузку из памяти и просмотр доступных моделей. Это избавляет от ручного поиска файлов, хотя размер загрузки и требования к памяти всё равно нужно учитывать.
Для формата GGUF используется llama.cpp. На компьютерах Apple Silicon доступен также MLX. Выбор формата и квантизации влияет на скорость, потребление памяти и качество ответа.
Чат с моделью
LM Studio даёт интерфейс чата для локальной модели, позволяет хранить настройки и управлять шаблонами промптов. Можно прикреплять документы и общаться с ними полностью офлайн. Это удобно для черновиков, анализа личных файлов и экспериментов с разными моделями.
Локальный запуск не гарантирует точность ответа. Документы стоит использовать как источник для диалога, а важные выводы проверять по первичному материалу.
Сервер и интеграции
Приложение умеет отдавать локальную модель через REST API в пределах компьютера или сети. В документации перечислены собственный API, OpenAI-совместимые и Anthropic-совместимые конечные точки. Это упрощает подключение существующих приложений без переписывания клиента с нуля.
В актуальном API v1 есть управление моделями, stateful chats, токены аутентификации и MCP через API. Открывая сервер в сеть, настройте доступ и не публикуйте его в интернет без отдельной защиты.
LM Studio поддерживает SDK для Python и TypeScript, REST API, OpenAI-compatible endpoints и Anthropic-compatible endpoints. В справке описаны чат, потоковые ответы, embeddings, структурированный вывод, tool use и управление локальными моделями.
Такой набор делает приложение полезным для прототипов и внутренних инструментов. Разработчик может начать с локальной модели, затем при необходимости сменить конфигурацию без зависимости от одного облачного API.
CLI и llmster
Команда lms служит для загрузки моделей, управления демоном, локальным сервером и интерактивными сессиями. Для серверов и CI есть llmster - автономный headless-режим без графического приложения.
Headless-развёртывание требует тех же мер безопасности, что и любой сервис с доступом к данным и модели. Документация приводит отдельные сценарии запуска для Windows, macOS и Linux.
MCP и инструменты
LM Studio может выступать MCP-клиентом и подключать MCP servers к локальным моделям. Раздел разработчика также указывает MCP via API, tool calling и агентные сценарии на своей машине. Доступ к инструментам зависит от конфигурации конкретного сервера и модели.
Перед добавлением внешнего MCP-сервера проверьте его разрешения и набор операций. Локальная модель сама по себе не делает подключённые инструменты безопасными.
Где работает
LM Studio доступна для macOS, Windows и Linux. Документация указывает поддержку Apple Silicon Mac, Windows x64 и ARM64, Linux x64. Приложение может работать полностью офлайн после загрузки моделей.
Подтверждены десктопное приложение, API, SDK, CLI и MCP. Отдельные мобильные приложения, браузерное расширение и собственный веб-интерфейс как самостоятельные продукты не заявлены.
Конфиденциальность
Локальный режим обрабатывает модель и данные на устройстве. Официальная страница цен подчёркивает, что данные в нём не уходят с компьютера. Это свойство относится к локальному запуску, а не ко всем возможным подключениям пользователя.
Облачный inference LM Studio размещён в США и использует Zero Data Retention по умолчанию. Внешний поиск доступен после входа в аккаунт и имеет лимиты, поэтому его не стоит смешивать с полностью офлайн-сценарием.
Бесплатный режим
Базовое использование локальных LLM и офлайн-расшифровка речи в LM Studio бесплатны. В июле 2025 года компания отдельно сообщила, что приложение можно бесплатно использовать и на работе. Пользователь оплачивает только собственное оборудование и, при необходимости, облачные кредиты.
Бесплатный режим не снимает аппаратные ограничения. Крупной модели может потребоваться больше памяти, чем есть на компьютере, поэтому перед загрузкой проверьте её размер.
Цены на облако
LM Studio Cloud работает по модели оплаты за токены. На странице цен приведены ставки за миллион токенов:
- GLM-5.3-Flash - $0.15 за входные и $0.50 за выходные токены.
- DeepSeek V4 Flash - $0.13 за входные и $0.26 за выходные токены.
- GLM-5.3 - $0.70 за входные и $2.20 за выходные токены.
- Kimi K2.6 - $0.95 за входные и $4.00 за выходные токены.
- Kimi K3 - $3.00 за входные и $15.00 за выходные токены.
Полный список включает и другие модели, а цены могут меняться. Bionic Pass отмечен как будущий тариф без опубликованных деталей.
Кому пригодится
LM Studio подходит разработчику, который хочет проверить интеграцию с локальным API, исследователю документов без передачи файла в облако и пользователю, предпочитающему локальный чат. Команде он может пригодиться для внутренних прототипов, если есть понятная политика доступа к компьютерам и моделям.
Для задач с высокой нагрузкой важнее всего подобрать модель под реальное железо. Самое большое число параметров не всегда даёт лучший результат на конкретном устройстве.
Плюсы и ограничения
- Бесплатный локальный запуск моделей.
- Поддержка Windows, macOS и Linux.
- Локальные REST API и совместимые интерфейсы.
- SDK, CLI, headless-режим и MCP.
Перед внедрением нужно учитывать ограничения:
- Скорость и доступный размер модели зависят от оборудования.
- Качество ответа определяется выбранной моделью.
- Облачный режим отличается от полностью локального сценария.
- Подключённые инструменты и сервер требуют настройки доступа.
Первый запуск
Начните с компактной модели, которая соответствует объёму памяти компьютера. Проверьте чат на своих коротких задачах, затем поднимите локальный сервер только для доверенной сети. Если приложение подключается к чужому коду через OpenAI-compatible API, ограничьте доступ токеном.
Для документов сначала сделайте тест на копии файла. Это помогает оценить скорость, качество поиска по тексту и нужный размер контекста без риска для рабочего оригинала.
Разработчик и лицензия
LM Studio развивает одноимённую среду локального запуска моделей. Официальные материалы подтверждают бесплатное использование приложения дома и на работе, локальный API, облачные кредиты и developer-инструменты. Отдельная партнёрская программа в изученных разделах не найдена. Сервис особенно полезен, когда важны контроль над окружением и возможность работать с локальными моделями.
| Возможности сервиса | |
|---|---|
| Доступность | |