Как запустить локальную модель в LM Studio на Mac
Как выбрать и загрузить модель в LM Studio, проверить первый ответ и освободить память. Пошаговый маршрут и ограничения редакционной проверки.
- Система
- macOS 27.0
- Программы
- LM Studio 0.4.23+1
Подробности проверки
- Сохранённый UI-тест: LM Studio 0.4.23+1, macOS 27.0 arm64, 24 GiB, qwen/qwen3.8-27b, context 4096, parallel 4, thinking on
- модель заранее загрузил пользователь.
- Дополнительно выполнена CLI-проверка Qwen3-0.6B Q8_0: load с context 4096 и parallel 1, затем unload
- список после выгрузки пуст.
- UI-маршрут load/unload, qwen/qwen3.8-27b через CLI, скорость, расход RAM и другие Mac не проверялись.
Как получить первый ответ локальной модели на Mac и понять, что именно уже работает? В LM Studio для этого нужно различать три действия: установить приложение, получить файл модели и загрузить его в память. Эта инструкция ведёт до короткого проверочного ответа и объясняет, как закончить работу без удаления скачанных файлов. Основной маршрут проходит через приложение; терминал ниже используется для дополнительной диагностики и описанного в документации способа выгрузки.
Согласно сохранённому отчёту редакционной проверки от 9 сентября 2026 года, в LM Studio 0.4.23+1 на macOS 27.0 arm64 с 24 GiB памяти получен ответ на короткий запрос. В отчёте модель обозначена локальным идентификатором qwen/qwen3.8-27b; это запись тестовой среды, а не рекомендация скачивать одноимённую модель. Её загрузил пользователь. Проверяли новый чат и отправку запроса. Названия My Models и Model Search наблюдались в боковой панели, но соответствующие экраны не открывали. Установку, скачивание и большие задачи не воспроизводили; позднее отдельно была выполнена только CLI-проверка загрузки и выгрузки малой Qwen3-0.6B с context 4096 и parallel 1.
Что подготовить перед запуском

По официальным системным требованиям для Mac нужны Apple Silicon и macOS 14.0 или новее; разработчик рекомендует от 16 ГБ оперативной памяти. Возможность работы на 8 ГБ оговорена для небольших моделей и умеренного контекста. Intel Mac в опубликованных требованиях не поддерживается. Соответствие этим условиям ещё не обещает, что любая выбранная модель поместится в память.
- Установленная LM Studio из официального источника. Если программа уже работает, не обновляйте её посреди текущей задачи ради этой инструкции.
- Свободное место под конкретный файл модели. Посмотрите размер загрузки заранее; размер приложения не включает будущие модели.
- Небольшой несекретный запрос с ответом, который вы можете проверить самостоятельно. Рабочие переписки для первого опыта не нужны.
- Интернет для поиска и скачивания модели, если подходящей локальной копии ещё нет. Проверьте также, доступен ли необходимый runtime — движок исполнения модели.
В этом сценарии нет вызова платного облачного API. Возможные затраты связаны с оборудованием, хранением и трафиком; условия использования конкретной модели смотрите отдельно. Не выбирайте её только по слову «открытая»: возможность скачать веса не заменяет проверку лицензии и ограничений применения.
1. Найдите подходящую модель
Если модели уже скачаны, сначала посмотрите My Models. Не скачивайте второй вариант только потому, что название кажется похожим. В боковом меню проверенной версии есть пункты My Models и Model Search. В документации поиск описан как Discover: он принимает название семейства, запись вида user/model или ссылку Hugging Face; на Mac переход к нему описан сочетанием Command + 2. Само скачивание в этом тесте не проверялось.
- Выберите модель для текстового диалога, а не только для получения embeddings. На первом этапе нужна генерация ответа обычным языком.
- Сопоставьте полное имя, вариант файла и объём загрузки. Сохраните эти сведения: без них трудно повторить удачный результат или объяснить ошибку.
- Прочитайте описание назначения и языков модели. Не считайте поддержку русского доказанной лишь потому, что интерфейс LM Studio переведён.
- Если подходящая копия уже есть, используйте её. Иначе скачайте один выбранный вариант и дождитесь завершения, прежде чем переходить к загрузке в память.
Варианты с обозначениями вроде Q4 и Q8 отличаются квантованием — способом уменьшить представление весов. Документация советует 4-битный вариант или выше, если позволяет компьютер. Это отправная точка, а не универсальная гарантия качества. Более крупный файл нельзя автоматически считать лучшим выбором для вашей задачи.
2. Загрузите модель в память
Контекст — объём текста, который модель может учитывать при ответе: вопрос, история и дополнительные материалы занимают в нём место. Не устанавливайте максимально возможное окно для проверки пары предложений. Токены — фрагменты текста, а не страницы и не строго слова; один и тот же документ в разных моделях может занимать разный объём. Поэтому число страниц само по себе не подскажет, хватит ли памяти.
Откройте Chat и средство выбора модели. По официальной инструкции здесь выбирают уже скачанную модель и при необходимости параметры загрузки. Этот шаг редакция не воспроизводила: для контрольного вопроса модель заранее загрузил пользователь. Для первого прохода оставьте параметры загрузки по умолчанию и не меняйте сразу несколько настроек — иначе причину ошибки будет трудно отделить от последствий собственных изменений.
- Выберите нужную локальную модель в загрузчике Chat. Не ориентируйтесь только на совпадение семейства: важен конкретный вариант.
- Дождитесь завершения загрузки и готовности к вводу. Наличие файла на диске само по себе не означает, что модель уже готова отвечать.
- Создайте отдельный новый чат через «+» или Command + N. Не смешивайте проверку с рабочим разговором.
- Отправьте короткий тест ниже. Если приложение сообщает ошибку, сохраните её точный текст без содержимого личных чатов.
Ответь по-русски ровно одним предложением.
В коробке лежат 4 красных и 3 синих карандаша.
Сколько всего карандашей? Не добавляй других сведений.По сохранённому отчёту, в проведённом тесте этот запрос действительно отправили через интерфейс. Окончательный ответ qwen/qwen3.8-27b: «Всего 7 карандашей.» Число верное, итоговый ответ состоит из одного предложения. UI также показал «Thought for 1 minutes 18 seconds» — это указанная приложением длительность рассуждений, а не измерение общей задержки ответа или бенчмарк скорости. Один правильный ответ подтверждает лишь работу простого диалога; он не заменяет отдельные проверки работы с документами, программирования и сложных вычислений.
3. Если удобнее проверить состояние в терминале
CLI — дополнительный способ проверить, на каком этапе находится модель. По документации lms ls перечисляет скачанные файлы, а lms ps показывает модели в памяти. Если утилита установлена в стандартном каталоге пользователя, можно обратиться к ней по полному пути. При отсутствии этого файла не копируйте команды установки из случайных форумов: начните с работающего приложения и его официальной справки.
~/.lmstudio/bin/lms lsЕсли команда долго не возвращает результат, сохраните текст сообщения и прервите ожидание Control + C. Затем проверьте приложение обычным способом. Отсутствие вывода не означает отсутствия модели. Не повторяйте команду бесконечно и не удаляйте скачанные файлы только из-за отсутствия списка. Сначала нужно понять, доступен ли приложению его локальный сервис.
Следующая команда по документации показывает модели, загруженные в память. Сохранённый отчёт редакции фиксирует для её тестовой среды SIZE 16.08 GB, context 4096, parallel 4 и Device Local. Исходный вывод lms ps к этому отчёту не приложен: эти значения приводятся как параметры из отчёта. Они не являются требованием для вашего Mac. Квантование, точный файл и runtime там не зафиксированы; по размеру их определить нельзя.
~/.lmstudio/bin/lms psКак разбирать неудачный первый запуск

Сначала определите момент отказа. Если модель не загрузилась в память, сокращение ещё не отправленного вопроса не решает проблему с размещением весов. По документации на оценку ресурсов влияет в том числе размер контекста. Если же модель отвечает на короткие вопросы, но не справляется с большим текстом, полезно отделить объём нового документа от накопленной истории чата. Предложенный порядок — диагностика по этапам, а не перечень воспроизведённых редакцией ошибок.
| Наблюдение | Что проверить |
|---|---|
| Модель скачана, но не отвечает | Выбрана ли она в Chat и завершилась ли загрузка в память. |
| Ошибка памяти при загрузке модели | Проверьте выбранный файл и контекст. Закройте ненужные приложения; при необходимости выберите более компактную модель. Не отключайте защиту ресурсов. |
| Ошибка на длинном запросе после успешного старта | Проверьте короткий запрос в новом чате. Затем увеличивайте объём текста постепенно; не меняйте одновременно все настройки. |
| Ответ неверный или слишком длинный | Повторите короткий однозначный пример в новом чате. Не оценивайте весь продукт по одному ответу. |
| Модель не находится в Discover | Проверьте точное имя и сеть; поиск и скачивание требуют подключения. |
| CLI ничего не вывел | Отсутствие вывода не равно отсутствию моделей. Зафиксируйте ошибку либо зависание. |
Как закончить проверку и что сохранить
Завершение разговора и удаление модели решают разные задачи. В отдельной CLI-проверке малую Qwen3-0.6B загрузили с context 4096 и parallel 1, затем штатно выгрузили; после unload список загруженных моделей оказался пустым. Это подтверждает только CLI-последовательность в этой конфигурации. UI-маршрут, qwen/qwen3.8-27b, скорость, расход памяти и другие Mac этим не проверены.
~/.lmstudio/bin/lms unloadВыгрузка из памяти не предназначена для очистки места на диске. Не удаляйте папку моделей или историю разговоров, чтобы просто закончить тест. Запишите версию приложения, полное имя модели, настройки, запрос и фактический ответ. При следующем сравнении меняйте одну составляющую — иначе невозможно понять причину различий.
По документации скачанные модели могут работать офлайн; поиск, загрузка моделей и обновление компонентов требуют сети. Мы не проверяли отключение сети и не проводили аудит трафика. Для следующего шага — вопросов к документам — сначала убедитесь, что простой диалог стабильно работает, а затем используйте отдельный учебный файл без личных данных.