Где скачать и что нужно
Скачивайте LM Studio только с официального сайта lmstudio.ai — там сборки для Windows, macOS и Linux. Программа бесплатна, а с июля 2025 года бесплатна и для работы в компании: отдельная коммерческая лицензия больше не нужна.
На Mac нужен процессор Apple Silicon (M1 и новее), на Windows и Linux — 64-битный процессор; мощная видеокарта сильно ускоряет работу. Ориентир: для моделей на 7–8 млрд параметров хватит 8 ГБ видеопамяти и 16 ГБ оперативной, для 14–32 млрд — 16–24 ГБ видеопамяти. Без видеокарты модель тоже запустится, но ответ пойдёт медленно.
Установка по шагам
Скачайте установщик
На lmstudio.ai кнопка сама предложит версию под вашу систему.
Установите
На Windows — обычный установщик, на Mac — перетащить в «Программы», на Linux — файл AppImage.
Пропустите или пройдите стартовый экран
LM Studio предложит скачать первую модель — можно согласиться или выбрать свою позже во вкладке Discover.
Загрузите модель
Откройте чат и выберите модель в загрузчике сверху (на компьютере — Ctrl+L или Cmd+L).
Главные настройки при загрузке модели
- GPU Offload — сколько слоёв модели уйдёт в видеокарту. Чем больше, тем быстрее; если не хватает видеопамяти, модель не загрузится — уменьшайте ползунок.
- Context Length — сколько текста модель держит в памяти. Длинный контекст съедает память и замедляет ответ; для обычного чата хватит 4–8 тысяч токенов.
- Flash Attention — ускоряет работу и экономит память на поддерживаемых моделях.
- Настройки можно сохранить для каждой модели, чтобы не выставлять их каждый раз.
Как ускорить LM Studio
Первое — возьмите модель поменьше или более сильно сжатый квант: Q4 работает заметно быстрее Q8 при небольшой потере качества. Второе — выгрузите в видеокарту максимум слоёв и закройте игры и браузер с десятками вкладок, которые тоже едят видеопамять.
Третье — уменьшите длину контекста и отключите режим размышлений у моделей, где он есть: «думающая» модель тратит сотни токенов до ответа. Если скорость всё равно низкая, проблема в железе, и настройками её не решить.
Как удалить LM Studio
Саму программу удаляют как обычно: на Windows через «Параметры → Приложения», на Mac — перетащить из «Программ» в корзину. Но модели лежат отдельно, в папке .lmstudio в домашнем каталоге, и могут занимать десятки гигабайт. Удалите её вручную, если модели больше не нужны.
Какую модель поставить первой
Для знакомства берите небольшую универсальную модель на 4–8 млрд параметров свежего поколения: Qwen, Gemma или Llama. Они быстро загружаются, отвечают по-русски сносно и дают понять, как ваш компьютер тянет локальные нейросети.
Если скорость устраивает, пробуйте модель на 12–14 млрд — качество заметно выше. Для кода есть специальные кодерные модели, для рассуждений — «думающие» версии. Не качайте сразу десять моделей: каждая весит несколько гигабайт, а разница между соседними часто меньше, чем кажется.
- Слабый ноутбук без видеокарты — 1–4 млрд параметров, Q4.
- Игровая видеокарта на 8 ГБ — 7–8 млрд, Q4 или Q5.
- Видеокарта на 16–24 ГБ или Mac с 32 ГБ памяти — 14–32 млрд.
Когда быстрее через ИИ-агента
Если локальная модель нужна не ради приватности, а чтобы получить документ, таблицу или презентацию, проще ИИ-агент LeanTech. Он работает в браузере на любом устройстве, внутри GPT, Claude, Gemini, DeepSeek и Grok, а результат приходит файлом DOCX, XLSX или PPTX. Оплата картой РФ.
Агент не работает офлайн и не ставит модели на ваш компьютер: данные уходят в облако. Если нужна работа без интернета и без передачи файлов наружу, это задача как раз для LM Studio.