Запустите More AI полностью офлайн с локальными моделями (Ollama и LM Studio)

Направьте More AI на модель, работающую на вашем собственном железе, — и ничто никогда не покинет вашу машину: ни счетов за API, ни необходимости в интернете. Рассказываем, как за считанные минуты настроить Ollama или LM Studio и чего ждать от локальных моделей в каждом режиме.

Команда More AI · Обновлено 16 июля 2026 г.

Зачем запускать модель локально

Любая облачная модель — даже через ваш собственный API-ключ — означает, что запрос отправляется на чей-то сервер. Локальная модель убирает это последнее звено: модель работает на вашем железе, More AI общается с ней через localhost, и ваши разговоры вообще не выходят в сеть. Именно такая конфигурация нужна для конфиденциальных документов, изолированных машин или просто работы в самолёте.

Вторая причина — стоимость: у локальной модели нет цены за токен. Задайте ей тысячу вопросов — и счётом будет только электричество. Честный компромисс — возможности: локальные модели меньше передовых облачных, поэтому оставьте сложные задачи на рассуждение облачному ключу, а повседневную работу доверьте локальной модели.

Ollama: самый быстрый путь

Установите Ollama, скачайте модель одной командой (например, сборку Llama, Qwen или Gemma под объём вашей оперативной памяти) — и она будет работать локально. В More AI откройте «Настройки → Провайдеры» и включите Ollama — без API-ключа и без настройки. Приложение автоматически подхватит установленные модели, и они появятся в селекторе моделей рядом с облачными.

Дальше всё работает как с любым другим провайдером: выберите локальную модель для переписки и начинайте печатать. Индикатор контекстного окна и переключение моделей в каждой переписке работают точно так же.

LM Studio: дружелюбный менеджер моделей

Предпочитаете графическое приложение? LM Studio позволяет просматривать и скачивать открытые модели, а затем в один клик поднимает для них локальный сервер. More AI поддерживает его как полноценного провайдера — так же, как Ollama: включите его в «Настройки → Провайдеры», и скачанные модели появятся в селекторе.

Любой другой сервер: кастомные эндпоинты

Используете vLLM, llama.cpp или прокси LiteLLM? Добавьте кастомного провайдера и направьте его на любой эндпоинт, говорящий на OpenAI-совместимом Chat Completions API (базовый URL обычно заканчивается на /v1), — или на Anthropic-совместимый эндпоинт Messages. Это покрывает практически любой self-hosted сервер моделей — на вашей машине или на компьютере в вашей локальной сети.

Селектор моделей со списком локальных моделей рядом с облачными провайдерами

Смешивайте локальное и облачное

Выбирать раз и навсегда не нужно. Ключи и локальные провайдеры живут бок о бок, и каждая переписка выбирает собственную модель, — так что практичная схема такая: локальная модель для личных заметок и быстрых вопросов, флагманская — для задач, которые того заслуживают. Переключение — два клика, а не перенастройка.

С локальными моделями работают все три режима — Chat, Cowork и Code используют один и тот же движок. Для агентных режимов выбирайте самую способную локальную модель, которую потянет ваше железо: планирование и работа с инструментами вознаграждают модель посильнее.

Частые вопросы

Действительно ли локальная модель бесплатна?

Платы за токены нет — модель работает на вашем собственном железе, так что единственный расход — электричество, которое потребляет компьютер. Само приложение More AI тоже бесплатно.

Всё ли работает офлайн?

Chat, Cowork и Code с локальной моделью работают полностью офлайн — файлы, документы и репозитории и так лежат на вашем диске. Лишь функции, которым интернет нужен по самой их природе (веб-поиск, синхронизация, коннекторы), подождут, пока вы снова не окажетесь в сети.

Какое железо мне нужно?

Небольшая модель уверенно работает в 8–16 ГБ оперативной памяти; более крупным и способным моделям нужно больше памяти или GPU. Маки на Apple Silicon — особенно удачные хосты. Начните с малого, посмотрите, что тянет ваша машина, и наращивайте.

Какие локальные серверы поддерживает More AI?

Ollama и LM Studio встроены — без ключа и без настройки, достаточно их включить. Помимо этого, любой OpenAI-совместимый эндпоинт (vLLM, llama.cpp, LiteLLM) или Anthropic-совместимый эндпоинт подключается как кастомный провайдер.

Может ли кодовый агент использовать локальную модель?

Да — режим Code работает через тот же движок, так что локальная модель тоже умеет планировать и вносить правки. Агентная работа вознаграждает модели посильнее, поэтому берите самую способную локальную модель, которую потянет ваше железо, или переключите конкретную сессию на облачный ключ.

Все гайды