Ollama умеет запускать нейросеть на компьютере, но общаться с ней через командную строку удобно недолго. Open WebUI добавляет привычный интерфейс с чатами, файлами, моделями и базами знаний — при этом запросы могут оставаться внутри вашего компьютера.

Ниже — рабочая схема для Windows 11: Ollama запускает модель, Docker хранит Open WebUI в отдельном контейнере, а постоянный том защищает настройки и историю от удаления при обновлении.

После установки откройте http://localhost:3000, создайте локальную учётную запись и отправьте запрос выбранной модели. Затем отключите интернет и задайте новый вопрос: если ответ появился, базовая локальная схема работает.

Что устанавливаем

КомпонентЗа что отвечаетГде хранятся данные
OllamaЗагрузка и запуск языковых моделейНа компьютере
Open WebUIЧаты, файлы, настройки и пользователиВ Docker-томе
Docker DesktopИзолированный запуск интерфейсаЛокальные контейнеры и тома
БраузерДоступ к интерфейсуОткрывает локальный адрес

Кому подходит Open WebUI

Связка полезна, если хочется получить локальный аналог привычного ИИ-чата, не отправлять документы внешнему сервису и переключаться между несколькими моделями. Она также удобна для домашнего сервера: интерфейс можно открыть другим устройствам в локальной сети, но делать это следует только после настройки доступа.

Open WebUI не делает слабый компьютер быстрее и не улучшает модель сам по себе. Качество ответа определяет выбранная LLM, объём доступной памяти, параметры контекста и способ подключения документов.

Если вы ещё не выбирали модель и не знаете, сколько памяти требуется, начните с инструкции по запуску нейросети на компьютере. Владельцам новых ноутбуков также пригодится разбор, что такое NPU и помогает ли он локальным моделям.

Требования к компьютеру

  • Windows 11 с включённой виртуализацией;
  • Docker Desktop с рабочим WSL 2;
  • Ollama для Windows;
  • не менее 8 ГБ оперативной памяти для небольших моделей;
  • свободное место для Docker и файлов модели;
  • видеокарта необязательна, но заметно ускоряет генерацию.

Модель должна помещаться в оперативную память или видеопамять вместе с контекстом. Если система постоянно использует файл подкачки, ответы будут медленными, даже если запуск формально состоялся.

Шаг 1. Установите Ollama

Установите Ollama для Windows и перезапустите терминал. Проверьте доступность команды:

ollama --version

Загрузите подходящую модель. В примере используется компактный вариант семейства Qwen; название актуальной версии можно заменить моделью из каталога Ollama:

ollama pull qwen3:4b
ollama run qwen3:4b

Введите тестовый запрос. Если ответ получен, нажмите Ctrl+C: сервис Ollama продолжит работать в фоне.

Шаг 2. Установите Docker Desktop

При первом запуске Docker может предложить установить или обновить WSL 2. После перезагрузки откройте Docker Desktop и дождитесь статуса работающего движка.

Проверьте терминал:

docker version

Если команда показывает сведения о клиенте и сервере, можно запускать контейнер. Ошибка только в разделе Server обычно означает, что Docker Desktop ещё не стартовал.

Шаг 3. Запустите Open WebUI

Откройте PowerShell и выполните одну команду:

docker run -d `
  -p 3000:8080 `
  --add-host=host.docker.internal:host-gateway `
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 `
  -v open-webui:/app/backend/data `
  --name open-webui `
  --restart always `
  ghcr.io/open-webui/open-webui:main

Официальная документация предлагает Docker-образы и отдельный постоянный том для данных. Актуальные варианты запуска собраны в руководстве Open WebUI.

В команде важны четыре параметра:

  • -p 3000:8080 открывает интерфейс на локальном порту 3000;
  • OLLAMA_BASE_URL указывает контейнеру адрес Ollama в Windows;
  • -v open-webui:/app/backend/data сохраняет чаты и настройки;
  • --restart always запускает контейнер вместе с Docker.

Шаг 4. Откройте локальный чат

Перейдите в браузере по адресу:

http://localhost:3000

Создайте первую учётную запись. В локальной установке она становится администратором. Это не облачная регистрация, однако пароль всё равно должен быть надёжным — особенно если позже вы разрешите доступ из домашней сети.

В верхней части нового чата выберите загруженную модель. Если список пуст, откройте административные настройки соединений и проверьте адрес Ollama:

http://host.docker.internal:11434

Как проверить, что нейросеть работает локально

  1. Сначала убедитесь, что модель уже скачана полностью.
  2. Откройте новый чат и задайте вопрос, которого раньше не было в истории.
  3. Отключите интернет, не закрывая Docker и Ollama.
  4. Отправьте второй новый запрос.
  5. Проверьте в диспетчере задач нагрузку на процесс Ollama.

Open WebUI может содержать функции, которым нужен интернет: веб-поиск, внешние API, загрузка моделей или удалённые расширения. Успешная локальная генерация не означает, что абсолютно каждая функция интерфейса работает офлайн.

Не устанавливайте случайные расширения и модели, если загружаете конфиденциальные документы. Локальный интерфейс не защищает от кода стороннего плагина, который сам отправляет данные наружу.

Как добавить документы

В Open WebUI можно прикрепить файл к чату или создать базу знаний. Система разбивает текст на фрагменты, строит эмбеддинги и подставляет релевантные части в запрос. Это называется RAG.

Для хорошего результата:

  • используйте текстовые PDF, а не изображения страниц;
  • удаляйте повторяющиеся колонтитулы;
  • не загружайте сотни документов в первый тест;
  • просите модель указывать документ и фрагмент ответа;
  • перепроверяйте даты, числа и выводы.

Если нужен не чат, а автоматический сценарий с Telegram, таблицами или расписанием, используйте отдельную инструкцию по локальной установке n8n и созданию ИИ-агента.

Как обновить Open WebUI без потери чатов

История находится в томе open-webui, поэтому контейнер можно пересоздать:

docker pull ghcr.io/open-webui/open-webui:main
docker stop open-webui
docker rm open-webui

После удаления запустите исходную команду docker run ещё раз. Не удаляйте том командой docker volume rm open-webui, если не хотите потерять локальные настройки и историю.

Перед крупным обновлением полезно сделать резервную копию данных средствами Open WebUI или Docker. Постоянный том защищает от пересоздания контейнера, но не заменяет резервную копию диска.

Как запустить Open WebUI вместе с Windows

Параметр --restart always автоматически стартует контейнер, когда запускается Docker. В настройках Docker Desktop включите запуск приложения при входе в Windows. Ollama обычно добавляет собственный фоновый сервис.

После перезагрузки не спешите открывать страницу: Docker и модель могут запускаться несколько десятков секунд.

Типовые ошибки

ОшибкаПричинаРешение
Страница localhost:3000 не открываетсяКонтейнер остановлен или порт занятВыполнить docker ps и проверить порт
Модели не отображаютсяКонтейнер не видит OllamaПроверить OLLAMA_BASE_URL
Ответ очень медленныйМодель не помещается в памятьВыбрать меньшую модель или квантование
После обновления пропали чатыКонтейнер запущен без прежнего томаПодключить open-webui:/app/backend/data
Порт уже используетсяНа 3000 работает другая программаЗаменить на -p 3001:8080

Безопасность локальной панели

Не пробрасывайте порт 3000 напрямую в интернет. Для доступа только с этого компьютера можно привязать публикацию к localhost. Для домашней сети используйте отдельного пользователя, брандмауэр и понятную схему доступа.

Документы, история и модели занимают место и могут содержать чувствительные данные. Ограничьте доступ к профилю Windows и диску, а резервные копии шифруйте.

Частые вопросы

Можно ли установить Open WebUI без Docker?

Да, существуют способы установки через Python и другие варианты. Для обычного пользователя Docker удобнее обновлять и проще отделять от системных зависимостей.

Работает ли Open WebUI без интернета?

Локальные чаты работают после загрузки образа и модели. Веб-поиск, удалённые API, скачивание моделей и некоторые расширения требуют сети.

Почему Open WebUI не видит Ollama?

Чаще всего внутри контейнера указан localhost. Для Docker Desktop на Windows используйте адрес host.docker.internal и убедитесь, что Ollama запущена на порту 11434.

Какая модель подходит для 8 ГБ памяти?

Начните с модели на 3–4 млрд параметров в квантованном формате. Более крупная модель может запуститься через файл подкачки, но работать слишком медленно.

Итог

Надёжная локальная схема состоит из трёх частей: работающая Ollama, контейнер Open WebUI и постоянный том данных. Не усложняйте первый запуск базами знаний и агентами. Сначала получите обычный ответ без интернета, затем настройте документы, резервное копирование и доступ из локальной сети.

Еще записи из этой же рубрики

Что будем искать? Например,Технология

Минуту внимания
Мы используем cookies для корректной работы сайта и понимания, как им пользуются читатели.