AUTOMATIC1111 Stable Diffusion: полный гайд по установке и настройке

Ошибка CUDA out of memory при первом запуске AUTOMATIC1111 Stable Diffusion WebUI — самый частый сценарий, с которым сталкиваются пользователи видеокарт с 4–6 ГБ видеопамяти, и решается она добавлением флагов --medvram или --lowvram в файл запуска. Этот интерфейс остаётся самым популярным способом запуска Stable Diffusion локально: он бесплатен, работает без подписки и даёт полный контроль над генерацией изображений.

В этом материале разберём установку WebUI на Windows, минимальные требования к железу, ключевые параметры генерации и типовые ошибки с их решениями. Инструкция ориентирована на актуальную версию репозитория AUTOMATIC1111/stable-diffusion-webui на GitHub.

Что такое AUTOMATIC1111 Stable Diffusion WebUI

AUTOMATIC1111 — это открытый веб-интерфейс для локального запуска моделей Stable Diffusion. Программа разворачивает локальный сервер на вашем компьютере, а управление происходит через браузер по адресу http://127.0.0.1:7860. Никакие данные не отправляются на внешние серверы — вся генерация выполняется на вашей видеокарте.

Интерфейс поддерживает основные режимы работы с нейросетью:

  • 🎨 txt2img — генерация изображения по текстовому описанию (промпту);
  • 🖼️ img2img — преобразование готового изображения с заданной силой изменений;
  • 🩹 Inpainting — дорисовка и исправление отдельных областей картинки;
  • 🔍 Extras — апскейл и улучшение качества готовых изображений;
  • 🧩 Extensions — установка расширений вроде ControlNet прямо из интерфейса.

Системные требования и подготовка

Главный лимитирующий фактор — видеокарта. Комфортная работа возможна на GPU NVIDIA с 6–8 ГБ видеопамяти и больше; на 4 ГБ генерация возможна с оптимизациями, но медленно и с ограничением разрешения. Карты AMD поддерживаются через DirectML или ROCm (последний — только на Linux), а запуск на CPU теоретически возможен, но на практике слишком медленный для регулярного использования.

Перед установкой убедитесь, что в системе присутствуют:

  • 🐍 Python 3.10.6 — именно эта ветка рекомендована разработчиком; при установке обязательно отметьте галочку Add Python to PATH;
  • 📦 Git — нужен для клонирования репозитория и обновлений;
  • 💾 Свободное место на диске — сама программа занимает немного, но каждая модель весит от 2 до 7 ГБ, желательно иметь запас от 20–30 ГБ;
  • 🎮 Свежий драйвер NVIDIA — устаревший драйвер является частой причиной ошибок CUDA.
⚠️ Внимание: не устанавливайте Python из Microsoft Store — эта версия нередко вызывает конфликты путей при установке зависимостей WebUI. Используйте установщик с официального сайта python.org.

Пошаговая установка на Windows

Установка сводится к клонированию репозитория и запуску скрипта, который сам подтянет все зависимости. Откройте терминал в папке, куда хотите поставить программу, и выполните:

git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git

Затем перейдите в созданную папку и запустите файл webui-user.bat двойным кликом. Первый запуск займёт продолжительное время: скрипт создаст виртуальное окружение, скачает PyTorch и остальные библиотеки. Не закрывайте окно консоли, пока не появится строка вида Running on local URL: http://127.0.0.1:7860.

Осталось положить модель. Скачанные файлы чекпоинтов (например, с ресурса Civitai) помещаются в папку models/Stable-diffusion. После этого модель появится в выпадающем списке в левом верхнем углу интерфейса — если список уже был открыт, нажмите кнопку обновления рядом с ним.

☑️ Проверка после установки

Выполнено: 0 / 5

Настройка webui-user.bat под вашу видеокарту

Файл webui-user.bat — главная точка конфигурации запуска. Откройте его в любом текстовом редакторе и найдите строку set COMMANDLINE_ARGS= — именно сюда добавляются флаги оптимизации.

ФлагНазначениеКому нужен
--xformersУскорение генерации и снижение расхода VRAMВладельцам NVIDIA — ставить в первую очередь
--medvramЭкономия видеопамяти ценой скоростиПри 4–6 ГБ VRAM
--lowvramМаксимальная экономия VRAMПри 4 ГБ и менее
--autolaunchАвтооткрытие браузера после запускаДля удобства
--apiВключение API для внешних программПри интеграции с другими приложениями

Пример готовой строки для карты с 6 ГБ памяти:

set COMMANDLINE_ARGS=--xformers --medvram --autolaunch
📊 На каком железе вы запускаете Stable Diffusion?
NVIDIA с 8+ ГБ VRAM
NVIDIA с 4–6 ГБ VRAM
Видеокарта AMD
Только CPU / облачный сервис

Основные параметры генерации

Во вкладке txt2img результат определяется несколькими ключевыми настройками. Prompt — текстовое описание желаемого изображения, Negative prompt — перечень того, чего на картинке быть не должно (дефекты, лишние объекты, артефакты). Качественный негативный промпт влияет на результат не меньше основного.

Что стоит понимать про остальные параметры:

  • ⚙️ Sampling method — алгоритм сэмплирования; популярны Euler a, DPM++ 2M Karras, разные методы дают разный характер картинки;
  • 🔢 Sampling steps — число шагов генерации; обычно рабочий диапазон 20–30, дальнейшее увеличение даёт минимальный прирост;
  • 📐 Width / Height — разрешение; базовые модели обучены на 512×512, сильное превышение без Hires. fix даёт деформации;
  • 🎚️ CFG Scale — насколько строго сеть следует промпту; типичные значения 6–9, слишком высокие ведут к пересвеченным артефактам;
  • 🎲 Seed — зерно генерации; значение -1 означает случайный результат, фиксированное число позволяет воспроизвести картинку.

Для повышения разрешения без искажений используйте связку Hires. fix: она сначала генерирует изображение в базовом размере, затем апскейлит его с дорисовкой деталей — это корректнее, чем просто задать большие Width и Height.

Как воспроизвести чужую генерацию

В PNG-файлах, созданных WebUI, встроены все параметры генерации. Перетащите такую картинку на вкладку PNG Info — интерфейс покажет промпт, seed, модель и настройки, а кнопка Send to txt2img перенесёт их в рабочую область.

Типичные ошибки и их решение

CUDA out of memory. Видеокарте не хватило памяти на текущее разрешение или размер батча. Порядок действий: уменьшите Width/Height, снизьте Batch count до 1, добавьте --medvram, а при нехватке — --lowvram. Также закройте браузеры и программы, занимающие VRAM.

Ошибки при первом запуске webui-user.bat. Чаще всего виноваты неверная версия Python или её отсутствие в PATH. Проверьте командой python --version в терминале — должна отображаться ветка 3.10. Если зависимости установились с ошибками, удалите папку venv внутри каталога WebUI и запустите скрипт заново: окружение будет пересоздано с нуля.

Чёрные квадраты вместо изображений. Возможная причина — генерация в половинной точности на старых картах либо конфликт с VAE. Попробуйте добавить флаги --no-half и --no-half-vae, а также проверьте, не выбран ли несовместимый VAE в настройках. Помните, что эти флаги увеличивают расход памяти.

⚠️ Внимание: скачивайте модели и расширения только из проверенных источников. Файлы в формате .ckpt потенциально могут содержать вредоносный код — предпочтительнее формат .safetensors, который лишён этой уязвимости.

Расширения и обновление WebUI

Вкладка Extensions позволяет устанавливать дополнения без ручной работы с файлами: в подразделе Available нажмите Load from, найдите нужное расширение и установите его кнопкой Install. Самое востребованное — ControlNet, дающее контроль над позами, композицией и глубиной сцены по референсному изображению. После установки любого расширения интерфейс нужно перезапустить через кнопку Apply and restart UI.

Обновление самого WebUI выполняется командой git pull в папке программы. Учтите, что крупные обновления иногда ломают совместимость старых расширений — перед обновлением имеет смысл сохранить копию рабочей папки, если установка критична для ваших задач.

Часто задаваемые вопросы

Можно ли запустить AUTOMATIC1111 без видеокарты NVIDIA?

Да, но с оговорками. Карты AMD работают через DirectML на Windows или ROCm на Linux, однако скорость и стабильность обычно ниже, чем у NVIDIA. Запуск на CPU возможен флагом --skip-torch-cuda-test и соответствующими настройками, но генерация одного изображения займёт многие минуты.

Куда скачивать модели для Stable Diffusion?

Наиболее известный каталог — Civitai, также модели публикуются на Hugging Face. Файлы чекпоинтов размещаются в папке models/Stable-diffusion, а LoRA-модели — в models/Lora. Предпочитайте формат .safetensors из соображений безопасности.

Почему интерфейс не открывается по адресу 127.0.0.1:7860?

Проверьте, что окно консоли с запущенным WebUI не закрыто и в нём нет ошибок — сервер работает, только пока запущен скрипт. Также убедитесь, что порт 7860 не занят другой программой и не блокируется брандмауэром; при конфликте порт можно сменить флагом --port.

Как ускорить генерацию изображений?

Основные способы: установить флаг --xformers, снизить количество шагов до разумного минимума (20–25), генерировать в базовом разрешении с последующим апскейлом вместо прямого задания больших размеров и убрать флаги экономии VRAM, если памяти хватает.

Безопасно ли использовать WebUI и сторонние модели?

Сам интерфейс с открытым исходным кодом безопасен. Риск представляют файлы моделей в формате .ckpt (поддерживают выполнение кода при загрузке) и расширения из непроверенных репозиториев. Используйте .safetensors и устанавливайте только популярные расширения с открытым кодом.