A1111 Stable Diffusion WebUI: полное руководство по установке и настройке

Ошибка CUDA out of memory при генерации в AUTOMATIC1111 Stable Diffusion WebUI почти всегда означает, что видеокарте не хватило видеопамяти под выбранное разрешение и размер батча — и это лишь одна из типичных ситуаций, с которыми сталкиваются пользователи самого популярного интерфейса для Stable Diffusion. Репозиторий AUTOMATIC1111/stable-diffusion-webui на GitHub стал фактическим стандартом локальной генерации изображений: он бесплатный, работает на обычном ПК и поддерживает тысячи расширений.

В этом руководстве разберём установку A1111 на Windows, системные требования, ключевые аргументы запуска, работу с моделями и расширениями, а также способы устранения частых ошибок. Материал ориентирован на пользователей, которые хотят запустить генерацию изображений локально, без облачных сервисов и подписок.

Что такое A1111 и чем он отличается от альтернатив

AUTOMATIC1111 WebUI (сокращённо A1111) — это графический интерфейс на базе Gradio, который позволяет управлять нейросетью Stable Diffusion через браузер. Сама нейросеть при этом работает локально на вашем компьютере: никакие изображения не отправляются на сторонние серверы, а количество генераций не ограничено.

Главные конкуренты A1111 — ComfyUI с узловым интерфейсом и облачные сервисы вроде Midjourney. A1111 выигрывает за счёт простоты: классические вкладки txt2img и img2img, огромная библиотека расширений и поддержка сообщества. ComfyUI гибче и экономичнее по памяти, но требует понимания логики нодов. Облачные сервисы не требуют мощного железа, но берут плату за генерации и накладывают ограничения на контент.

Системные требования и подготовка

Минимальные требования зависят от версии моделей, которые вы планируете использовать. Для классических моделей SD 1.5 достаточно видеокарты с 4 ГБ видеопамяти, для SDXL желательно 8 ГБ и больше. Работа на AMD и на CPU возможна, но заметно медленнее и требует дополнительной настройки.

  • 🎮 Видеокарта NVIDIA с 4+ ГБ VRAM (для SDXL — от 8 ГБ)
  • 💾 20+ ГБ свободного места на диске (модели весят от 2 до 7 ГБ каждая)
  • 🐍 Установленный Python 3.10.6 — именно эта версия рекомендована разработчиком
  • 📦 Установленный Git для клонирования репозитория
  • 🖥️ Windows 10/11 64-бит (Linux и macOS также поддерживаются)
⚠️ Внимание: при установке Python обязательно отметьте галочку «Add Python to PATH». Без неё установщик A1111 не найдёт интерпретатор, и запуск завершится ошибкой. Если галочку забыли — проще переустановить Python, чем править переменные окружения вручную.

Установка A1111 на Windows: пошаговая инструкция

Установка сводится к трём действиям: клонировать репозиторий, запустить скрипт и дождаться автоматической загрузки зависимостей. Первый запуск может занять продолжительное время — скачиваются библиотеки PyTorch и базовые компоненты.

☑️ Установка A1111 с нуля

Выполнено: 0 / 5

Клонирование выполняется одной командой в терминале. Выберите папку без кириллицы и пробелов в пути — это исключит часть экзотических ошибок:

git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git

После клонирования запустите файл webui-user.bat двойным кликом. Скрипт сам создаст виртуальное окружение, скачает PyTorch и при первом успешном запуске выведет в консоль адрес http://127.0.0.1:7860. Откройте его в браузере — интерфейс готов к работе.

Обратите внимание: для генерации нужна хотя бы одна модель (чекпоинт). Файлы моделей в формате .safetensors помещаются в папку models/Stable-diffusion. Предпочтительнее именно формат safetensors, а не ckpt — он не исполняет код при загрузке и потому безопаснее.

Аргументы командной строки: настройка под своё железо

Поведение WebUI настраивается через аргументы запуска, которые прописываются в файле webui-user.bat в строке COMMANDLINE_ARGS. Вот наиболее востребованные параметры:

АргументНазначениеКому нужен
--xformersУскорение генерации и экономия VRAMВладельцам NVIDIA
--medvramРежим экономии видеопамятиКарты с 4–6 ГБ VRAM
--lowvramАгрессивная экономия VRAM, генерация медленнееКарты с 2–4 ГБ VRAM
--apiВключение REST APIИнтеграция с внешними программами
--autolaunchАвтооткрытие браузера при запускеДля удобства

Пример настроенной строки запуска для карты с 6 ГБ памяти:

set COMMANDLINE_ARGS=--xformers --medvram --autolaunch

Меняйте аргументы по одному и проверяйте результат. Так проще понять, какой параметр дал эффект или, наоборот, вызвал проблему.

📊 На каком железе вы запускаете A1111?
NVIDIA с 8+ ГБ VRAM
NVIDIA с 4–6 ГБ VRAM
AMD
Только CPU / облако

Работа с интерфейсом: txt2img, img2img и модели

Вкладка txt2img — основная: вы вводите текстовый запрос (промпт), выбираете модель, сэмплер, количество шагов и разрешение, после чего нажимаете Generate. Начните с базовых настроек: 20–30 шагов, сэмплер Euler a или DPM++ 2M Karras, разрешение 512×512 для моделей SD 1.5 и 1024×1024 для SDXL. Слишком большое разрешение для модели, обученной на меньшем, даёт дублирующиеся объекты и артефакты.

Вкладка img2img позволяет изменять существующие изображения: задавайте степень изменения параметром Denoising strength — чем он выше, тем сильнее результат отличается от исходника. Значения в районе 0.4–0.6 обычно подходят для стилизации с сохранением композиции.

Дополнительные возможности раскрываются через LoRA (небольшие дообученные адаптеры стиля или персонажей) и ControlNet (контроль композиции по позе, глубине, контурам). ControlNet устанавливается как расширение и требует отдельных моделей.

Где брать модели и как проверить их безопасность

Популярный источник моделей — сайт Civitai. Скачивайте файлы только в формате safetensors, смотрите на количество скачиваний и отзывы. Перед использованием проверьте файл антивирусом. Модели SD 1.5 обычно занимают около 2 ГБ, SDXL — около 6–7 ГБ.

Расширения: как устанавливать и не сломать WebUI

Расширения устанавливаются через вкладку ExtensionsInstall from URL: вставьте ссылку на GitHub-репозиторий расширения и нажмите Install. После установки требуется перезапуск интерфейса кнопкой Apply and restart UI.

  • 🧩 ControlNet — контроль поз, глубины и композиции
  • 🖼️ ADetailer — автоматическое исправление лиц и рук
  • 📐 Ultimate SD Upscale — качественное увеличение изображений
  • 🔍 Image Browser — просмотр и поиск по сгенерированным картинкам
⚠️ Внимание: расширения — частая причина падений WebUI после обновлений. Если интерфейс перестал запускаться после установки нового дополнения, удалите его папку из extensions и запустите WebUI снова. Ставьте расширения по одному, чтобы сразу видеть виновника проблем.

Типичные ошибки и их решение

CUDA out of memory. Снизьте разрешение, уменьшите batch size до 1, добавьте аргумент --medvram или --lowvram. Для SDXL на слабых картах помогает --xformers. Также закройте браузерные вкладки с видео и другие программы, потребляющие VRAM.

WebUI не запускается после обновления. Часто помогает удаление папки venv в корне установки — при следующем запуске зависимости скачаются заново. Если не помогло, проверьте вывод в консоли: там почти всегда указано, какой модуль или расширение вызвал сбой.

Модель не появляется в списке. Проверьте, что файл лежит именно в models/Stable-diffusion, имеет расширение .safetensors или .ckpt, и нажмите кнопку обновления рядом с выпадающим списком моделей в интерфейсе.

Чёрные квадраты вместо изображений на картах серии GTX 16xx обычно лечатся запуском с аргументами --precision full --no-half — проблема связана с вычислениями в половинной точности на этом поколении видеокарт.

Запуск на видеокартах AMD

Официально A1111 ориентирован на NVIDIA. Для AMD под Windows существуют форки и сборки с DirectML, а под Linux — вариант с ROCm. Производительность и стабильность зависят от конкретной карты и драйверов; актуальные инструкции смотрите в wiki репозитория, так как этот способ установки активно меняется.

Производительность: как ускорить генерацию

Скорость генерации зависит от видеокарты, разрешения, количества шагов и выбранного сэмплера. Самый заметный прирост даёт включение --xformers на картах NVIDIA. Далее — снижение числа шагов: для многих современных сэмплеров 20–25 шагов достаточно, а дальнейшее увеличение почти не меняет результат.

Не гонитесь за большим batch size: генерация четырёх изображений по одному (batch count) часто стабильнее, чем одним батчем из четырёх, и не упирается в лимит видеопамяти. Для апскейла используйте встроенный Hires. fix с умеренным коэффициентом — двукратное увеличение заметно легче для карты, чем четырёхкратное.

Часто задаваемые вопросы

Можно ли запускать A1111 без видеокарты?

Да, с аргументом --use-cpu all, но генерация одного изображения 512×512 может занимать десятки минут. Такой режим подходит только для ознакомления с интерфейсом.

Куда сохраняются сгенерированные изображения?

По умолчанию — в папки outputs/txt2img-images и outputs/img2img-images внутри каталога установки. Пути можно изменить в настройках интерфейса.

Чем safetensors лучше ckpt?

Формат .ckpt основан на pickle и теоретически может содержать исполняемый вредоносный код. .safetensors хранит только веса модели и загружается быстрее, поэтому считается безопасным стандартом.

Как обновить A1111 до последней версии?

Выполните git pull в папке установки и перезапустите webui-user.bat. Учтите, что после обновления часть расширений может временно перестать работать до выхода их собственных обновлений.

Нарушает ли A1111 авторские права на сгенерированные изображения?

Сам интерфейс — инструмент, а правовой статус изображений зависит от модели, промптов и законодательства вашей страны. Для коммерческого использования изучите лицензию конкретной модели — у разных чекпоинтов условия различаются.