Ошибка CUDA out of memory при генерации в AUTOMATIC1111 Stable Diffusion WebUI почти всегда означает, что видеокарте не хватило видеопамяти под выбранное разрешение и размер батча — и это лишь одна из типичных ситуаций, с которыми сталкиваются пользователи самого популярного интерфейса для Stable Diffusion. Репозиторий AUTOMATIC1111/stable-diffusion-webui на GitHub стал фактическим стандартом локальной генерации изображений: он бесплатный, работает на обычном ПК и поддерживает тысячи расширений.
В этом руководстве разберём установку A1111 на Windows, системные требования, ключевые аргументы запуска, работу с моделями и расширениями, а также способы устранения частых ошибок. Материал ориентирован на пользователей, которые хотят запустить генерацию изображений локально, без облачных сервисов и подписок.
Что такое A1111 и чем он отличается от альтернатив
AUTOMATIC1111 WebUI (сокращённо A1111) — это графический интерфейс на базе Gradio, который позволяет управлять нейросетью Stable Diffusion через браузер. Сама нейросеть при этом работает локально на вашем компьютере: никакие изображения не отправляются на сторонние серверы, а количество генераций не ограничено.
Главные конкуренты A1111 — ComfyUI с узловым интерфейсом и облачные сервисы вроде Midjourney. A1111 выигрывает за счёт простоты: классические вкладки txt2img и img2img, огромная библиотека расширений и поддержка сообщества. ComfyUI гибче и экономичнее по памяти, но требует понимания логики нодов. Облачные сервисы не требуют мощного железа, но берут плату за генерации и накладывают ограничения на контент.
Системные требования и подготовка
Минимальные требования зависят от версии моделей, которые вы планируете использовать. Для классических моделей SD 1.5 достаточно видеокарты с 4 ГБ видеопамяти, для SDXL желательно 8 ГБ и больше. Работа на AMD и на CPU возможна, но заметно медленнее и требует дополнительной настройки.
- 🎮 Видеокарта NVIDIA с 4+ ГБ VRAM (для SDXL — от 8 ГБ)
- 💾 20+ ГБ свободного места на диске (модели весят от 2 до 7 ГБ каждая)
- 🐍 Установленный Python 3.10.6 — именно эта версия рекомендована разработчиком
- 📦 Установленный Git для клонирования репозитория
- 🖥️ Windows 10/11 64-бит (Linux и macOS также поддерживаются)
⚠️ Внимание: при установке Python обязательно отметьте галочку «Add Python to PATH». Без неё установщик A1111 не найдёт интерпретатор, и запуск завершится ошибкой. Если галочку забыли — проще переустановить Python, чем править переменные окружения вручную.
Установка A1111 на Windows: пошаговая инструкция
Установка сводится к трём действиям: клонировать репозиторий, запустить скрипт и дождаться автоматической загрузки зависимостей. Первый запуск может занять продолжительное время — скачиваются библиотеки PyTorch и базовые компоненты.
☑️ Установка A1111 с нуля
Клонирование выполняется одной командой в терминале. Выберите папку без кириллицы и пробелов в пути — это исключит часть экзотических ошибок:
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
После клонирования запустите файл webui-user.bat двойным кликом. Скрипт сам создаст виртуальное окружение, скачает PyTorch и при первом успешном запуске выведет в консоль адрес http://127.0.0.1:7860. Откройте его в браузере — интерфейс готов к работе.
Обратите внимание: для генерации нужна хотя бы одна модель (чекпоинт). Файлы моделей в формате .safetensors помещаются в папку models/Stable-diffusion. Предпочтительнее именно формат safetensors, а не ckpt — он не исполняет код при загрузке и потому безопаснее.
Аргументы командной строки: настройка под своё железо
Поведение WebUI настраивается через аргументы запуска, которые прописываются в файле webui-user.bat в строке COMMANDLINE_ARGS. Вот наиболее востребованные параметры:
| Аргумент | Назначение | Кому нужен |
|---|---|---|
--xformers | Ускорение генерации и экономия VRAM | Владельцам NVIDIA |
--medvram | Режим экономии видеопамяти | Карты с 4–6 ГБ VRAM |
--lowvram | Агрессивная экономия VRAM, генерация медленнее | Карты с 2–4 ГБ VRAM |
--api | Включение REST API | Интеграция с внешними программами |
--autolaunch | Автооткрытие браузера при запуске | Для удобства |
Пример настроенной строки запуска для карты с 6 ГБ памяти:
set COMMANDLINE_ARGS=--xformers --medvram --autolaunch
Меняйте аргументы по одному и проверяйте результат. Так проще понять, какой параметр дал эффект или, наоборот, вызвал проблему.
Работа с интерфейсом: txt2img, img2img и модели
Вкладка txt2img — основная: вы вводите текстовый запрос (промпт), выбираете модель, сэмплер, количество шагов и разрешение, после чего нажимаете Generate. Начните с базовых настроек: 20–30 шагов, сэмплер Euler a или DPM++ 2M Karras, разрешение 512×512 для моделей SD 1.5 и 1024×1024 для SDXL. Слишком большое разрешение для модели, обученной на меньшем, даёт дублирующиеся объекты и артефакты.
Вкладка img2img позволяет изменять существующие изображения: задавайте степень изменения параметром Denoising strength — чем он выше, тем сильнее результат отличается от исходника. Значения в районе 0.4–0.6 обычно подходят для стилизации с сохранением композиции.
Дополнительные возможности раскрываются через LoRA (небольшие дообученные адаптеры стиля или персонажей) и ControlNet (контроль композиции по позе, глубине, контурам). ControlNet устанавливается как расширение и требует отдельных моделей.
Где брать модели и как проверить их безопасность
Популярный источник моделей — сайт Civitai. Скачивайте файлы только в формате safetensors, смотрите на количество скачиваний и отзывы. Перед использованием проверьте файл антивирусом. Модели SD 1.5 обычно занимают около 2 ГБ, SDXL — около 6–7 ГБ.
Расширения: как устанавливать и не сломать WebUI
Расширения устанавливаются через вкладку Extensions → Install from URL: вставьте ссылку на GitHub-репозиторий расширения и нажмите Install. После установки требуется перезапуск интерфейса кнопкой Apply and restart UI.
- 🧩 ControlNet — контроль поз, глубины и композиции
- 🖼️ ADetailer — автоматическое исправление лиц и рук
- 📐 Ultimate SD Upscale — качественное увеличение изображений
- 🔍 Image Browser — просмотр и поиск по сгенерированным картинкам
⚠️ Внимание: расширения — частая причина падений WebUI после обновлений. Если интерфейс перестал запускаться после установки нового дополнения, удалите его папку из extensions и запустите WebUI снова. Ставьте расширения по одному, чтобы сразу видеть виновника проблем.
Типичные ошибки и их решение
CUDA out of memory. Снизьте разрешение, уменьшите batch size до 1, добавьте аргумент --medvram или --lowvram. Для SDXL на слабых картах помогает --xformers. Также закройте браузерные вкладки с видео и другие программы, потребляющие VRAM.
WebUI не запускается после обновления. Часто помогает удаление папки venv в корне установки — при следующем запуске зависимости скачаются заново. Если не помогло, проверьте вывод в консоли: там почти всегда указано, какой модуль или расширение вызвал сбой.
Модель не появляется в списке. Проверьте, что файл лежит именно в models/Stable-diffusion, имеет расширение .safetensors или .ckpt, и нажмите кнопку обновления рядом с выпадающим списком моделей в интерфейсе.
Чёрные квадраты вместо изображений на картах серии GTX 16xx обычно лечатся запуском с аргументами --precision full --no-half — проблема связана с вычислениями в половинной точности на этом поколении видеокарт.
Запуск на видеокартах AMD
Официально A1111 ориентирован на NVIDIA. Для AMD под Windows существуют форки и сборки с DirectML, а под Linux — вариант с ROCm. Производительность и стабильность зависят от конкретной карты и драйверов; актуальные инструкции смотрите в wiki репозитория, так как этот способ установки активно меняется.
Производительность: как ускорить генерацию
Скорость генерации зависит от видеокарты, разрешения, количества шагов и выбранного сэмплера. Самый заметный прирост даёт включение --xformers на картах NVIDIA. Далее — снижение числа шагов: для многих современных сэмплеров 20–25 шагов достаточно, а дальнейшее увеличение почти не меняет результат.
Не гонитесь за большим batch size: генерация четырёх изображений по одному (batch count) часто стабильнее, чем одним батчем из четырёх, и не упирается в лимит видеопамяти. Для апскейла используйте встроенный Hires. fix с умеренным коэффициентом — двукратное увеличение заметно легче для карты, чем четырёхкратное.
Часто задаваемые вопросы
Можно ли запускать A1111 без видеокарты?
Да, с аргументом --use-cpu all, но генерация одного изображения 512×512 может занимать десятки минут. Такой режим подходит только для ознакомления с интерфейсом.
Куда сохраняются сгенерированные изображения?
По умолчанию — в папки outputs/txt2img-images и outputs/img2img-images внутри каталога установки. Пути можно изменить в настройках интерфейса.
Чем safetensors лучше ckpt?
Формат .ckpt основан на pickle и теоретически может содержать исполняемый вредоносный код. .safetensors хранит только веса модели и загружается быстрее, поэтому считается безопасным стандартом.
Как обновить A1111 до последней версии?
Выполните git pull в папке установки и перезапустите webui-user.bat. Учтите, что после обновления часть расширений может временно перестать работать до выхода их собственных обновлений.
Нарушает ли A1111 авторские права на сгенерированные изображения?
Сам интерфейс — инструмент, а правовой статус изображений зависит от модели, промптов и законодательства вашей страны. Для коммерческого использования изучите лицензию конкретной модели — у разных чекпоинтов условия различаются.