Чёрный экран вместо картинки, артефакты на лицах или ошибка out of memory при запуске генерации чаще всего означают не поломку Stable Diffusion, а неправильно подобранную или некорректно загруженную модель. Чекпоинт весом несколько гигабайт — это сердце всей системы: именно он определяет стиль, качество и реалистичность результата, а несовместимость версии модели с вашей видеокартой способна остановить работу ещё до первого промпта.
В этом материале разберём, какие модели Stable Diffusion существуют, чем отличаются SD 1.5, SDXL и более новые версии, как выбрать чекпоинт под свою задачу и куда его положить, чтобы Automatic1111 или ComfyUI увидели файл. Отдельно разберём типичные ошибки при загрузке моделей и способы их диагностики.
Что такое модель (чекпоинт) в Stable Diffusion
Модель — это обученная нейросеть, сохранённая в виде одного файла с весами. В сообществе её называют чекпоинтом (checkpoint). Файл содержит «знания» о том, как выглядят объекты, люди, стили живописи, и именно из этих весов рождается изображение по вашему текстовому описанию.
Базовые модели выпускает компания Stability AI, а на их основе энтузиасты создают тысячи дообученных вариантов — файнтюнов. Один чекпоинт может быть заточен под фотореализм, другой — под аниме, третий — под архитектурные рендеры. Замена модели полностью меняет характер генераций без изменения промпта.
Технически чекпоинты распространяются в форматах .safetensors и .ckpt. Первый считается предпочтительным: формат safetensors не допускает исполнения произвольного кода при загрузке, тогда как старый .ckpt теоретически может содержать вредоносную полезную нагрузку.
⚠️ Внимание: скачивайте модели только с крупных площадок вроде Hugging Face или Civitai и отдавайте приоритет файлам.safetensors. Файл.ckptиз неизвестного источника — это потенциальный риск выполнения чужого кода на вашем компьютере.
Основные поколения моделей Stable Diffusion
За время развития проекта вышло несколько поколений базовых моделей, и они не взаимозаменяемы: LoRA и настройки, сделанные под одну версию, не работают с другой. Поэтому выбор поколения — первый шаг, от которого зависит вся дальнейшая экосистема дополнений.
| Версия | Типичное разрешение | Требования к VRAM | Особенности |
|---|---|---|---|
| SD 1.5 | 512×512 | От 4 ГБ | Огромная база LoRA и файнтюнов, работает на слабых картах |
| SD 2.x | 768×768 | От 6–8 ГБ | Менее популярна, меньше-дополнений |
| SDXL 1.0 | 1024×1024 | От 8 ГБ | Заметно лучше детализация, понимает естественный язык |
| SD 3 / 3.5 | 1024×1024 и выше | От 8–12 ГБ | Новая архитектура, лучше текст и композиция |
Для старта на скромном железе чаще всего советуют SD 1.5: под неё создано больше всего обучающих материалов и дополнений, а генерация идёт быстро даже на видеокартах с 4–6 ГБ видеопамяти. Если у вас 8 ГБ и больше, логичнее сразу смотреть в сторону SDXL — скачок в качестве ощутимый.
Типы моделей: чекпоинты, LoRA, VAE и эмбеддинги
Путаете чекпоинт с LoRA — получаете ошибку загрузки или неожиданный результат. Разберём иерархию дополнений, потому что у каждого типа своя роль и своя папка.
- 🧠 Чекпоинт (checkpoint) — полноценная базовая модель, файл обычно от 2 до 7 ГБ. Без него генерация невозможна в принципе.
- 🎨 LoRA — небольшой «патч» к чекпоинту (обычно десятки или сотни мегабайт), добавляющий стиль, персонажа или конкретный объект. Работает только поверх совместимой базовой модели.
- 🌈 VAE — модуль, отвечающий за финальное декодирование картинки. Неподходящий VAE даёт выцветшие, серые или перенасыщенные цвета.
- 📝 Textual Inversion (эмбеддинги) — крошечные файлы, учат модель новому понятию или стилю через ключевое слово в промпте.
- 🎛️ ControlNet — управляющие модели, позволяющие задать позу, глубину или контуры будущего изображения.
Практический вывод: сначала вы ставите чекпоинт, затем под него подбираете остальное. Если на странице LoRA указано «SDXL only», на SD 1.5 она либо не загрузится, либо выдаст мусор.
Как выбрать модель под задачу и железо
Вам нужно ответить на два вопроса: что генерировать и на чём. Фотореалистичные портреты, аниме, фэнтези-арт и 3D-рендер-стилистика — под каждую задачу на Civitai есть десятки специализированных чекпоинтов с примерами работ. Смотрите галерею модели и отзывы перед скачиванием: это самый быстрый способ понять её сильные и слабые стороны.
По железу ориентир простой. Объём VRAM видеокарты — главный ограничитель: при нехватке памяти вы получите ошибку CUDA out of memory или генерация уползёт в минуты на кадр. Если карта слабая, используйте SD 1.5 и режимы экономии памяти вроде --medvram или --lowvram в параметрах запуска Automatic1111.
Также проверьте лицензию модели, если планируете коммерческое использование. У разных чекпоинтов условия различаются: часть авторов разрешает коммерцию свободно, часть — с ограничениями. Условия указаны на странице модели, и свериться с ними стоит до использования изображений в работе.
Установка модели: пошаговая инструкция
Процедура одинакова по сути, но папки различаются в зависимости от интерфейса. Ниже — универсальный порядок для Automatic1111 WebUI, самого распространённого варианта. Для ComfyUI структура папок аналогичная, модели кладутся в ComfyUI/models/checkpoints.
☑️ Установка чекпоинта в Automatic1111
После выбора модели в списке интерфейс может «подвиснуть» на десятки секунд — это нормально: веса загружаются в видеопамять. Признак успеха — в консоли появляется строка о загрузке весов без ошибок, а первая генерация проходит до конца.
webui-user.bat --medvram --xformers
Если модель не появилась в списке, проверьте три вещи: файл действительно лежит в нужной папке (не в архиве!), его расширение — .safetensors или .ckpt, а сам файл докачался полностью. Битая загрузка — частая причина ошибок вида runtimeerror при выборе чекпоинта; лечится повторным скачиванием.
Типичные проблемы и их диагностика
⚠️ Внимание: ошибка out of memory при загрузке SDXL на карте с 6 ГБ — это не неисправность, а нехватка видеопамяти. Не пытайтесь «чинить» модель: снизьте разрешение, включите режим экономии VRAM или перейдите на SD 1.5.
Размытые, выцветшие картинки при корректном промпте — классический симптом проблемы с VAE. Многие чекпоинты имеют встроенный VAE, но некоторые требуют отдельного файла, и авторы указывают это в описании. Проверьте настройки: в Automatic1111 выбор VAE находится в разделе Settings → Stable Diffusion → SD VAE.
Ещё одна частая ситуация — модель загружается, но игнорирует LoRA. Здесь почти всегда виновата несовместимость версий: LoRA обучена под SDXL, а активен чекпоинт SD 1.5. Проверяйте пометку базовой версии на странице каждого дополнения.
Почему генерация занимает минуты вместо секунд
Скорее всего, модель не поместилась в VRAM целиком, и часть вычислений ушла в обычную оперативную память — это в разы медленнее. Проверьте загрузку видеокарты в диспетчере задач во время генерации. Если VRAM забита под предел, включите --medvram или --lowvram, закройте браузер с видео и другие программы, потребляющие видеопамять.
Где брать модели и как оценивать их качество
Две главные площадки — Hugging Face и Civitai. Первый — официальный репозиторий базовых моделей от Stability AI и исследовательских проектов. Второй — крупнейший каталог файнтюнов сообщества с галереями примеров, рейтингами и отзывами.
Оценивайте чекпоинт перед скачиванием по нескольким признакам:
- ⭐ Галерея примеров — реальные генерации пользователей показывают возможности модели честнее, чем промо-картинки автора.
- 📊 Рейтинг и число скачиваний — популярные модели обычно лучше протестированы сообществом.
- 📄 Описание — хороший автор указывает рекомендуемые настройки: sampler, шаги, CFG scale, нужен ли внешний VAE.
- 🔖 Базовая версия — пометка SD 1.5, SDXL или SD 3 решает вопрос совместимости с вашими LoRA.
Не качайте десятки чекпоинтов «про запас» на старте. Возьмите одну универсальную модель под ваше поколение, освойте с ней промптинг и настройки — и только потом расширяйте коллекцию под конкретные стили. Так вы быстрее поймёте, какие параметры на что влияют.
Часто задаваемые вопросы
Чем отличается.safetensors от.ckpt?
Оба формата хранят веса модели, но .safetensors загружается быстрее и не позволяет выполнить произвольный код при открытии файла. Формат .ckpt основан на pickle и теоретически может содержать вредоносный код, поэтому при равном выборе берите safetensors.
Можно ли объединить две модели в одну?
Да, существует техника слияния (model merging): в Automatic1111 она доступна на вкладке Checkpoint Merger. Результат смешивает черты обеих моделей, но предсказать его заранее сложно — это экспериментальный инструмент, и удачные пропорции подбираются пробами.
Почему модель не появляется в списке после копирования?
Проверьте, что файл распакован из архива, лежит именно в папке models/Stable-diffusion и имеет расширение .safetensors или .ckpt. После копирования нажмите кнопку обновления рядом со списком моделей или перезапустите WebUI.
Сколько видеопамяти нужно для SDXL?
Комфортный минимум — около 8 ГБ VRAM. На 6 ГБ SDXL можно запустить с режимами экономии памяти и пониженным разрешением, но работа будет медленнее. Точные требования зависят от интерфейса и настроек, поэтому при сомнениях сверяйтесь с документацией вашего WebUI.
Нужно ли скачивать VAE отдельно?
Не всегда. Многие современные чекпоинты содержат встроенный VAE, и тогда ничего дополнительно ставить не требуется. Если автор модели указывает внешний VAE в описании или картинки получаются блёклыми — скачайте рекомендованный файл и выберите его в настройках интерфейса.