Запрос «stable video diffusion download» чаще всего приводит пользователя не на официальный сайт, а на десятки сторонних страниц, где под видом модели раздают перепакованные архивы или устаревшие версии весов. Чтобы не скачать битый файл или модификацию с неизвестным содержимым, загружать Stable Video Diffusion нужно с официального репозитория Stability AI на Hugging Face — именно там публикуются оригинальные чекпоинты SVD и SVD-XT.
Модель распространяется бесплатно для исследовательских и некоммерческих целей, но требует аккаунта на Hugging Face и принятия лицензионного соглашения перед скачиванием. Ниже разберём, какие файлы нужны, какое железо потребуется, как запустить генерацию локально и что делать, если загрузка обрывается или модель не запускается.
Что такое Stable Video Diffusion и какие версии существуют
Stable Video Diffusion — это генеративная модель от Stability AI, которая превращает статичное изображение в короткий видеоролик. На вход подаётся картинка, на выходе получается анимация длиной в несколько секунд. Модель работает по принципу диффузии: постепенно убирает шум из последовательности кадров, сохраняя согласованность движения.
Существует две основные публичные версии весов:
- 🎬 SVD — базовая версия, генерирует 14 кадров;
- 🎬 SVD-XT — расширенная версия, генерирует 25 кадров;
- 🎬 обе версии выпускаются также в формате fp16 — с уменьшенным размером файла и меньшим потреблением видеопамяти.
Для большинства пользователей оптимален SVD-XT в формате fp16: он даёт более длинную анимацию при умеренных требованиях к железу. Базовый вариант имеет смысл только при очень слабой видеокарте или для экспериментов с минимальным числом кадров.
Системные требования перед скачиванием
Прежде чем качать веса размером в несколько гигабайт, стоит убедиться, что компьютер потянет локальный запуск. Главный ограничивающий фактор — объём видеопамяти (VRAM). Точные минимальные значения зависят от интерфейса запуска и настроек, поэтому ниже приведены ориентировочные, а не гарантированные рамки.
| Компонент | Минимум (ориентировочно) | Комфортно |
|---|---|---|
| Видеокарта | NVIDIA с 8 ГБ VRAM | NVIDIA с 12+ ГБ VRAM |
| Оперативная память | 16 ГБ | 32 ГБ |
| Свободное место на диске | 20 ГБ | 40+ ГБ (SSD) |
| ОС | Windows 10/11, Linux | Windows 11 / Linux |
| Python | 3.10 | 3.10–3.11 |
На картах с малым объёмом VRAM генерация возможна через режимы экономии памяти в ComfyUI, но скорость заметно падает. Видеокарты AMD поддерживаются ограниченно и требуют дополнительной настройки — для первого запуска надёжнее использовать NVIDIA.
Где скачать Stable Video Diffusion официально
Единственный источник оригинальных весов — страница stabilityai/stable-video-diffusion-img2vid-xt на Hugging Face. Порядок действий такой:
1. Зарегистрируйте аккаунт на Hugging Face и подтвердите email.
2. Откройте страницу модели и примите условия лицензии — кнопка согласия находится в верхней части страницы.
3. Перейдите во вкладку Files and versions.
4. Скачайте файл svd_xt.safetensors или его fp16-вариант svd_xt_1_1.safetensors, если он доступен.
⚠️ Внимание: сторонние сайты, предлагающие «Stable Video Diffusion скачать одним файлом без регистрации», часто распространяют переупакованные архивы. Внутри может оказаться устаревшая версия, битый файл или вредоносное содержимое. Проверяйте, что файл имеет расширение .safetensors и скачан с домена huggingface.co.
Установка и запуск через ComfyUI
Самый популярный способ работы с SVD — бесплатный интерфейс ComfyUI, который поддерживает модель из коробки. Альтернативы — Automatic1111 с расширениями или запуск через оригинальный репозиторий generative-models от Stability AI, но для новичка ComfyUI проще.
Общий порядок установки:
- 📦 установите Python 3.10 и Git;
- 📦 скачайте ComfyUI с официального репозитория на GitHub или установите портативную сборку для Windows;
- 📦 поместите файл весов SVD в папку
ComfyUI/models/checkpoints; - 📦 запустите
run_nvidia_gpu.batи откройте интерфейс в браузере; - 📦 загрузите готовый workflow для SVD (примеры есть в документации ComfyUI) или соберите нод-граф вручную.
☑️ Проверка перед первым запуском SVD
После загрузки workflow укажите входное изображение, число кадров и параметры движения (motion bucket), затем запустите генерацию. Первый запуск может занять заметное время — модель подгружается в память.
Типичные ошибки при скачивании и их решение
Самая частая проблема — обрыв загрузки на середине файла. Веса SVD-XT занимают несколько гигабайт, и нестабильное соединение приводит к повреждённому файлу, который ComfyUI отказывается загружать с ошибкой чтения. Решение — скачивать не через браузер, а через инструмент с докачкой, например команду huggingface-cli download или git lfs.
huggingface-cli download stabilityai/stable-video-diffusion-img2vid-xt svd_xt.safetensors --local-dir ./models
Вторая типичная ситуация — ошибка 403 Forbidden при скачивании. Она означает, что вы не вошли в аккаунт Hugging Face или не приняли лицензию на странице модели. Для загрузки через терминал дополнительно потребуется токен доступа из настроек профиля.
⚠️ Внимание: если при загрузке модели в ComfyUI появляется ошибка вида out of memory, не пытайтесь увеличивать число кадров или разрешение. Снизьте разрешение входного изображения, уменьшите batch size и включите режим экономии VRAM в настройках запуска.
Что делать, если VRAM не хватает даже на минимальных настройках
Попробуйте запуск ComfyUI с флагом --lowvram или --novram, который переносит часть вычислений в оперативную память. Скорость упадёт в разы, но генерация станет возможной. Альтернатива — облачные сервисы вроде RunPod или Google Colab с GPU-тарифом, где модель запускается на удалённой видеокарте.
Облачные альтернативы локальному скачиванию
Если видеокарта не подходит по требованиям, скачивать веса локально не обязательно. SVD доступна через облачные платформы: аренда GPU на RunPod, Vast.ai, блокноты Google Colab с предустановленными окружениями, а также API от Stability AI. В этом случае вы платите за время вычислений, но не зависите от своего железа.
Облачный вариант удобен и для теста: перед покупкой видеокарты или долгой настройкой локального окружения можно проверить, подходит ли качество генерации под ваши задачи. Минус — зависимость от интернета и ограничения бесплатных тарифов.
Лицензия и ограничения использования
Веса Stable Video Diffusion опубликованы под исследовательской лицензией Stability AI Non-Commercial Research Community License. Это означает: модель можно свободно скачивать и использовать в некоммерческих целях — обучение, эксперименты, личные проекты. Коммерческое применение требует отдельной лицензии или подписки Stability AI Membership.
Перед использованием сгенерированных видео в публичных проектах проверьте актуальные условия на странице модели — лицензионная политика Stability AI периодически обновляется, и формулировки в этой статье могут не отражать последние изменения.
Часто задаваемые вопросы
Можно ли скачать Stable Video Diffusion без регистрации на Hugging Face?
Нет, официальные весы доступны только авторизованным пользователям, принявшим лицензионное соглашение. Регистрация бесплатна и занимает пару минут.
Чем SVD отличается от SVD-XT?
SVD генерирует 14 кадров, SVD-XT — 25 кадров, что даёт более длинную и плавную анимацию. Для большинства задач рекомендуется версия XT.
Запустится ли модель на видеокарте с 6 ГБ VRAM?
Шансы невысокие даже в режиме экономии памяти. Реалистичный минимум — около 8 ГБ VRAM, при меньшем объёме лучше рассмотреть облачные сервисы.
Безопасно ли скачивать веса со сторонних сайтов?
Нет. Загружайте только файлы формата .safetensors с официальной страницы stabilityai на Hugging Face. Сторонние источники могут содержать изменённые или вредоносные файлы.
Можно ли использовать SVD в коммерческих проектах?
Базовая лицензия разрешает только некоммерческое и исследовательское использование. Для коммерческого применения нужна подписка или отдельная лицензия Stability AI — уточняйте условия на официальном сайте.