AI-фотосессия · 29 сентября 2026 · 7 мин чтения
Stable Diffusion: что это и стоит ли ставить себе ради портрета
Stable Diffusion простыми словами: где скачать бесплатно, чем WebUI отличается от Forge, какая видеокарта нужна и сколько возни уйдёт, чтобы нейросеть рисовала твоё лицо.
Кратко. Stable Diffusion это открытая нейросеть, которая рисует изображение по текстовому описанию или по исходной картинке. Её можно скачать бесплатно и запустить на своём компьютере через интерфейс вроде WebUI или Forge. Понадобится видеокарта с запасом памяти и терпение: чтобы в кадре оказался именно ты, модель придётся дообучить на своих фото.
Что такое Stable Diffusion без терминов
Представь генератор картинок, который живёт у тебя на компьютере, работает без интернета и ни у кого не спрашивает разрешения. Это и есть Stable Diffusion: семейство моделей от компании Stability AI, веса которых выложены в открытый доступ. Midjourney или ChatGPT ты арендуешь по подписке, а эту нейросеть скачиваешь себе целиком.
Внутри она работает как любая диффузионная модель. Берёт случайный шум и за несколько десятков шагов вычищает из него картинку, которая подходит под твоё описание. Если хочется понять механику, она разобрана в тексте про диффузию простыми словами.
Stable Diffusion изображение умеет получать тремя способами:
- Из текста: пишешь «мужчина в сером пальто на набережной», получаешь кадр.
- Из другой картинки: даёшь набросок или фото, и модель перерисовывает его в заданном духе.
- Перерисовкой куска: закрашиваешь маской часть снимка, и новой становится только она.
Каждый режим, модель и настройку ты выбираешь сам. Это одновременно главный плюс и главная причина, почему половина скачавших бросает на второй вечер.
Stable Diffusion бесплатно: за что платишь на самом деле
Сама модель денег не стоит. Последнее поколение, Stable Diffusion 3.5, выходит под лицензией Stability AI Community: бесплатно для личных задач и для бизнеса с выручкой до миллиона долларов в год.
Счёт приходит с другой стороны. Скажем, у тебя игровой ноутбук трёхлетней давности. В теории на нём всё запускается, на практике кадр считается долго, вентиляторы воют, а свободное место на диске тает: каждая модель весит несколько гигабайт, и их быстро становится пять.
| Что | Сколько стоит |
|---|---|
| Модель | Ничего |
| Интерфейс | Ничего |
| Видеокарта | Та, что уже есть, или покупка новой |
| Место на диске | Несколько гигабайт на каждую модель |
| Время | Вечер на установку, дальше сколько не жалко |
Отсюда простое правило: Stable Diffusion бесплатен для того, у кого уже стоит мощная карта и есть желание копаться.
Stable Diffusion скачать: что именно качать
Качать придётся две вещи: саму модель и программу, в которой ты с ней работаешь. Модель это файл с весами, программа это окно с полем для текста, ползунками и кнопкой «Generate».
Веса официально лежат на странице Stability AI на Hugging Face. Интерфейсы выкладывают их авторы на GitHub. «Портативные сборки» из Телеграма и архивы с файлообменников лучше не трогать: внутри может оказаться что угодно, и ты запустишь это с правами своей учётной записи.
У классического интерфейса AUTOMATIC1111 установка на Windows описана в инструкции на GitHub и выглядит так:
- Поставить Python именно версии 3.10.6. Более новые, по словам авторов, не дружат с библиотекой PyTorch.
- Поставить Git.
- Скачать репозиторий командой git clone.
- Запустить webui-user.bat обычным пользователем, без прав администратора.
Первый запуск сам докачивает зависимости, и в этот момент выясняется, насколько терпелив твой интернет.
Stable Diffusion WebUI и Forge: какой выбрать
Stable Diffusion WebUI от AUTOMATIC1111 это исторический стандарт. Под него написаны почти все инструкции в сети, в нём есть перерисовка по маске, подключение LoRA и вкладка обучения.
Stable Diffusion Forge сделан поверх того же WebUI и выглядит почти так же. Его автор переписал работу с памятью видеокарты, чтобы генерация шла быстрее, и встроил поддержку моделей Flux. Поставить Forge проще: есть архив «в один клик», его распаковываешь, запускаешь update.bat, потом run.bat.
| WebUI | Forge | |
|---|---|---|
| Основа | Оригинальный проект | Надстройка над WebUI |
| Установка | Python, Git, скрипт | Готовый архив |
| Слабая видеокарта | Терпимо | Заметно легче |
| Модели Flux | Через сторонние расширения | Из коробки |
| Инструкции в сети | Больше всего | Почти все подходят от WebUI |
Есть ещё ComfyUI, где генерация собирается из блоков, соединённых проводами. Это мощно и гибко, но для первого знакомства похоже на сборку шкафа по схеме без картинок.
Stable Diffusion изображение: почему кадр не всегда похож на фото
Первые кадры обычно разочаровывают, и дело не в тебе. Базовая модель учится на миллионах картинок, где фотографии перемешаны с рисунками, поэтому без подсказок тянет в «цифровую иллюстрацию»: гладкая кожа, слишком чистый свет, глаза чуть ярче жизни.
Фотореализм приходится добывать. Люди качают дообученные сообществом модели, заточенные под фото, пишут в описании тип камеры и объектива, добавляют негативный промпт со словами вроде «мультяшный» и «пластиковая кожа». Что такое негативный промпт и зачем он нужен, разобрано в тексте про промпты.
Даже после этого остаются классические следы генерации. Представь кадр: мужчина с чашкой кофе у окна, свет красивый, а на руке, держащей чашку, шесть пальцев. Или вывеска за спиной написана буквами несуществующего алфавита. Такие вещи домашний пользователь ловит глазами и перегенерирует, иногда по двадцать раз на один приличный снимок.
Какая видеокарта нужна для Stable Diffusion
Короткий ответ: чем больше видеопамяти, тем меньше мучений. Авторы WebUI пишут, что их интерфейс работает на картах с 4 ГБ, а кто-то запускал и на двух. Это нижняя планка для самых лёгких старых моделей, а не комфорт.
Свежие модели требуют больше. Для Stable Diffusion 3.5 Medium компания называет около 10 ГБ видеопамяти, и это без учёта текстовых кодировщиков, которые тоже где-то должны жить. Удобнее всего с картами NVIDIA: основные инструкции написаны под них, для AMD и Intel есть отдельные, и путь там заметно тернистее.
Допустим, у тебя карта с 6 ГБ. Кадр по тексту ты получишь, но выбор моделей сузится, а обучение своего лица превратится в ночную смену для компьютера. Прежде чем что-то покупать, проверь, что стоит в твоём ноутбуке: это видно в диспетчере задач на вкладке с графическим процессором.
Как научить Stable Diffusion рисовать твоё лицо
Из коробки модель тебя не знает. Напишешь «портрет Алексея из Самары», получишь портрет незнакомца, уверенного, что он Алексей. Чтобы в кадре был ты, модель надо дообучить, и дома это выглядит так:
- Собрать 15-20 своих снимков с разных ракурсов и при разном свете. Почему не меньше, разобрано в тексте про число фото для обучения.
- Обрезать лишний фон и подписать каждый кадр.
- Обучить небольшой адаптер LoRA в отдельной программе и подобрать число шагов.
- Прогнать десятки пробных кадров с разной силой адаптера.
- Отсеять брак: лишние пальцы, чужой нос, лицо, прилипшее к одной позе.
На каждом шаге есть свои ловушки. Слабо обучил, и выходит «похож на двоюродного брата». Перестарался, и модель рисует тебя только в той футболке, в которой ты был на половине исходников. Как нейросеть запоминает лицо и почему она его то теряет, то зажимает, объясняет текст про обучение на твоих фото.
Когда проще готовый сервис
Если цель одна, нормальные портреты себя для анкеты, аватарки или резюме, домашняя установка окупается плохо. Ты неделю становишься оператором нейросети ради задачи, которую можно закрыть за вечер.
Мы делаем как раз это: фотореалистичные портреты одного мужчины по его фото. В каталоге больше 600 сцен, хватает трёх селфи, пакеты от 490 ₽, первые кадры приходят через пару минут после оплаты, весь пакет за 10-20 минут. В Профи-фотосессии из 15-20 твоих снимков обучается личная модель, всё занимает около 20 минут, на выходе 60 фото в 5 стилях за 3 490 ₽. Кадры вертикальные, 3:4.
Есть и честный плюс у домашнего варианта: снимки никуда не уходят с твоего диска. У нас исходники хранятся в Yandex Object Storage и под конкретный заказ передаются на генерацию и обучение AI-сервисам kie.ai и fal.ai. Для общих моделей они не используются.
Кому Stable Diffusion всё-таки стоит поставить
Тому, кому интересен сам процесс. Художнику, который хочет раскадровки. Дизайнеру, которому нужны десятки вариантов фона. Человеку с мощной картой и свободными выходными, которому любопытно, как всё устроено изнутри.
Для них Stable Diffusion это открытая мастерская: лимитов нет, подписку никто не продлевает, а модели от сообщества выходят каждую неделю. Начни с Forge, поставь одну модель из официального источника и сделай десять кадров по тексту, прежде чем браться за обучение своего лица. Если после десятого кадра ещё интересно, дальше будет только интереснее.
Частые вопросы
Stable Diffusion бесплатно или за деньги?
Веса моделей Stability AI раздаёт бесплатно, скачать и запустить их у себя может любой. Коммерческое использование тоже бесплатно для частных лиц и компаний с выручкой до миллиона долларов в год. Платишь ты железом и временем, то есть видеокартой, электричеством и вечерами на настройку.
Где скачать Stable Diffusion?
Модели лежат на официальной странице Stability AI на Hugging Face, интерфейсы AUTOMATIC1111 WebUI и Forge на GitHub у их авторов. Сборки из торрентов и чатов лучше обходить стороной, в них попадаются и устаревшие версии, и вредоносный код.
Чем Forge отличается от обычного WebUI?
Forge построен поверх AUTOMATIC1111 WebUI и выглядит почти так же. Автор переделал работу с памятью видеокарты, поэтому на скромном железе генерация идёт бодрее, а модели Flux поддержаны из коробки. Для новичка разница сводится к тому, запустится ли всё на его карте.
Какая видеокарта нужна для Stable Diffusion?
Авторы WebUI заявляют поддержку карт с 4 ГБ видеопамяти, но на такой карте живут только лёгкие старые модели. Stable Diffusion 3.5 Medium, по данным Stability AI, просит около 10 ГБ без учёта текстовых кодировщиков. Проще всего с картами NVIDIA, для AMD и Intel есть отдельные инструкции.
Можно ли в Stable Diffusion сделать фото со своим лицом?
Можно, но из коробки модель тебя не знает. Нужно собрать 15-20 своих снимков, обучить на них небольшой адаптер LoRA и подобрать его силу при генерации. У новичка на первый похожий кадр обычно уходит не один вечер.
Обновлено: 29 сентября 2026
Готов попробовать?
Выбери сцены из каталога — более 600 вариантов. Первые кадры через пару минут после оплаты, от 490 ₽.
Выбрать сцены →Читать дальше
AI-фотосессия · 7 мин
LoRA vs Stable Diffusion: чем отличаются и что лучше
LoRA — это «дообучение» поверх Stable Diffusion. Объясняем зачем разделение и почему для портрета без LoRA не получится.
AI-фотосессия · 8 мин
Как нейросеть рисует фото: диффузия простыми словами
Картинка не достаётся из базы и не склеивается из кусков. Она проступает из случайного шума за несколько десятков шагов.
AI-фотосессия · 8 мин
Как нейросеть учится на твоих фото: разбор по шагам
Весь путь от загруженной папки до готового портрета, по шагам и без магии.
AI-фотосессия · 8 мин
Сколько фото нужно для обучения нейросети: 15-20
Разбор по цифрам: что выходит из пяти кадров, что из десяти и почему двадцать однотипных хуже двенадцати разных.
AI-фотосессия · 8 мин
Что такое LoRA простыми словами: как нейросеть учит лицо
Базовая модель умеет рисовать человека вообще. LoRA это маленькая надстройка, которая учит её рисовать конкретно тебя.