AI-фотосессия · 30 сентября 2026 · 8 мин чтения
Генерация фото нейросетью: путь от запроса до кадра
Как устроена генерация фото нейросетью на практике: пять шагов от текста до кадра, структура запроса, сколько ждать результат и почему портрет конкретного человека сложнее случайной картинки.
Кратко. Генерация фото нейросетью сводится к четырём действиям: описать кадр словами, выбрать модель под задачу, заказать серию вариантов и отобрать годное. Ждать недолго. Первые картинки приходят через минуты. Случайный персонаж рисуется сразу, а портрет конкретного человека требует его снимков на входе: текстом сходство не задаётся.
Что происходит после нажатия кнопки
Внутри нет папки с готовыми снимками, из которой модель достаёт подходящий. Она стартует с поля случайных точек, похожего на снег в старом телевизоре, и за несколько десятков проходов она вычищает оттуда шум и на каждом шаге сверяется с твоим описанием, пока из мусора не проступит картинка. Кадр собирается заново каждый раз.
Из этого следуют две вещи, которые видно на практике. Один и тот же текст дважды даёт разные снимки, потому что стартовое поле каждый раз новое. И модель тянется к среднему: под словами «мужчина у окна» она держит тысячи похожих кадров и выдаст усреднённого мужчину у усреднённого окна. Скажем, ты хотел себя с утренним кофе на балконе, а получил мужчину из рекламы банка: вроде всё на месте, но никто. Конкретику в кадр добавляешь ты, больше её взять неоткуда.
Подать на вход можно три разные вещи, и от выбора зависит всё остальное. Только текст: модель рисует с нуля, лицо получается случайным. Текст вместе с картинкой-образцом: от образца берётся поза, композиция или цвет, дальше сцена достраивается. Набор твоих снимков: по ним либо обучают отдельную модель, либо переносят лицо в готовую сцену, и только этот путь даёт узнаваемого тебя.
Как сгенерировать изображение нейросетью: пять шагов
- Реши, куда пойдёт кадр. Аватарка в мессенджере, обложка канала, анкета, слайд в презентации: от этого зависит крупность плана, фон и одежда. Без ответа на этот вопрос получится красивая картинка не под задачу.
- Выбери инструмент по типу работы. Одни модели рисуют сцену с нуля, другие правят загруженный снимок, третьи обучаются на твоих фото ради сходства. Это три разные технологии, и путать их дорого по времени.
- Собери запрос по блокам: субъект, одежда, место, свет, план и оптика. Порядок важнее длины.
- Закажи сразу серию. Из шести-восьми вариантов обычно годятся один-два, такая арифметика нормальна для любой модели, включая платные.
- Отбери лучший кадр, проверь мелочи, при необходимости увеличь разрешение. Апскейл делается поверх готового файла, в конце, а не в процессе.
Как собрать запрос, чтобы не переделывать
Хороший запрос похож на записку фотографу, а не на стихотворение. Модель сильнее реагирует на первые слова, поэтому главное идёт вперёд, украшения в хвост.
| Блок | Что писать | Пример |
|---|---|---|
| Субъект | возраст, стрижка, щетина | мужчина 35 лет, короткая стрижка, щетина |
| Одежда | ткань и цвет вместо бренда | тёмно-синий шерстяной свитер |
| Место | одна деталь обстановки | кабинет, стеллаж с книгами позади |
| Свет | источник и направление | мягкий свет из окна слева |
| План и оптика | крупность и фокусное | поясной портрет, 85 мм, фон размыт |
Собранное вместе это выглядит так:
Мужчина 35 лет, короткая тёмная стрижка, щетина, тёмно-синий шерстяной свитер, кабинет со стеллажом позади, мягкий свет из окна слева, поясной портрет, 85 мм, фон размыт.
Для сравнения, было: «стильный мужчина в красивом интерьере, атмосферно». Стало то, что выше. Двадцать с небольшим слов, и каждое управляет чем-то одним. Если дописать к ним ещё тридцать прилагательных, картинка станет хуже: после определённой длины модель теряет хвост запроса и начинает смешивать требования. Отдельная строка отводится под то, чего в кадре быть не должно. Как её формулировать и почему у редактирующих моделей запреты срабатывают иначе, разобрано в тексте про промпт и негативный промпт.
Менять формулировку стоит по одному блоку за подход. Поправил свет, посмотрел серию, сравнил с прошлой: так видно, что именно сработало. Если переписать сразу всё, причину удачного кадра ты не найдёшь и повторить его не сможешь. Удачные строки лучше сохранять в заметки, они работают и через полгода, и на другой модели с небольшой правкой.
Пять ошибок, из-за которых кадр выходит мусорным
Почти все они про одно: модель не умеет догадываться, чего ты хотел.
- Абстракции вместо предметов. «Стильный образ» и «атмосферное освещение» модель понимает как угодно, «серый пиджак» и «свет из окна» однозначно.
- Три сцены в одном запросе. Улица, кафе и офис вместе дадут гибрид с витриной посреди кабинета.
- Названия брендов и марок. Обычно они вырезаются фильтрами, иногда превращаются в кривую надпись на одежде.
- Указание эмоции без мимики. Вместо «уверенный взгляд» лучше описать положение: подбородок чуть вперёд, плечи развёрнуты, взгляд в камеру.
- Заказ одного кадра. Один запуск ничего не говорит о запросе: понять, работает формулировка или нет, можно на серии.
Создать картинку с помощью нейросети и получить себя это разные задачи
Первое делается за минуту. Абстрактный мужчина в костюме нарисуется с первого запроса, и предъявить ему нечего: лицо ничьё, сравнивать не с чем. Со вторым мама с первого взгляда скажет, ты это или нет.
Со сходством так не выйдет. Чтобы в кадре оказался ты, модель должна увидеть твоё лицо: либо на наборе из 15-20 снимков, по которым обучают персональную модель, либо на опорных селфи, которые подмешиваются в каждую генерацию. Описание внешности словами тут бесполезно, «серые глаза и прямой нос» дадут человека с серыми глазами и прямым носом. Таких в любом вагоне метро человек пять.
Дальше всё упирается в исходники. Нужны разные ракурсы, ровный свет, открытое лицо без очков и кепок, никого постороннего в кадре. Что снимать и чего не загружать, расписано в инструкции про селфи для обучения нейросети.
Сколько ждать и сколько кадров заказывать
Меньше, чем идёт кофе в турке. Одна картинка считается от полуминуты до нескольких минут. Время зависит от числа проходов, разрешения и загруженности видеокарт: портрет в 2K тяжелее мелкой превьюшки в несколько раз, а в час пик к счёту добавляется очередь.
Пачка кадров идёт параллельно, поэтому десять штук приходят далеко не в десять раз медленнее одного. Это меняет тактику: выгоднее заказать серию по одному сценарию, чем гонять по кадру и каждый раз править формулировку. Для аватарки и анкеты хватает пяти-шести финальных снимков, значит генерировать надо два-три десятка.
Считает картинку не твой компьютер, если ты работаешь через сайт или бот: запрос уходит на чужие видеокарты, и скорость зависит от того, сколько людей стоит в очереди перед тобой. Ставить модель себе имеет смысл при двух условиях: есть видеокарта с большим объёмом памяти и есть желание разбираться с настройками. Экономии времени тут нет, зато появляется контроль над каждым параметром и ничего не уходит на сторону.
Как отбирать и что делать с браком
Брак будет всегда. Вопрос только в доле. Проверяй кадр по зонам сверху вниз: глаза и отражения в них, зубы, уши и дужки очков, руки и пальцы, стыки одежды, фон за плечом. Порядок проверки и список типичных поломок собран в справочнике артефактов.
Часть дефектов чинится точечной перерисовкой: лишняя складка, пятно на фоне, криво лежащий воротник. Поехавшая геометрия лица или сломанная перспектива не лечатся, такой кадр дешевле заменить новым. Мелочь, заметная при полном размере, часто исчезает на аватарке в двести пикселей, поэтому смотреть файл стоит в том размере, в котором его увидят люди.
С отбором есть отдельная ловушка: свой кадр ты оцениваешь не так, как посторонний. Привычка к зеркальному отражению мешает, и выбранное самим фото часто расходится с тем, которое другие называют самым похожим. Работает простая проверка: показать пять финалистов двум знакомым и спросить «какое из них выглядит как я». Вопрос «какое красивее» тут не помогает: друзья выберут самое льстивое.
Создание изображений нейросетью без запроса: как это устроено у нас
Всё, что выше, можно не делать руками. Мы делаем AI-фотосессии для мужчин, и промпт человек не пишет вообще. Формулировка спрятана внутри сцены: ты выбираешь готовую обстановку в каталоге, там больше 600 вариантов, загружаешь три селфи и получаешь кадры. Первые появляются через пару минут после оплаты, весь пакет за 10-20 минут. Десять снимков стоят 490 ₽, пятьдесят шесть 1 990 ₽.
Когда сходство важнее скорости, берётся профи-режим: 15-20 фото на входе, обучение личной модели около 20 минут, на выходе 60 кадров в пяти стилях за 3 490 ₽. Файлы приходят вертикальные, 3:4, в полном размере: кадры из каталога сразу в 2K, а в «Профи» часть кадров своей модели увеличивается бесплатно.
Чего генерация не сделает
У неё есть потолок, и лучше увидеть его до оплаты, а не после.
- Документы. Фото на паспорт, визу и пропуск снимается по регламенту живой камерой, сгенерированный кадр там не примут.
- Твои вещи. Конкретная машина с твоим номером, гитара с царапиной на деке, форма с логотипом клуба: модель нарисует похожий предмет, но не этот.
- Надписи. Текст на вывеске, бейдже или футболке чаще всего выходит кашей из букв, особенно кириллица.
- Компанию. Два и более знакомых лица в одном кадре держатся плохо, кто-то обязательно поплывёт.
- Событие. Кадр с несостоявшейся встречи останется картинкой и доказательством ничего не станет.
Границы проще нащупать заранее: возьми самую сложную деталь своей задачи, будь то надпись, предмет или второй человек, и прогони её одним кадром до того, как планировать серию.
Частые вопросы
Как сгенерировать изображение нейросетью с первого раза?
Опиши кадр по пяти блокам: кто в кадре, во что одет, где стоит, откуда свет, какой план и фокусное расстояние. Закажи сразу серию из шести-восьми вариантов вместо одного. С первого запроса попадает редко, из серии выбирать уже есть из чего.
Сколько времени занимает создание изображений нейросетью?
От полуминуты до нескольких минут на кадр плюс очередь на видеокартах. Пачка кадров считается параллельно, поэтому десять штук приходят не в десять раз дольше одного. В нашем каталоге пакет собирается за 10-20 минут.
Можно ли создать картинку с помощью нейросети со своим лицом?
Да, но словами это не делается. Модель должна увидеть твоё лицо: либо на 15-20 снимках, по которым обучают личную модель, либо на опорных селфи, которые подмешивают в каждый кадр. Описание внешности текстом даёт похожий типаж, а не тебя.
Почему один и тот же запрос выдаёт разные картинки?
Модель стартует со случайного поля точек, и каждый запуск начинается с нового. Одинаковый текст при разном старте даёт разные кадры по позе, свету и деталям. Повторить конкретный снимок можно только с сохранённым стартовым числом.
В каком виде приходят готовые кадры?
У нас это вертикальные файлы 3:4 в полном размере, они лежат в личном кабинете и скачиваются по личной ссылке. Автоматических кропов под форматы соцсетей нет, квадрат под аватарку вырезается вручную.
Обновлено: 30 сентября 2026
Готов попробовать?
Выбери сцены из каталога — более 600 вариантов. Первые кадры через пару минут после оплаты, от 490 ₽.
Выбрать сцены →Читать дальше
AI-фотосессия · 10 мин
AI-фотосессия для мужчин: что получается, а что нет
Мужская специфика AI-съёмки без рекламы: борода и лысина, врущая фигура, два режима работы и селфи, которые ломают модель.
AI-фотосессия · 8 мин
ИИ-фотки: что это, как их узнают и зачем делают
Разбор для тех, кто впервые увидел в ленте слишком ровное фото и не понял, настоящее оно или нарисованное.
AI-фотосессия · 8 мин
Дообучение целиком или LoRA: в чём разница
Один способ пересчитывает всю нейросеть, второй подкладывает рядом маленький файл поправок. Для одного лица почти всегда хватает второго.
AI-фотосессия · 8 мин
Как нейросеть рисует фото: диффузия простыми словами
Картинка не достаётся из базы и не склеивается из кусков. Она проступает из случайного шума за несколько десятков шагов.
AI-фотосессия · 8 мин
Промпт и негативный промпт: как они управляют кадром
Промпт это техзадание на кадр. Порядок слов в нём весит больше, чем количество красивых прилагательных.
AI-фотосессия · 8 мин
Сколько генерируется AI-фото и почему это не мгновенно
Разбор по слагаемым: из чего складывается время генерации кадра и что из этого реально можно ускорить.