AI-фотосессия · 2 октября 2026 · 8 мин чтения
HeyGen: говорящий аватар из фото и что с согласием
HeyGen AI: как устроен говорящий аватар из фото или видео, клон голоса и перевод на русский, что дают бесплатно и почему делать аватар можно только из своего лица.
Кратко. HeyGen это сервис heygen.com для роликов с говорящим аватаром. Аватар делается из фото или из видеозаписи человека, голос синтезируется или клонируется, губы двигаются под текст. Русская озвучка и перевод есть. Бесплатно дают 3 видео в месяц до минуты. Цифровой двойник требует видеосогласия того, чьё лицо в кадре.
HeyGen: что это и зачем
Представь: тебе нужно записать для команды десять коротких инструкций, а садиться перед камерой десять раз не хочется. HeyGen решает ровно эту задачу. Один раз даёшь ему своё лицо и голос, дальше пишешь текст, а ролик с тобой в кадре собирается без съёмки.
Устроено это из трёх частей. Внешность аватара, которую сервис берёт из фото или видео. Голос, синтезированный из библиотеки или клонированный с твоей записи. И синхронизация губ, которая двигает рот и голову под произносимый текст.
Для бизнеса это экономия съёмочных дней. Для обычного человека чаще просто любопытство: как я буду выглядеть, если заговорю по-японски.
Сразу про нас: видео мы не делаем. Это разбор чужого сервиса, о нашем продукте одна фраза в конце.
HeyGen аватар: из фото или из видео
Аватары в HeyGen бывают трёх видов, и разница между ними решает, насколько ролик будет похож на тебя живого.
| Вид | Откуда берётся | Что с мимикой | Согласие |
|---|---|---|---|
| Готовый аватар из библиотеки | актёры, заранее снятые сервисом | живая, но не твоя | не нужно, это не ты |
| Фото-аватар | один твой снимок | движения сочиняет нейросеть | формальной проверки нет, но нужно |
| Цифровой двойник | видеозапись тебя | берётся из твоей записи | видеосогласие обязательно |
Фото-аватар делается быстрее всего: загрузил снимок и готово. Но у нейросети есть только одно положение твоего лица, всё остальное она придумывает. Поворот головы, моргание, улыбку при словах «рад вас видеть» модель сочиняет по среднему человеку.
Цифровой двойник собирается из видео, где ты говоришь сам. В справке HeyGen прямо сказано, что движения рук и выражения лица берутся из исходной записи. Поэтому и снимать её стоит с теми жестами и мимикой, которые хочешь видеть потом в роликах.
HeyGen видео: как снять исходник для двойника
Двойник наследует всё, что было в исходной записи, включая плохой свет и напряжённые плечи. Поэтому запись решает больше, чем любые настройки потом.
- Свет спереди и ровный. Окно перед тобой днём работает лучше, чем люстра над головой.
- Камера на уровне глаз, телефон на стопке книг, а не в вытянутой руке.
- Фон спокойный, без людей и движущихся предметов.
- Говори как обычно, с паузами и естественными жестами. Двойник повторит именно их, и скованность на записи превратится в скованность во всех будущих роликах.
- Руки не закрывают лицо, волосы не падают на глаза.
- Одежда та, в которой хочешь появляться в роликах: надёжнее сразу снять нужный образ, чем потом надеяться на подмену нейросетью.
Допустим, ты снял исходник вечером на кухне, под верхней лампой, в домашней футболке, говоря заученным текстом. Через месяц все твои обучающие ролики выглядят так, будто их записывали в допросной. Пятнадцать минут у окна днём, в рубашке и своими словами, дают совсем другого двойника.
Отдельно про очки. Блики на стёклах нейросеть воспроизводит не всегда аккуратно, так что если можешь говорить без них, лучше снять запись без очков.
Где говорящий аватар уместен, а где выглядит роботом
Лучше всего аватар работает там, где зритель и не ждёт живого разговора. Обучающее видео, инструкция для сотрудников, короткое объяснение продукта на сайте, презентация на нескольких языках.
Хуже всего он работает там, где тебя знают. Мама, друг, девушка, коллега, с которым ты обедаешь, узнают тебя по мелочам, которые нейросеть не повторит: как ты щуришься, прежде чем пошутить, как говоришь с паузой на середине фразы. Аватар произносит текст ровно, без запинок, и именно эта ровность выдаёт его первой.
Скажем, ты записал через фото-аватар поздравление другу на день рождения. Первые секунды смешно. К середине он замечает, что ты ни разу не моргнул невпопад и произнёс «с днём рождения, братан» тоном диктора новостей. Эффект странный, и это ровно то место, где технология ещё не дотягивает.
Ещё роботом аватар выглядит на длинных роликах. Короткая фраза проходит, а пять минут одинаковой позы и одинакового кивка утомляют даже тех, кто не знает тебя лично. Почему нейросеть так обращается с лицом в движении, есть в статье о том, почему AI меняет лицо.
Почему аватар можно делать только из своего лица
Говорящий ролик с реальным человеком выглядит как запись этого человека. Если лицо чужое, а слова написал ты, получается подделка, и неважно, задумана она как шутка или как розыгрыш.
HeyGen это правило встраивает в процесс. Для цифрового двойника нужна проверка на камеру от самого человека, изображённого в записи: он читает текст согласия на видео. Сервис отклоняет согласие, если текст прочитан неразборчиво, лицо плохо видно, звук не совпадает с картинкой или вместо человека в ролике другой AI-аватар. И человек в видеосогласии должен быть тем же, что в исходной записи.
С фото-аватаром тоньше. Формальной проверки у него нет, и это соблазняет загрузить чужой снимок. Но документация HeyGen прямо предупреждает: фото-аватар всё равно строится из изображения реального человека, и отсутствие проверки не даёт разрешения использовать чью-то внешность.
Отсюда простое правило для этой статьи и для жизни. Делай аватар и клон голоса только из своего лица и своего голоса. Коллегу, друга или родственника можно, только если он сам согласился и сам записал согласие. Где проходит граница между AI-портретом и дипфейком, подробно разобрано в статье про разницу между AI-фото и дипфейком.
Клон голоса и HeyGen на русском
Русский в HeyGen есть в двух местах: среди языков озвучки и среди языков перевода видео.
Озвучка работает так: пишешь текст по-русски, выбираешь голос из библиотеки или свой клон, аватар произносит. Перевод берёт уже готовый ролик, например твою запись на русском, и переводит её на другой язык. Можно перевести только звук, а можно ещё и подогнать движение губ под новый язык.
Клон голоса в HeyGen идёт в составе своего видеоаватара: записал себя, и двойник говорит твоим голосом. По странице тарифов один клон есть даже на бесплатном плане.
Правило для голоса то же, что для лица. Клонируй только себя. Голос узнают по телефону быстрее, чем лицо на видео, и чужой клон, который звонит маме и просит денег, это уже схема мошенников, а не шутка.
Небольшой практический совет: пиши текст для аватара короткими фразами и с запятыми там, где ты сам сделал бы паузу. Длинные предложения без знаков препинания синтезатор читает на одном дыхании, и живости это не добавляет.
HeyGen бесплатно: что дают
Бесплатный план HeyGen рассчитан на пробу, а не на работу. На странице тарифов он выглядит так:
- 3 видео в месяц.
- Каждое длиной до 1 минуты.
- Выгрузка до 1080p.
- Один свой видеоаватар и больше 500 готовых.
- Один клон голоса.
- Перевод больше чем на 30 языков, на платных тарифах 175 языков и диалектов.
Дальше идут платные тарифы с ежемесячными кредитами, ценой в долларах, выгрузкой в 4K на старших планах и роликами длиннее. Цены HeyGen меняет, проверяй их на heygen.com перед оплатой.
Сервис может быть недоступен из России, а оплата отсюда не гарантирована. Обходы мы не советуем ни здесь, ни для других сервисов. Если нужно просто оживить собственный снимок, варианты собраны в статье о том, как оживить фото нейросетью.
Если нужен портрет, а не говорящая голова
Для аватара HeyGen нужен хороший исходник: ровный свет, лицо крупно, ты смотришь в камеру. Бывает, что человек открывает сервис и понимает: главная проблема не в видео, нормальной фотографии себя у него просто нет.
Если хорошего исходника для аватара HeyGen у тебя нет, начни с фото: a-dam.photo делает портреты одного мужчины по его селфи, видео не делает, пакеты от 490 ₽, сцены выбираешь в каталоге.
Источники
- HeyGen, тарифы: https://www.heygen.com/pricing
- HeyGen, документация о согласии для аватаров: https://developers.heygen.com/docs/avatar-consent
- HeyGen, справка по цифровому двойнику: https://help.heygen.com/en/articles/9380615-digital-twin-faq
- HeyGen, языки озвучки: https://help.heygen.com/en/articles/11391932-voice-languages-we-support
- HeyGen, языки перевода видео: https://help.heygen.com/en/articles/11391941-video-translation-languages-we-support
Частые вопросы
HeyGen это что?
Сервис heygen.com для видео с говорящим аватаром. Ты даёшь фото или запись себя и текст, сервис делает ролик, где аватар произносит этот текст твоим или синтезированным голосом с движением губ под речь.
Можно ли пользоваться HeyGen бесплатно?
Бесплатный план есть. По странице тарифов он даёт 3 видео в месяц длиной до минуты, выгрузку до 1080p, один свой видеоаватар и один клон голоса. Для регулярной работы этого мало, дальше идут платные тарифы с кредитами.
Есть ли HeyGen на русском?
Русский есть среди языков озвучки и среди языков перевода видео. Можно написать текст по-русски и получить аватар, который его произносит, или перевести готовый ролик с другого языка с подстройкой губ.
Можно ли сделать аватар HeyGen из чужого фото?
Нет. Для цифрового двойника сервис требует видеосогласие от самого человека в кадре. Для фото-аватара такой проверки нет, но в документации сказано, что это не разрешение: согласие человека нужно всё равно.
Делает ли a-dam.photo видео?
Нет. Мы делаем только фотопортреты одного мужчины по его снимкам, роликов в продукте нет.
Обновлено: 2 октября 2026
Готов попробовать?
Выбери сцены из каталога — более 600 вариантов. Первые кадры через пару минут после оплаты, от 490 ₽.
Выбрать сцены →Читать дальше
AI-фотосессия · 8 мин
AI-фото и дипфейк: в чём разница и где граница
Разница не в нейросети, а в том, чьё лицо в кадре и кто это разрешил.
AI-фотосессия · 8 мин
AI-аватарка: как сделать нейросетью и не выглядеть фейком
Аватарка это один кадр в квадрате размером с ноготь. Какие сцены и какой отбор дают такой кадр из генерации.
AI-фотосессия · 8 мин
Почему нейросеть меняет черты лица: разбор механики
Не инструкция, а объяснение: что именно тянет твои черты в сторону усреднённого лица и на каком шаге это происходит.
AI-фотосессия · 8 мин
Оживить фото нейросетью: как это работает и где граница
Четыре секунды движения из одной фотографии: что модель знает о лице, что сочиняет и почему со снимками близких нужна осторожность.