← Блог Обзор

Hedra AI: говорящий аватар из фото — как пользоваться

· · 6 минут чтения
Портрет превращается в говорящего видеоаватара со звуковой волной и микрофоном

Коротко. Hedra — американская нейросеть для создания говорящих персонажей. Вы загружаете фото (или генерируете его) и аудиодорожку, а модель делает видео, где персонаж произносит этот текст: двигает губами в такт, моргает, меняет выражение лица и жестикулирует. Разбираем, что умеет Hedra AI, как сделать первого аватара, где у неё ограничения и что делать, если оплатить сервис из России не получается.

Что такое Hedra

Hedra — стартап из Кремниевой долины, основанный в 2023 году выходцами из Стэнфорда. Первой моделью была Character-1: она анимировала только лицо и быстро стала популярной у авторов мемов и подкастов. Следующее поколение, Character-3, компания называет «омнимодальной» моделью: она одновременно учитывает картинку, звук и текстовое описание, поэтому двигается не только рот, но и голова, плечи, руки, а эмоции совпадают с интонацией.

Сейчас Hedra — это не одна модель, а студия: внутри можно сгенерировать портрет, озвучить текст встроенными голосами и собрать ролик. Для части задач студия использует сторонние генераторы картинок и видео.

Что умеет Hedra AI

  • Говорящая голова по фото. Главная функция: портрет плюс аудио — и персонаж говорит.
  • Любой стиль. Работает с фото, рисунками, 3D, аниме и даже с мордами животных.
  • Озвучка внутри. Текст можно не записывать, а озвучить выбранным голосом прямо в сервисе.
  • Управление эмоциями. Текстовой подсказкой задаётся настроение: «спокойно», «взволнованно», «с улыбкой».
  • Любой язык. Губы подстраиваются под звук, поэтому русская речь работает так же, как английская.

Где это применяют: короткие видео для соцсетей и рекламы, ведущий для обучающего курса, «оживший» персонаж для игры или подкаста, поздравления, презентации продукта без съёмки.

Как сделать говорящего аватара: пошагово

  1. Подготовьте портрет. Лицо анфас или чуть вполоборота, хорошо освещено, рот закрыт или слегка приоткрыт, без рук у лица. Чем чище исходник, тем меньше артефактов.
  2. Подготовьте звук. Запишите голос без шумов и музыки либо сгенерируйте озвучку. Короткие фразы получаются лучше длинных монологов.
  3. Задайте описание. Одной-двумя фразами опишите эмоцию и поведение: «говорит уверенно, слегка кивает».
  4. Сгенерируйте и проверьте. Смотрите на зубы, края лица и руки — там чаще всего появляются ошибки. Если что-то не так, поменяйте фото, а не только подсказку.

Примеры описаний, которые хорошо работают:

  • «Ведущая курса, говорит спокойно и дружелюбно, смотрит в камеру, иногда слегка улыбается» — для обучающих роликов;
  • «Персонаж мультфильма, говорит эмоционально, активно жестикулирует, удивлённо поднимает брови» — для соцсетей;
  • «Деловой мужчина в офисе, говорит уверенно и размеренно, кивает в конце фраз» — для презентации продукта.

Держите описание коротким: эмоция, темп, направление взгляда. Длинные «художественные» подсказки модель всё равно учитывает лишь частично, а главное в ролике задают фото и звук.

Видео и озвучка нейросетью — без VPN

Veo 3.1, Kling и озвучка текста в одном окне. Оплата в рублях, без подписки.

Открыть Умку →

Ограничения и цена Hedra

У Hedra есть бесплатный тариф, но кредитов на нём мало, а ролики выходят с водяным знаком. Платные тарифы — подписка в долларах: она снимает водяной знак, повышает качество и даёт право на коммерческое использование. Российские карты к оплате не принимаются, а стабильная работа сайта из России не гарантирована.

Ещё несколько ограничений, которые стоит знать заранее:

  • длинный монолог лучше резать на куски — на длинных роликах растёт шанс «поплывшего» лица;
  • быстрые движения и повороты в профиль даются модели хуже, чем спокойная речь в камеру;
  • делать видео с лицом реального человека без его согласия нельзя — это нарушает правила сервиса, а в рекламе ещё и закон.

Чем заменить Hedra из России

Точной копии Hedra в Умке нет: синхронизировать губы с вашим аудиофайлом наши модели не умеют. Но многие задачи решаются другими путями, и всё это доступно в разделе видеонейросетей без VPN.

ЗадачаHedraЧто использовать в Умке
Персонаж произносит репликуФото + ваше аудиоVeo 3.1: реплика в кавычках в промте, звук генерируется сразу
Оживить портретФото + аудиоKling: видео из фото — моргание, поворот, улыбка, без речи
Озвучить текстВстроенные голосаОтдельная озвучка текста нейросетью
Создать портрет персонажаГенератор в студииГенераторы картинок: Nano Banana и другие
ОплатаПодписка в долларахПакеты в рублях, без подписки

Как это выглядит на практике. Если нужен говорящий персонаж, опишите его в Veo 3.1 и дайте реплику в кавычках: модель сама сгенерирует и лицо, и голос. По-русски она говорит, но дикция хуже, чем на английском, — делайте несколько дублей. Подробности и примеры промтов — в статье «Veo 3 нейросеть». Если же важно лицо с конкретного фото, оживите его в Kling — как это сделать, рассказано в гайде «Как оживить фото нейросетью», — а голос сгенерируйте в разделе озвучки и наложите на ролик в любом видеоредакторе. Про выбор голоса читайте в статье «ИИ-озвучка».

Сколько это стоит в Умке

Подписки нет: пополняете баланс токенами и тратите по факту. При регистрации дают 60 токенов — их хватит, чтобы сгенерировать портрет персонажа (обычная картинка стоит 35 токенов), но не видео: ролик стоит заметно дороже и зависит от модели и длины. Минимальный пакет — 725 токенов за 290 ₽, дальше 1811 токенов за 690 ₽, 4172 за 1490 ₽ и 11 700 за 3900 ₽ — в больших пакетах токен до 20% выгоднее. Подробно — на странице цен.

Вывод

Hedra — одна из лучших нейросетей для говорящих аватаров: фото и аудио превращаются в убедительное видео с мимикой и жестами. Минусы — оплата в долларах и нестабильный доступ из России. Если нужен говорящий персонаж без VPN, попробуйте Veo 3.1 с репликой в промте, а для конкретного лица — связку «оживление фото плюс озвучка».

Сделайте своего персонажа

60 токенов в подарок, карта не нужна. Без подписки и VPN.

Открыть Умку →

Частые вопросы

Hedra бесплатная?

Есть бесплатный тариф с небольшим запасом кредитов, но ролики на нём выходят с водяным знаком и в ограниченном качестве. Для коммерческого использования и длинных видео нужна платная подписка в долларах.

Говорит ли Hedra по-русски?

Да. Модель синхронизирует губы с любой загруженной аудиодорожкой, поэтому язык определяется звуком, а не нейросетью. Русскую речь можно записать самому или сгенерировать в сервисе озвучки.

Работает ли Hedra в России?

Сайт может открываться, но оплатить подписку российской картой нельзя, а вход и стабильная работа часто требуют VPN. В Умке Hedra нет, зато есть видеомодели Veo 3.1 и Kling, которые открываются без VPN с оплатой в рублях.

Чем Hedra отличается от оживления фото?

Обычное оживление добавляет движение: моргание, поворот головы, улыбку. Hedra делает говорящую голову — губы, мимика и жесты подстраиваются под конкретную речь из аудиофайла.