Open Call
для AI video
art авторов

Фото + аудио Синхрон губ В полный рост ByteDance
OmniHuman

OmniHuman
видео человека из фото и голоса
в Phygital+

OmniHuman — нейросеть ByteDance: одно фото человека и дорожка речи превращаются в видео в полный рост — с жестами и синхроном губ. Не только «говорящая голова». В Phygital+ онлайн: бесплатная проба, без VPN.

Подходит и для стилизованных персонажей. Текстовое описание и быстрый режим помогают докрутить движение без пересъёмки. Озвучку можно взять из Sound Creation или Voice Clone рядом в пространстве.

OmniHuman

Кратко OmniHuman

Для кого

Персонажи для рекламы, обучения и презентаций с синхроном губ

Команды, которым нужно видео человека из фото и голоса

Вендор
ByteDance
Релиз
Февраль 2025 (OmniHuman-1)
Категория
AI-видео — анимация человека по звуку
Модальности
Изображение + аудио (+ текст, маска) → видео
Длина аудио
До ~35 секунд за генерацию
Коммерческое использование
Да
Доступ
Все тарифы Phygital+

Зачем использовать OmniHuman

Видео из фото и голоса: тело, жесты и устойчивый синхрон губ.

1

Видео из фото и голоса

Один портрет и речь — готовый говорящий ролик без съёмки.

2

Не только лицо

Движение всего тела: жесты и поза, а не классическая «говорящая голова».

3

Синхрон губ держится

Губы совпадают с дорожкой — основа убедительности персонажа.

4

Не только реализм

Работает и со стилизованными и мультяшными персонажами.

5

Контроль без пересъёмки

Текстовое описание и быстрый режим — правите движение, не зовя актёра снова.

Для кого говорящих персонажей по фото

OmniHuman подходит, когда есть портрет и готовая озвучка — и нужен говорящий человек в кадре целиком, а не только лицо.

OmniHuman
edu
OmniHuman
OmniHuman
edu
OmniHuman

Как использовать OmniHuman

Фото + аудио (озвучка из пространства), при необходимости описание — генерация.

OmniHuman
Шаг 1

Подключите фото

Портрет или персонаж анфас — чем чище кадр, тем стабильнее результат.

OmniHuman
Шаг 2

Подключите аудио

Речь до ~35 сек: озвучка, клон голоса или своя дорожка.

OmniHuman
Шаг 3

Описание и экспорт

При необходимости опишите жест или сцену, включите быстрый режим для черновика и сохраните результат.

Сгенерировано в OmniHuman

OmniHuman
OmniHuman
OmniHuman
OmniHuman
OmniHuman
OmniHuman
OmniHuman
OmniHuman
Начать генерацию

Цены и доступ

Одна подписка — без отдельного сайта OmniHuman. Можно начать бесплатно, без VPN.

Free

Попробовать OmniHuman бесплатно

500 кредитов в неделю. Карта не нужна.

  • 500 кредитов в неделю
  • Доступ к 30+ моделям
  • Личное использование
Начать бесплатно
Pro

Профессиональный доступ

45 000 кредитов в месяц, коммерческие права и полные скачивания.

  • 45 000 кредитов в месяц
  • Коммерческая лицензия
  • Кредиты на 15% дешевле
Выбрать Pro
Team

Работа в команде

90 000 кредитов в месяц, до 10 мест, общее пространство.

  • 90 000 кредитов в месяц
  • До 10 мест
  • Общий биллинг
Выбрать Team
Enterprise

Масштаб Enterprise

210 000 кредитов в месяц, API и выделенный менеджер.

  • API и интеграции
  • Безлимит мест
  • Выделенный менеджер
Связаться

Технические характеристики

Характеристики OmniHuman в Phygital+.

Модель
OmniHuman-1 / OmniHuman 1.5
Релиз
Февраль 2025 (статья и модель)
Обязательные входы
Фото персонажа, аудио
Результат
Видео с синхроном губ и жестами
Сид
От −1 до 2147483647, по умолчанию случайный
Кого поддерживает
Люди, гуманоиды, стилизованные и мультяшные персонажи
Вендор
ByteDance
Архитектура
Диффузионный трансформер (DiT) с обучением на смешанных условиях
Опциональные входы
Текстовое описание, маска
Длина аудио
Рекомендуется до 35 сек, поле до 60 сек
Быстрый режим
Опционально: быстрее за счёт качества эффекта

OmniHuman vs другие AI-модели

Говорящий персонаж рядом с озвучкой и генераторами видео.

Модель

OmniHuman

Анимация человека в полный рост из фото и речи (ByteDance)

Kling Omni

Сцены с устойчивым персонажем и раскадровкой, без отдельного входа «аватар»

HeyGen

Студийные ведущие и готовая библиотека персонажей

Wan Video

Видео из текста и картинки без режима говорящего человека

Лучше всего для Любое фото становится говорящим ведущим с жестами Направленные мультипланы с именованными элементами Готовые аватары ведущих, скрипт → видео Обычное видео из текста и картинки
Что на входе Одно изображение + одна аудиодорожка (речь) Текстовое описание, референсы Скрипт и выбор аватара Описание, первый/последний кадр
Движение Жесты всего тела, мимика и точный синхрон губ По умолчанию не от звука Сток и свои аватары, не свободная анимация вашего фото Без фокуса на синхрон губ
Длина До 35 секунд аудио за генерацию Минуты на один план Минуты на клип Секунды на ролик из текста или картинки

Используйте OmniHuman вместе с другими AI-моделями в Phygital+

Сначала озвучка, потом OmniHuman, при необходимости улучшение видео.

OmniHuman

С озвучкой (Sound Creation)

Сгенерируйте речь и подайте в OmniHuman.

OmniHuman

С клоном голоса (Voice Clone)

Клон голоса бренда — персонаж говорит «своим» тембром.

OmniHuman

С генерацией картинок

Соберите портрет, затем анимируйте.

OmniHuman

С улучшением видео

Поднятие разрешения после выбранного дубля.

Начать генерацию

Коротко про OmniHuman в Phygital+.

FAQ по OmniHuman

OmniHuman
Что такое OmniHuman?

Нейросеть ByteDance: фото человека и аудио превращаются в видео в полный рост — с синхроном губ и жестами (OmniHuman-1, 2025).

Можно ли OmniHuman бесплатно?

Да, на бесплатном тарифе Phygital+ — пробные кредиты. Аккаунт нужен.

Чем отличается от старых «говорящих голов»?

Не только лицо: модель двигает тело и жесты под речь, а не просто накладывает рот на статичный портрет.

Работает ли на мультике и стиле?

Да, стилизованные персонажи тоже поддерживаются — качество зависит от исходного кадра.

Что подключать к ноде?

Обязательно изображение и аудио; по желанию — текстовое описание и маску.

Какая длина аудио?

Обычно до ~35 секунд за одну генерацию — смотрите карточку модели перед запуском.

Зачем текстовое описание?

Коротко направляет движение и сцену поверх анимации от звука.

Что меняет быстрый режим?

Быстрее и дешевле черновик; для финала его часто выключают.

Нужен ли VPN или скачивание?

Нет — онлайн в Phygital+, без VPN. Озвучку можно собрать рядом в пространстве.

Можно ли использовать коммерчески?

На платном тарифе — да; нужны права на фото и голос.

Другие AI-модели в Phygital+

Весь каталог 30+ AI-моделей в Phygital+.

Dialogue Creation ElevenLabs v3 FLUX Gemini Omni GPT-Image-2 Hailuo 3.0 Ideogram 3 Kling 3.0 Kling Omni Kling Omni Image Krea AI LTX Video Luma Magnific Upscale Midjourney Nano Banana Pro OmniHuman Qwen Image Recraft V4 Reve Runway 4.5 Seedance 2.5 Seedream 5 Sound Creation Topaz Upscale Upscale Video Veo 3.1 Voice Clone Voice Creation WAN 2.5 Wan Video 2.1

Готовы работать быстрее с OmniHuman?

Присоединяйтесь к 100+ командам в Phygital+ — все модели в одном workspace

Попробуйте Phygital+ бесплатно
bg

Российская Федерация
ООО «АЙ-СПЕЙС»
101000 г. Москва, ул. Мясницкая, д. 30/1/2, стр. 2, помещ. 1/Ч
ИНН/КПП 7721481180/770101001
ОГРН 1167746316462 — data
Email: we@phygitalism.com

Правила и условия

Российская Федерация
ООО «АЙ-СПЕЙС»
101000 г. Москва, ул. Мясницкая, д. 30/1/2, стр. 2, помещ. 1/Ч
ИНН/КПП 7721481180/770101001
ОГРН 1167746316462 — data
Email: we@phygitalism.com

Правила и условия