Лаборатория будущей жизни Alibaba

HappyHorse 1.0 — Видео с собственным звуком

Видеомодель с 15 миллиардами параметров, которая генерирует изображение, движение и звук за один проход. Напишите сцену, добавьте отсылку и получите кинематографические клипы с синхронизированными по губам диалогами.

Творите с HappyHorse 1.0

Текст в видео, изображение в видео и ссылка на видео — включая собственный звук. Создавайте клипы длительностью 3–15 секунд в разрешении 720p или 1080p.

0 / 2500

3с

3–15 секунд

Требуемые кредиты:150

Пример видео

(Здесь появятся сгенерированные видеорезультаты)

Большинство видеомоделей сначала генерируют изображение, а потом включают звук. HappyHorse 1.0 кодирует текст, видео и аудио в одном потоке — поэтому щелчок двери, ливень и произнесенная фраза относятся к одному и тому же моменту.

Почему HappyHorse 1.0 выделяется

Один проход для изображения и звука

Один проход для изображения и звука

Трансформатор 15В обрабатывает текст, видео и звук одновременно. Движение губ и речь создаются вместе на уровне фонем, а не сшиваются постфактум.

Личность субъекта, которая сохраняется

Личность субъекта, которая сохраняется

Лица, гардероб и продукты остаются неизменными при движении. Ссылка на видео может заблокировать до девяти визуальных привязок, чтобы персонаж или артикул не смещались в середине клипа.

Язык подсказок режиссера

Язык подсказок режиссера

Опишите размер кадра, движения камеры, время и звуковое оформление. HappyHorse 1.0 рассматривает «медленное нажатие в течение трех секунд, теплый свет из окна» как структуру, а не настроение.

Доказано слепыми сравнениями

Доказано слепыми сравнениями

На видеоарене искусственного анализа HappyHorse 1.0 вошла в число лучших видеомоделей как по преобразованию текста в видео, так и по преобразованию изображения в видео — по мнению людей, которые не могли видеть название модели.

HappyHorse 1.0 — это семейство рабочих процессов обработки видео на одной магистральной сети. Выберите точку входа, соответствующую уже имеющимся у вас активам.

Четыре способа создания

Создано для людей, которые выпускают короткие видео, а не просто экспериментируют с ними. В центре внимания — производительность, ориентированная на человека: лица, речь и продукты, которые должны выдерживать временные рамки.

Для кого предназначен HappyHorse 1.0

Создатели и кинематографисты

Создатели и кинематографисты

Блокируйте кадры, пробуйте язык камеры и создавайте многоязычные диалоги без отдельного голосового конвейера. Полезно для аниматики, социальных фильмов и Look-разработки.

Команды бренда и кампании

Команды бренда и кампании

Приведите героя в движение, а затем сохраняйте одинаковый талант или продукт во всех вариантах. Достаточно быстрый для концептуальных раундов, достаточно острый для платных размещений.

Электронная коммерция и видео о продуктах

Электронная коммерция и видео о продуктах

Анимируйте фотографии каталога, фиксируйте внешний вид SKU с помощью ссылок и добавляйте окружающий звук или готовый к озвучке звук в том же поколении.

От подсказки к воспроизводимому клипу

HappyHorse 1.0 выводит изображение с разрешением до 1080p, 3–15 секунд, в форматах 16:9, 9:16, 1:1, 4:3 и 3:4. Сгенерируйте на этой странице — отдельный аудиоинструмент не требуется.

Начать генерировать

Одна система с 15 миллиардами параметров обеспечивает каждый рабочий процесс. Визуальные эффекты и звук генерируются вместе, при этом основной целью дизайна являются люди.

Возможности HappyHorse 1.0

Совместная генерация видео и аудио

Изображение, движение, речь и окружение происходят из одного и того же прямого прохода. Закрывающаяся дверь и ее щелчок — это одно решение, а не два конвейера.

Синхронизация губ на уровне фонем

Форма рта повторяет звуки речи, а не только слова. Умение работать с говорящими головами и ведущими клипами на шести языках.

Блокировка первого кадра изображения и видео

Ваш кадр становится точным начальным кадром. Движение продолжается, а вес, линии глаз и геометрия продукта остаются правдоподобными.

Многосправочный контроль идентификации

До девяти ссылок можно прикрепить персонажей, одежду и товары, чтобы серия клипов оставалась визуально выровненной.

Подсказки с учетом выстрела

Широкое открытие, синхронизированные нажатия и звуковые ноты интерпретируются как структура кадра — ближе к режиссерскому заданию, чем к общей подсказке настроения.

Готовые к производству размеры вывода

720p или 1080p, 3–15 секунд, альбомное и книжное соотношение для лент, историй и размещения героев.

Продолжайте исследовать

Создайте на этой странице, сравните планы или продолжите работу с другими моделями на платформе.

Часто задаваемые вопросы по HappyHorse 1.0

На этой странице собрана общедоступная информация о HappyHorse 1.0. Мы не связаны с Alibaba.