Как это работает

Генерация видео в HappyHorse

Коротко. В одно задание платформа HappyHorse принимает от 1 до 9 референсных изображений. На каждое из них ссылаются прямо в тексте промпта — через @Image1, @Image2 и так далее. Режим называется Reference to video, на выходе получается ролик 5-15 секунд в 16:9, 9:16, 4:3, 3:4, 21:9, 1:1, 5:4, 4:5.

01

Чем это отличается от генерации по одному описанию?

Обычный генератор получает только текст и додумывает всё остальное — как выглядит герой, где он находится, какого цвета свет. HappyHorse принимает до 9 изображений в одно задание, и вы ссылаетесь на них прямо в промпте. Внешность и фон вы не описываете словами, а показываете; в тексте остаётся только то, что происходит.

Разница видна на повторных генерациях. Текстовое описание «девушка в красной куртке» каждый раз даёт новую девушку и новую куртку. Ссылка на @Image1 отправляет модель к одной и той же картинке, поэтому персонаж от дубля к дублю держится ближе к исходнику.

Отсюда и типичные сценарии: подставить своего героя в чужую локацию, оживить снятый кадр, собрать короткую рекламную вставку с конкретным товаром. Всё, что требует узнаваемого объекта, здесь решается картинкой, а не длинным абзацем текста.

02

Как устроена работа с референсами

Три вещи, которые нужно понять до первой генерации: сколько картинок можно дать, как на них ссылаться и где это писать.

Вход

От 1 до 9 изображений

Одно задание принимает до девяти референсов. Можно обойтись и одним — тогда остальное описывается текстом.

Синтаксис

Ссылки @Image1 и @Image2

В промпте на изображения ссылаются по имени: @Image1, @Image2 и дальше по списку. Подсказка офсайта показывает формат дословно — «Use the character in @Image1, walking into the scene of @Image2».

Режим

Reference to video

Так называется режим сборки ролика по референсам. Именно он включает разбор ссылок на картинки в тексте задания.

Поле промпта рассчитано на 5 000 знаков, и это не запас на всякий случай. Когда объектов на входе несколько, текст уходит на описание связей между ними, а не на внешность — и места нужно заметно больше, чем на одну фразу.

03

Пошагово: от загрузки до готового ролика

Порядок одинаковый для бесплатного плана и для Pro — тариф меняет только количество кредитов и число одновременных заданий.

Шаг 01

Соберите референсы

Отберите изображения заранее: персонаж, локация, предмет, стиль. В одно задание помещается от 1 до 9 картинок, поэтому лишние лучше отсеять до загрузки.

Шаг 02

Включите режим Reference to video

В студии на официальном сайте это отдельный режим генерации. Без него ссылки на картинки в тексте разбирать нечему.

Шаг 03

Загрузите изображения в задание

После загрузки каждая картинка получает своё обращение — @Image1, @Image2 и дальше по списку. Эти имена и пойдут в текст промпта.

Шаг 04

Напишите задание

Держитесь структуры из подсказки офсайта: сначала объект и его источник, потом действие и связь с другим источником — «Use the character in @Image1, walking into the scene of @Image2». Лимит поля — 5 000 знаков.

Шаг 05

Учтите формат до запуска

Ролик выйдет длиной 5-15 секунд в соотношении 16:9, 9:16, 4:3, 3:4, 21:9, 1:1, 5:4, 4:5 и разрешении 720p. Экспорт в 1080p и снятие водяного знака открываются на платных тарифах.

Шаг 06

Запустите и повторите

Бесплатный план держит до 2 параллельных генераций, Standard — до 10, Pro снимает лимит. На платных тарифах доступен пакетный запуск, то есть несколько вариантов одного замысла считаются разом.

04

Границы формата

Параметры генерации фиксированные. Их стоит держать в голове ещё на этапе замысла — подстроить длину или пропорции под задачу не получится.

Параметр Значение
Модель HH 1.1
Соотношение сторон 16:9, 9:16, 4:3, 3:4, 21:9, 1:1, 5:4, 4:5
Разрешение 720p, на платных тарифах доступен экспорт 1080p
Длина ролика 5-15 секунд
Референсы от 1 до 9 изображений в одном задании
Длина промпта до 5 000 знаков
05

Что делать, если результат не тот

Чаще всего дело не в модели, а в том, что объекты и связи между ними смешаны в одну фразу. Разведите их — и правки станут точечными.

Приём 01

Отдельно опишите объекты

Сначала назовите, что вы берёте с каждой картинки: персонажа из @Image1, локацию из @Image2, предмет из @Image3. Пока модель не знает роли изображения, она выбирает её сама — и часто не ту.

Приём 02

Отдельно опишите связь

Второй частью задания идёт действие: кто куда движется, что с чем взаимодействует, как ведёт себя камера. В подсказке офсайта это ровно вторая половина фразы — «walking into the scene of @Image2».

Приём 03

Не дублируйте картинку словами

Если внешность героя уже есть на референсе, повторное описание одежды и лица в тексте тянет результат в свою сторону. Оставьте картинке внешность, тексту — поведение.

Приём 04

Уберите лишние референсы

Девять изображений — потолок, а не цель. Чем больше источников, тем больше связей приходится проговаривать. Если сцена расползается, сократите вход до двух-трёх картинок.

Читайте также

Создайте первый ролик прямо сейчас

Оформите подписку Syntx и получите доступ к HappyHorse и 90+ нейросетям.