Музыкальный клип по референс-фото и треку: сегментный промпт — Veo
Сегментный промпт для генерации музыкального клипа в видеомоделях с референсами: исполнитель по фото с сохранением identity, гардероб по второму фото, трек как единственное аудио и липсинк по секундам. Формат родом из Seedance 2.0 (Higgsfield), работает везде, где модель принимает фото и аудио.
Пример результата
Пример заполнения: сегмент 1 из 10, исполнительница — «две косы, переходящие в длинные тёмные локоны, серебряная серьга-подвеска, тонкая цепочка с кулоном»; гардероб — «чёрный укороченный пиджак, узкий галстук с анималистичным принтом, джинсовая мини-юбка с рюшами, лоферы»; липсинк — «0.0–2.0 „Всё — в игру!“ / 3.0–4.0 „Свет горит“»; локация — «улица со старыми кирпичными домами, раннее золотое утро»; shot flow — «0–2 с: кадр из-за перил крыльца, резкий crash zoom, героиня не в центре; 3–4 с: план через плечо». Модель выдаёт сегмент на 8–15 секунд (Veo — около 8 секунд за генерацию) «дорогого» клипа: героиня узнаваема, рот попадает в слова, кадры смещены от центра — киношная, а не стоковая картинка. Совет 1: клип собирается сегментами по 8–15 секунд — пишите отдельный промпт на каждый, но блок identity и continuity копируйте без изменений, иначе лицо и одежда «поплывут». Совет 2: на инструментальных паузах явно пишите «рот закрыт» — иначе модель дорисует пение там, где его нет. Совет 3: правило «без центра» жёстко ломает ось (восьмёрку) — если нужен классический монтаж диалоговых планов, добавьте требование соблюдать 180-degree rule. Совет 4: классический Veo 3 не принимает аудиофайл на вход — вокал и его характер опишите текстом в блоке липсинка, а мастер-трек положите поверх на монтаже; строку про @Аудио1 оставляйте только в моделях с аудио-входом.