Как это сделать
Схема состоит из трёх частей. В начале стоит вход: ваша идея в одной или двух фразах, например «женщина работает за ноутбуком в светлом домашнем офисе». Дальше идёт нода языковой модели с инструкцией, которая превращает идею в подробный промпт. Результат этой ноды подключается к ноде генерации изображения или видео как её текстовый вход. Это означает, что вручную пишется только идея. Остальное модель собирает по заданным правилам, и все промты получаются в одной структуре.
Инструкция для языковой модели
Качество зависит от инструкции в ноде. Если написать просто «придумай промпт для картинки», результат будет случайным: то слишком короткий, то с лишними пояснениями, то на русском там, где модель генерации ожидает английский. Инструкция должна задавать четыре вещи: роль, структуру, язык и формат ответа.
Пример:
Ты пишешь промпты для генератора изображений. Получив короткую идею, составь один подробный промпт на английском языке. Структура промпта: главный объект и действие, ракурс и композиция, место и фон, освещение, стиль и фактура, цветовая палитра, технические детали съёмки. Правила: пиши одним абзацем, 60-90 слов. Не добавляй объектов, которых нет в идее, кроме мелких деталей окружения. Если в идее есть надпись, оставь её без изменений в кавычках. В конце добавь «no watermark, no extra text». Ответ: только текст промпта, без пояснений, заголовков и кавычек вокруг всего текста.
Последняя строка важна. Если модель ответит фразой вроде «Конечно, вот ваш промпт:», эта фраза попадает в генерацию вместе с самим промтом и испортит результат.
Как это выглядит в рабочем пространстве
Идея: Молодая женщина работает за ноутбуком в светлом домашнем офисе, на экране надпись WORKFLOW Ответ языковой модели: Молодая женщина работает за ноутбуком в светлом домашнем офисе, на экране ноутбука крупная надпись «WORKFLOW», современный минималистичный интерьер, естественный дневной свет из окна, аккуратный рабочий стол, уютная атмосфера, реалистичная фотография, высокая детализация, мягкие нейтральные тона.
Этот текст идёт напрямую в ноду изображения. Вы набрали одну строку, модель собрала из неё полный промт с композицией, светом и техническими деталями.
Как получить видео из того же изображения
Для видео нужна вторая нода языковой модели с другой инструкцией, потому что структура промта отличается. Для видео из готового кадра описывать сцену повторно не нужно, она уже есть на картинке. Нужно описать движение и камеру.
Ты пишешь промпты для генерации видео из готового изображения. Получив идею движения, составь один промпт на английском языке. Структура: движение камеры, действие главного объекта, движение второстепенных деталей, что должно остаться неизменным. Правила: не описывай внешний вид сцены, она уже задана изображением. Движения плавные и реалистичные, без резких переходов. Обязательно добавь фразу о том, что лицо, одежда и надписи остаются неизменными. 40-60 слов, одним абзацем. Ответ: только текст промпта.
Идея: «медленный наезд на экран, героиня поворачивает голову». Модель вернёт готовый текст с командой для камеры, описанием поворота головы и пунктом о стабильности внешнего вида. Дальше он подключается к ноде видео вместе с картинкой из первой ветки.
Как проверять результат
Промт, который написала модель, стоит увидеть до запуска генерации. Генерация дороже текста, а ошибка в промте делает дорогой запуск бесполезным. В схеме можно вывести ответ языковой модели в отдельный блок просмотра и остановиться на нём: прочитать, поправить входную идею или инструкцию и только потом запускать нодa изображения. Что смотреть в промте: сохранилась ли надпись без изменений, нет ли лишних объектов, которых вы не просили, не появились ли пояснения вроде «вот промт». Если одна и та же проблема повторяется, исправляйте инструкцию, а не каждый промт отдельно.



