На GitHub опубликован репозиторий ralksta/ComfyUI-Photoshoot (лицензия MIT, около 78 звёзд) — набор нод ComfyUI, который собирает «фотосессию» персонажа: героя достаточно один раз описать по 44 полям и сохранить под именем, после чего нода строит серию до 40 кадров с разным кадрированием, позами и выражениями. Ноды выдают только текст промпта, поэтому подходят любой модели, принимающей промпт, а серия рассчитывается детерминированно — её можно продолжить позже без повторов. Обучение LoRA и референсные фото для этого не нужны.


Что произошло
В репозитории ralksta/ComfyUI-Photoshoot опубликован набор нод для генерации «фотосессии» персонажа. Персонаж описывается один раз по 44 полям в шести вкладках — тело, лицо, волосы, макияж, одежда — и сохраняется под именем для повторного использования. Нода Photoshoot собирает серию до 40 кадров по шести осям: камера (7 кадрирований от экстремального крупного плана до общего), поза (18 поз в 4 семействах плюс расположение в сцене), выражение (90 настроений в 9 группах), фокус (12 точек), соотношение сторон (9 форматов) и шум. Текущая версия 2.3.0 от 2 сентября 2026 года принесла ноды Style и Monochrome, настройку стартового номера серии и FAQ.
Контекст
Механика построена на чистом промпт-инжиниринге: ноды не рисуют изображения, а генерируют только текст — от 760 до 1000 символов, в среднем около 840, то есть примерно 190–250 токенов. Устойчивость серии держится на двух приёмах. Первый — детерминированное комбинирование по последовательности Кронекера: седьмой кадр всегда один и тот же, а серию можно расширить позже без повторов. Второй — автоматическое укорачивание описания персонажа с расстоянием: для общего плана из карточки вырезаются детали, неразрешимые с такого ракурса, вроде помады, подводки и формы скул (303 символа вместо 376), чтобы они не стягивали композицию к лицу. Такой подход — альтернатива привычным способам удержания персонажа, где консистентность обычно обеспечивают весами LoRA или референсными изображениями.
Почему это важно для индустрии
Для индустрии это пример того, что консистентность персонажа в ComfyUI достигается структурой промпта, а не обучением: открытый MIT-код удешевляет продакшен персонажного контента и одновременно означает, что саму технику невозможно защитить — она совместима с любым стеком. Поскольку на выходе получается текст, набор работает с любой моделью, принимающей промпт, но лучше всего раскрывается с T5/LLM-энкодерами (Flux, SD 3.5, Qwen-Image, Krea 2); у CLIP-моделей SD 1.5 и SDXL детали в конце промпта теряют вес из-за лимита 77 токенов на чанк. Это строительный блок, а не сервис: публичного API нет, метрики латентности и цены не задокументированы, поэтому командам придётся встраивать его в собственный ComfyUI-контур. При этом схема «персонаж как структурированная карточка на 44 поля» и приём «бюджет промпта под разрешимость кадра» — переносимые паттерны, которые могут перекочевать в другие нодепаки, видео- и мультисценовые пайплайны.
Почему это важно для пользователей
Практический сценарий начинается с установки набора через ComfyUI Manager. Дальше читатель получает серию до 40 кадров одного и того же персонажа с разным кадрированием, позами, эмоциями и форматами, не обучая LoRA и не загружая референсные фото. Персонаж сохраняется под именем и переиспользуется между сессиями, так что одного описанного героя можно снимать в разных проектах. В репозитории уже лежат готовый воркфлоу photoshoot-series.json, примеры, гайд по промптингу и постеры-матрицы. Качество кадров целиком зависит от базовой модели: постеры в README отрендерены на Krea 2 Turbo с 8 шагами и CFG 1.0.
Что пока неизвестно / ограничения
Устойчивость идентичности персонажа между кадрами нигде не измерена: количественных метрик в материале нет, а доказательством служат только отрендеренные постеры на одной конфигурации (Krea 2 Turbo, fp8, 8 шагов, CFG 1.0). Ужимание промпта с расстоянием остаётся инженерной гипотезой — в документации нет ни абляций, ни замеров, подтверждающих эффект. Проект молодой: около 78 звёзд, автор-одиночка, публичного API нет, поэтому стоит рассчитывать на локальный инструмент, а не на поддерживаемый сервис.
Источники
- GitHub — ralksta/ComfyUI-Photoshoot: Build a person once, then shoot a whole series (официальный репозиторий, README, готовый воркфлоу photoshoot-series.json)
- Release v2.3.0 — Photoshoot 2.3.0: ноды Style и Monochrome, стартовый номер серии, FAQ
- Full node reference — docs/nodes.md: все контролы, связки focus/framing, укорачивание person-блока с расстоянием
Автор
Look at AI, редакция
