Рабочий процесс ComfyUI для видео с толпой: управление людьми, движением и заслонением

E
Emma Chen·10 мин чтения·Sep 13, 2026
Поделиться в X
Рабочий процесс ComfyUI для видео с толпой: управление людьми, движением и заслонением

Обзор ИИ

Какой рабочий процесс ComfyUI наиболее безопасен для видео с толпой?

Создайте один утверждённый статичный кадр с толпой, отделите главного героя от групп фона, добавьте руководство по глубине или позе, затем сгенерируйте короткий ролик. Увеличивайте интенсивность движения толпы только после того, как личности, траектории движения и заслонения станут стабильными.

Как сохранить последовательность нескольких персонажей в ComfyUI?

Назначьте каждому важному персонажу уникальную роль, «якорь» в виде одежды, зону на экране и действие. Используйте референсы для приоритетных персонажей, оставьте движение камеры простым и проверяйте полные клипы на предмет замены или дублирования персонажей.

Почему ИИ-видео с толпой порождает сливающиеся тела и лишних людей?

Толпы объединяют множество перекрывающихся объектов, быстрое движение, мелкие лица и неопределённую глубину. Когда промпты не определяют слои или траектории, модель может интерпретировать заслонение как новое тело или новую личность.

Готовы попробовать сами?

Бесплатные кредиты при регистрации. Тарифы от $20 в месяц.

Попробовать Seedance бесплатно

Следует ли генерировать сцену с толпой за один проход?

Используйте один проход только для простого фона с лёгким движением. Для более насыщенных действий сначала сгенерируйте или утвердите слой главного героя, затем управляйте толпой как вторым слоем, после чего выполните композитинг или повторно запустите генерацию только для наименьшей области с ошибками.

Почему сцены с толпой ломаются легче, чем одиночные кадры

Одиночный image-to-video кадр требует от модели сохранить одну личность, одно тело и одно основное действие. Кадр с толпой множит эти требования и дополнительно добавляет пересечения: один человек проходит сзади главного героя, другой выходит из кадра, две руки перекрываются, а несколько мелких лиц перемещаются в условиях сжатия. Модель должна решать, какие пиксели принадлежат кому — в каждом кадре. Именно поэтому убедительный статичный постер может превратиться в непригодный видеоклип.

Практическая цель — не «сгенерировать много людей», а поддерживать читаемую иерархию. Определите, кого зритель должен распознавать, кто выполняет повествовательное действие, а кто лишь создаёт атмосферу. Предоставьте главному герою самый сильный референс и наибольшую площадь на экране. Обращайтесь с ключевыми второстепенными персонажами как с персонажами с именами. Остальную толпу рассматривайте как группы с общей направленностью, скоростью и глубиной, а не как двадцать отдельно описанных незнакомцев.

Репетиция фильма разделяет главного героя, режиссёра и актёров фона на читаемые слои глубины

Рассматривайте передний план (главного героя), средний план (режиссёра) и задний план (прохожих) как отдельные задачи управления, а не как одну недифференцированную толпу.

Начните с краткого «договора о приемке»: лицо главного героя остаётся узнаваемым; тела не дублируются; траектории движения на переднем плане не пересекаются; цвета ключевой одежды сохраняются без изменений; входы и выходы происходят строго по одному разу; фон не отвлекает внимание. Это преобразует расплывчатую формулировку «толпа выглядит странно» в конкретные сбои, которые можно изолировать и перегенерировать.

Составьте план ролей и зон до открытия графа

Назначьте приоритеты личностей

Используйте три уровня. Приоритет A — герой или говорящий персонаж; ему предоставляется наиболее чёткое изображение или референс-видео. Приоритет B — один–три ключевых второстепенных персонажа, чьи одежда и действия имеют значение. Приоритет C — атмосфера: силуэты, сидящие посетители, пассажиры или далёкие пешеходы. Не тратите одинаковую силу условного обучения на всех. Слишком много конкурирующих референсов может снизить чёткость вместо её повышения.

Составьте компактный манифест перед формированием промпта:

Роль Зона на экране Визуальный якорь Движение Должно оставаться неизменным
Главный герой спереди-слева до центра ржавая куртка, чёрная сумка идёт навстречу камере лицо и куртка остаются стабильными
Второстепенный A сзади-слева тёмно-синяя кепка пересекает кадр слева направо проходит позади главного героя ровно один раз
Группа B дальняя платформа тёмная офисная одежда медленно садится в транспорт остаётся в масштабе фона

Эта таблица служит производственным контролем, а не текстом, который нужно вставлять дословно. Она заставляет вас устранить противоречия до того, как модель будет вынуждена их угадывать. Если вам нужно сохранить один и тот же состав персонажей в последующих кадрах, в рабочем процессе с несколькими ключевыми кадрами объясняется, как утверждать и повторно использовать визуальные якоря.

Разделите глубину и трафиковые полосы

Набросайте кадр как зоны переднего, среднего и заднего плана. Определите две–три полосы движения с разными направлениями. Избегайте прохождения нескольких полных фигур через одну и ту же центральную точку при первом тесте. Пересечения слева направо проще оценить, чем неограниченная толпа, движущаяся во всех направлениях. Статичная или плавно следящая камера оставляет больше ресурсов для движения тел и сохранения личностей.

Пассажир в ржавой куртке остаётся визуальным приоритетом, тогда как пешеходы на заднем плане проходят на разных уровнях глубины

Используйте тест на заслонение: часть людей проходит спереди, другая — сзади, затем проверьте, выходит ли каждое тело чисто, без слияния.

Постройте рабочий процесс ComfyUI для видео с толпой

1. Утвердите статичный кадр композиции

Создайте или предоставьте чистое изображение в соотношении сторон 16:9 или 9:16 с окончательной высотой камеры, плотностью толпы, распределением одежды и свободными полосами движения. Устраните дублирующиеся лица, невозможные руки или пересекающиеся ноги до начала анимации. Image-to-video может анимировать утверждённый кадр; от него не следует ожидать исправления изначально некорректной компоновки толпы. Для прямого хостинга теста маршрут Seedance image-to-video позволяет оценить тот же исходный кадр без необходимости поддерживать локальный граф.

2. Извлеките только те элементы управления, которые нужны для данного кадра

Выбирайте типы руководства в зависимости от ожидаемого сбоя. Глубина помогает сохранить порядок от переднего к заднему плану. Поза помогает реализовать ключевое действие. Контурные карты могут защитить архитектуру или крупный реквизит. Сегментация или маски помогают изолировать героя от атмосферной группы. Используйте минимально достаточную комбинацию, обеспечивающую читаемость сцены. Применение всех препроцессоров с высокой силой может сделать движение жёстким или вызвать противоречия между различными типами управления.Для перемещающихся референсов вырежьте чистый фрагмент с аналогичным углом камеры и ритмом движения тела. Перед извлечением нормализуйте разрешение и частоту кадров. Убедитесь, что треки поз не «перескакивают» между соседними людьми при их пересечении. Поменявшийся скелет приведёт к поменявшемуся движению — независимо от того, насколько тщательно составлен положительный промпт.

3. Отделите движение главного героя от движения толпы

Создайте базовую версию с участием героя и лишь несколькими второстепенными персонажами. Зафиксируйте seed, модель, sampler, размеры кадра, количество кадров и инструкции для камеры. Как только движение героя будет одобрено, добавьте атмосферную толпу или вторую ветвь условного управления. Если рабочий процесс поддерживает маскирование или композитинг, сохраняйте выводы для героя и фона независимыми как можно дольше — чтобы исправить один без необходимости регенерации обоих.

src=https://r2.seedance.tv/blog/image-to-video-ai-with-prompt-online-free/social-motion-output-v1.mp4
poster=https://r2.seedance.tv/blog/image-to-video-ai-with-prompt-online-free/social-motion-output-poster-v1.jpg
label=Движущийся объект с пешеходами, пересекающими платформу на станции

Этот существующий клип из библиотеки Seedance служит примером визуального контроля, а не контролируемым бенчмарком ComfyUI. Внимательно проследите за движением ведущего тела, проходящими пешеходами, краями пальто, ступнями и случаями экранирования на всём протяжении анимации.

4. Сохраняйте граф и информацию о происхождении

Сохраните JSON-файл рабочего процесса, имена моделей, версии пользовательских узлов, хэши входных данных, seed, размеры кадра, количество кадров, FPS, силу управляющих сигналов и окончательно принятый вывод — всё вместе. ComfyUI способна повторно выполнить только изменённые участки графа, однако это преимущество теряется, если утверждённая конфигурация не была зафиксирована. Если очередь выполнения зависает после рендеринга, воспользуйтесь руководством по восстановлению после заморозки ComfyUI перед тем, как изменять творческие параметры управления.

Промпты для нескольких людей без хаотичных результатов

Формулируйте промпт в порядке кадра: сначала обстановка, затем главный объект, далее выделенные второстепенные персонажи, группы в толпе, камера и, наконец, исключения. Назовите важных людей один раз и сохраняйте их описания стабильными. Описывайте фоновых людей коллективно: «шесть пассажиров в тёмных пальто двигаются к открытому вагону» — понятнее, чем длинный список несвязанных лиц, возрастов и аксессуаров.

Полезный шаблон:

Широкий кадр дождливой платформы, камера на уровне глаз. Женщина в ржаво-коричневом пальто идёт слева спереди к центру, глядя вперёд. Мужчина в тёмно-синей кепке проходит позади неё слева направо. Дальняя группа медленно садится в стоящий поезд. Плавное продвижение камеры вперёд; естественный темп ходьбы; лицо в плане крупно остаётся стабильным; дублированных людей нет; столкновений нет; внезапных появлений нет.

Используйте отрицательные инструкции только для тех классов ошибок, которые проявляются визуально, а не для каждого воображаемого объекта. Фраза «нет дублированных тел, сросшихся конечностей, замены лиц, телепортирующихся пешеходов, ходьбы задом наперёд или новых людей, появляющихся в плане крупно» — конкретна и применима на практике. Если лица искажаются только при уменьшении размера персонажей, руководство по исправлению лиц на расстоянии предлагает целевую диагностику вместо усиления глобальных управляющих ограничений.

Шесть танцоров занимают отдельные полосы движения, тогда как обычные пешеходы остаются в далёком фоне

Тест хореографии должен сохранять различимость тел и жестов, в то время как фоновое движение остаётся подчинённым.

Проверка согласованности толпы с помощью небольшой «лестницы стресс-тестов»

Не начинайте сразу с финальной сцены фестиваля, битвы или концерта. Используйте четырёхступенчатую лестницу. Во-первых, анимируйте трёх людей без пересечений. Во-вторых, допустите проход одного второстепенного персонажа позади главного. В-третьих, введите одно экранирование в плане крупно. В-четвёртых, добавьте далёкую атмосферную группу. Сократите продолжительность и тщательно просмотрите каждый этап перед увеличением плотности.

Оцените результат при нормальной скорости воспроизведения и по кадрам:

  • Идентичность: приоритетные лица, причёски и одежда остаются привязанными к своим носителям.
  • Количество: в плане крупно не появляются новые люди, и ни один требуемый персонаж не исчезает преждевременно.
  • Анатомия: конечности корректно разделяются до и после перекрытия.
  • Трафик: каждый вход, пересечение и выход следует указанной полосе движения.
  • Глубина: дальние люди остаются меньше по размеру и не «вскакивают» в план крупно.
  • Камера: её движение не вызывает общего сдвига или «дыхания» всей группы.
  • Временная завершённость: последние кадры достаточно стабильны для обрезки или продолжения.

Запишите номер первого кадра, на котором нарушается какое-либо правило. Эта точка часто указывает на причину: плохая первоначальная компоновка, смена трека позы, чрезмерная интенсивность движения, слабое условное управление идентичностью или движение камеры, конкурирующее с толпой.

Исправление ошибок без полной перестройки сцены

Если тела сливаются — увеличьте начальное расстояние между ними, упростите траектории пересечения, усильте разделение по глубине или с помощью масок, и сократите длительность кадра. Если идентичность главного персонажа «дрейфует» — уменьшите детализацию толпы в промпте и усильте влияние приоритетного референса, а не повышайте все управляющие параметры сразу. Если фон «заморожен» — добавьте одно коллективное действие и мягкое движение; не назначайте каждому далёкому человеку отдельную роль.

Когда движение «дрожит» — проверьте по кадрам данные о позах или оптическом потоке. Сгладьте один нестабильный трек, уменьшите силу управляющего сигнала в конце кадра или удалите конфликтующий управляющий элемент. Когда люди «всплывают» по краям кадра — начните с меньшего числа персонажей у краёв и явно укажите точки их входа. Храните успешный базовый граф рядом с каждым экспериментом, чтобы обновление узла никогда не уничтожало последнюю известную работоспособную конфигурацию.

Оживлённый рынок продуктов создаёт множество слоёв глубины, не превращая каждого покупателя в персонажа с выделенной ролью

Для плотной атмосферы сначала оцените порядок глубины, чёткость силуэтов и правдоподобие движения толпы — и лишь затем запрашивайте индивидуальные действия фоновых персонажей.

Для множества вариаций разделите творческую генерацию и файловую оркестрацию. В руководстве по пакетной обработке ComfyUI рассматриваются детерминированные папки, манифесты и повторные попытки; данный рабочий процесс с толпой должен сначала создать один одобренный кадр, достойный последующей пакетной обработки.

Когда Seedance Agent — более простой путь производстваЛокальный граф ComfyUI ценен, когда требуются точные препроцессоры, пользовательские маски, управление на уровне моделей или воспроизводимые эксперименты. Он также возлагает на вас ответственность за ссылки, версии узлов, состояние очереди, проверку результатов и частичные повторные запуски. Сложность координации возрастает при съёмке толпы: отклонение одного лишнего персонажа может обесценить иначе удачный дубль.

Seedance Agent полезен, когда важнее выполнение производственной задачи, чем владение графом. Укажите приоритеты актёров, ссылочные ресурсы, манифест кадров, полосы движения толпы, продолжительность, соотношение сторон и правила принятия результатов. Перед генерацией просмотрите предложенный план кадров, одобрите наиболее удачный результат и повторно запустите только неудавшиеся единицы. Преимущество заключается не в гарантии идеального результата для каждой толпы, а в чётком разделении этапов планирования, генерации, проверки и поставки.

Заключение

Надёжный рабочий процесс создания видео с толпой в ComfyUI начинается с утверждённой композиции, назначения приоритетов идентификации, разделения зон глубины и полос движения, применения только необходимых управляющих параметров и постепенного увеличения плотности по измеренной «лестнице нагрузки». Оценивайте полный клип по критериям идентичности, количества, анатомической корректности, заслонения, движения и пригодности финала, затем исправляйте минимальный неудавшийся слой вместо полного перезапуска. Когда поддержка ссылок, масок, версий узлов, проверок и повторных запусков становится более трудоёмкой задачей, планируйте и создавайте последовательность толпы с помощью Seedance Agent и оставляйте ComfyUI для тех кадров, которые действительно выигрывают от локального управления.

Готовы попробовать сами?

Примените шаги из этого руководства в Seedance и превратите промпты или изображения в готовые видео за считанные минуты.

Бесплатные кредиты при регистрации. Тарифы от $20 в месяц.

Похожие статьи

Еще материалы на этом же языке, которые стоит прочитать дальше.