ComfyUI-H3-FaceRefine: исправление генерации лиц на общих планах в MiniMax H3

В видеомодели MiniMax H3 лица на общих планах часто превращаются в кашу. Проблема не в разрешении, а в соотношении размера головы к кадру. Артефакты остаются даже в 720p и выше. Для решения задачи появился набор кастомных нод ComfyUI-H3-FaceRefine. Инструмент работает по принципу FaceDetailer из Impact Pack, но адаптирован для видео.
Пайплайн покадрово отслеживает лицо через детекторы YOLOv8 и вырезает его. Вырезанный фрагмент масштабируется до размеров всего холста. Затем алгоритм перегенерирует крупный план через img2img инъекцию латентов. Для стабильного трекинга конкретного персонажа в толпе используется библиотека insightface. После генерации исправленный фрагмент вшивается обратно в исходный видеоряд с учетом временного шумоподавления.
Инструмент поддерживает работу с аудио для липсинка через MiniMaxH3NativeAudioLock. При загрузке весов в формате GGUF весь процесс укладывается в 12 ГБ видеопамяти. В репозитории лежат готовые шаблоны рабочих процессов. Доступны варианты с базовой прямоугольной маской и с точным выделением лица через модель SAM.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад