Tr1dae

ComfyUI-MiniMaxH3_LatentUpscaler

Tr1dae

MiniMaxH3_LatentUpscaler for ComfyUI

AI 简介

这是一个专为ComfyUI设计的MiniMax H3视频-音频联合潜空间上采样节点,用于在两阶段采样流程中对NestedTensor格式的多模态潜变量(视频[B,24,T,H/16,W/16] + 音频[B,32,2,T_audio])进行无损空间上采样与噪声重校准。核心功能包括:视频潜变量双线性插值上采样、音频潜变量可控重噪(audio_denoise参数调节)、视觉参考(minimax_refs/keyframes)及RoPE元数据同步缩放,并支持显存优化缓存管理。不依赖学习模型,而是基于PyTorch原生插值与噪声调度逻辑实现。适用于MiniMax H3多模态生成工作流中的高分辨率视频-音频协同生成场景,尤其适合需分阶段控制时空质量的创作者与研究者。

Python
182
Stars
9
Forks
1
Watchers
1
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分40
默认分支main