H3 Studio 是一个 ComfyUI 自定义节点,为开放权重的全模态模型 MiniMax H3(也称 Hailuo 3.0)提供前端。它支持文生视频、图生视频、首尾帧和参考生视频,可生成最长 15 秒、24 fps 的视频,并带有同步的 32 kHz 立体声音频。它以自定义节点方式安装,提供单个页面,无需第二个服务、CORS 设置或构建步骤。 由于 H3 不接受自由文本,该工具包含一个本地 LLM 提示词助手,将简单的简述扩展为 H3 的结构化三字段模式,验证后交给 H3。助手也可以就地优化现有提示词。附加的关键帧和主体参考会展示给 LLM,使主体定义描述的是实际图像。 其他功能包括:自动选择任务的关键帧处理、切换到 Ref2VA 检查点和六段式参考模式的主体参考、自我纠正的提示词、模式守卫、会话胶片条、格式验证与修复、采样期间的实时预览、进度报告、LLM 与 H3 之间的 VRAM 自动交接,以及端点编辑器。 要求包括带原生 H3 支持的 ComfyUI 0.30.0+、来自 Comfy-Org/MiniMax-H3 的 H3 权重,以及供提示词助手使用的可选 OpenAI 兼容 LLM 端点。
团队用 H3 Studio 在本地基于 MiniMax H3 生成带原生音频的视频。
团队用 H3 Studio 创建文生视频、图生视频、首尾帧和参考生视频片段。
团队用 H3 Studio 通过附加主体参考照片在多个片段间保持角色一致。
团队用 H3 Studio 借助本地 LLM 把简单简述扩展为 H3 的结构化提示词模式。
团队用 H3 Studio 放入首帧和/或尾帧,并让任务自动跟随。
团队用 H3 Studio 在生成前验证并修复提示词格式错误。
团队用 H3 Studio 在单块消费级 GPU 上管理 LLM 与 H3 之间的 VRAM。
团队用 H3 Studio 保留会话片段,并连同提示词和设置一起回溯。