# Goohai-MiniMax-H3_Integration **Repository Path**: chen-leisures/Goohai-MiniMax-H3_Integration ## Basic Information - **Project Name**: Goohai-MiniMax-H3_Integration - **Description**: MiniMax H3 ComfyUI 智能一体化 孤海FOTO - **Primary Language**: Python - **License**: Not specified - **Default Branch**: main - **Homepage**: None - **GVP Project**: No ## Statistics - **Stars**: 0 - **Forks**: 0 - **Created**: 2026-08-22 - **Last Updated**: 2026-08-22 ## Categories & Tags **Categories**: Uncategorized **Tags**: None ## README # MiniMax H3 ComfyUI 智能一体化(GH) GitHub Goohaitools-comfyui B站 孤海FOTO ## 🎬 视频教程 ### 👉 点击前往 B 站主页观看全部教程 B站视频教程 --- ## 🧩 RunningHub 工作流 ### 👉 点击访问我的 RunningHub 个人主页 RunningHub RH Vibex主页 · 在线运行AI应用 --- MiniMax H3 的独立 ComfyUI 一体化集成节点,支持文本生视频、首尾帧、全能参考和音视频混合条件构建。节点会自动识别素材组合、生成官方媒体标签,自动优化提示词,支持本地模型优化与在线API优化。 An independent ComfyUI integration node for MiniMax H3 conditioning. The diffusion model remains an external input in the downstream sampler. This package bundles the T8 conditioning implementation. ## 功能概览 根据上传的素材智能判定任务类型,负责收集图片、视频、音频和提示词,加载 H3 所需的 CLIP/VAE,并输出供后续采样器使用的 AV(Audio-Video)混合潜空间条件,支持原声音轨输出。 扩散模型本身仍由下游采样器执行。本仓库内置了 T8 风格的条件构建逻辑。 ## 节点 ### `MiniMax-H3 智能一体化(GH)` 主节点,负责: - 加载 MiniMax H3 CLIP、视频 VAE 和音频 VAE; - 根据画幅、百万像素和参考素材自动计算输出尺寸; - 读取首帧、尾帧、参考图片、参考视频和参考音频; - 根据素材组合生成 T2VA、I2VA、L2VA、FL2VA、Ref2VA 或 Hybrid 条件; - 所有输出汇集成一条管道,交给配套适配器分流,界面更简洁。 前端支持拖放/上传图片、视频和音频;首尾帧模式与全能参考模式可以分别保存提示词和素材状态,切换模式不会丢失另一模式的内容。 主节点默认画幅为“自适应”,会优先根据当前模式下第一个有效视觉素材的宽高比计算目标画布;没有视觉素材时使用 16:9。用户也可以手动选择常用固定比例和目标百万像素。 素材区还支持: - 将本地图片、视频或音频直接拖入对应上传区域; - 在素材上传区域或已有素材卡片上粘贴剪贴板图片,不会同时触发 ComfyUI 的全局“粘贴节点”操作; - 视频和音频卡片内直接播放预览,视频静音、音频裁剪等按钮仅在鼠标悬停素材时显示; - 素材、提示词、模式、音频裁剪范围、静音状态、驱动音频和优化器配置均随工作流保存。 ### `MiniMax-H3 适配器(GH)` 接收主节点的 `MiniMax` 输出,并拆分为下游工作流需要的端口: - 正面条件(`positive`); - AV 混合潜空间(`av_latent`,同时包含视频和音频潜空间); - 视频 VAE、音频 VAE; - 模型序号(自动切换大模型类型); - 混合音频、条件提示词、媒体映射 JSON 和执行报告。 适配器还会输出“原始音频”(内部端口名为 `mux_audio`),可连接到 `VHS_VideoCombine.audio`。 适配器输出的“原始音频”可直接连 `VHS_VideoCombine` 的音频输入,保证原始音质不变。 ## 工作模式 ### 首尾帧 / 文生视频 前端模式名为 `text_keyframes`,根据上传情况自动解析任务类型: | 输入 | 解析任务 | 标签格式 | | --- | --- | --- | | 无首尾帧 | T2VA | 无图片标签 | | 只有首帧 | I2VA | `` | | 只有尾帧 | L2VA | `` | | 首帧和尾帧 | FL2VA | `Picture 1`、`Picture 2`(不带尖括号) | | 首帧或尾帧 + `hybrid_audio` | Hybrid | ``,音频作为参考条件 | 首帧和尾帧素材点击后会自动将官方格式标签插入提示词。切换任务类型、上传或删除素材时,已有媒体标签也会自动统一为当前任务所需的带尖括号或不带尖括号格式。标签编号是否仍对应现有素材由“严格提示词标签”选项控制。 首尾帧模式中的 `hybrid_audio` 是专用参考音频。上传后默认将音频模式切换为“锁定源音频”,移除后恢复为“自动生成”;用户可以在高级选项中手动覆盖。 ### 全能参考 前端模式名为 `all_reference`,用于 Ref2VA/Hybrid 参考素材工作流,支持: - 最多 9 张参考图片; - 最多 3 个参考视频; - 最多 3 个独立参考音频; - 参考视频自带音轨(可在视频卡片右上角静音)。 全能参考模式会按视频音轨和独立音频的顺序生成音频序号,可在高级选项中选择驱动音频。参考媒体标签使用官方尖括号格式,例如 ``、`