DasiwaMinimaxH3_dasiwaREF2VAHybridV1
UpdateSep 16, 2026 16:49PublishedSep 04, 2026 11:48
30
0
0
DasiwaMinimaxH3_dasiwaREF2VAHybridV1 - 1
Avatar
Lorena
Type
UNet
Basic Model
MiniMax H3
Published time
Sep 04, 2026 11:48
File Signature
3a4875d89570f002debf47ca427aa690a52600935816448c48c0267bc7387bfb
DasiwaMinimaxH3_dasiwaREF2VAHybridV1.safetensors
19.53 GB

DaSiWa MiniMax H3 REF2VA Hybrid V1

DaSiWa MiniMax H3 REF2VA Hybrid V1 是基于 MiniMax H3(Hailuo 3.0) 制作的 Hybrid 音视频生成模型,对应 Darksidewalker / DaSiWa 发布的 DaSiWa MiniMax H3 Hybrid v1 — “The Gate of Possibility” 系列。

该版本将 MiniMax H3 官方 FL2VA + REF2VA checkpoint 进行 Hybrid 合并,以 FL2VA 权重作为基础,并融合 REF2VA 的参考条件能力,再通过 INT8 Row-wise ConvRot 进行量化。

与 Turbo 版本不同,本版本属于 Non-Distilled / 非蒸馏版本,主要使用 20–25 Steps 进行生成,更偏向完整保留 MiniMax H3 原始生成能力与 Hybrid 多模式支持。

主要能力

模型基于 MiniMax H3 的 omni-modal video + audio diffusion 架构,可以同时处理视频画面与音频生成。

支持包括:

  • T2VA — 文本生成视频 + 音频
  • I2VA — 图片生成视频 + 音频
  • FLF2VA — 首末帧控制视频生成
  • REF2VA — 参考图 / 角色参考视频生成
  • Synchronized Audio — 与视频同步生成对白、环境音及其他声音内容

Hybrid V1 将 FL2VA 与 REF2VA 能力整合到同一模型中,因此可以根据 Workflow 切换不同的视频控制模式,而无需针对每一种任务单独更换大型 checkpoint。

REF2VA Hybrid

该版本采用 MiniMax H3 官方 FL2VA checkpoint 作为基础,并融合 REF2VA 条件结构。

DaSiWa Hybrid V1 默认配方主要覆盖 REF2VA 的:

blocks 25–49 adaln_proj

从而在保留 FL2VA 基础能力的同时加入 Reference Conditioning 能力。

模型经过 pruning 后包含 932 个 tensor keys,并采用 DaSiWa Quant Station 的 INT8 Row-wise ConvRot 方案进行处理,使完整模型体积保持在约 19.53 GiB

推荐采样设置

本模型属于 Non-Distilled 版本,不应直接套用 4-Step / 8-Step Turbo 模型的低步数设置。

作者针对 Non-Distilled Hybrid 版本推荐:

Option A

Sampler: res_multistep
Scheduler: simple

Option B

Sampler: euler
Scheduler: simple

推荐 Steps:

20–25

推荐 Video Shift:

10–12

推荐 Audio Shift:

3–5

可以根据具体视频长度、分辨率、Prompt 和生成模式在该范围内进一步调整。

Trigger Words

不需要 Trigger Words。

这是完整的 MiniMax H3 base diffusion model / checkpoint,而不是 LoRA。

Civitai 官方版本的 trainedWords 同样为空,因此直接通过 Prompt 控制视频内容即可。

Strength

不适用。

该模型作为 Base UNet 通过 UNETLoader 直接加载,没有 LoRA Strength 参数。

如有需要,可以在该模型之上继续加载与 MiniMax H3 兼容的 Motion、Combat、Style 或其他功能型 LoRA。

模型加载

ComfyUI 中通常将模型放入:

ComfyUI/models/diffusion_models/

并使用:

UNETLoader

进行加载。

完整生成还需要对应的 MiniMax H3 Text Encoder / CLIP、Video VAE、Audio VAE 及相关 H3 节点。

建议使用与 MiniMax H3 Hybrid 模型兼容的完整 Workflow。

使用提示

本版本属于 Hybrid V1 非 Turbo / 非蒸馏版本

如果追求更低 Steps 和更快生成速度,可以选择对应的 DaSiWa 4Turbo / 8Turbo 版本;如果使用当前版本,则建议优先按照 Non-Distilled 的 20–25 Steps 参数进行测试。

使用前建议:

  • 更新 ComfyUI 至兼容 MiniMax H3 的版本
  • 更新相关 custom_nodes
  • 检查 diffusion model / text encoder / VAE 路径
  • 使用 MiniMax H3 对应的完整视频 + 音频 Workflow
  • 根据 T2VA / I2VA / FLF2VA / REF2VA 模式正确配置输入条件

模型信息

Model: DaSiWa MiniMax H3 REF2VA Hybrid V1
Series: The Gate of Possibility / Hybrid v1
Base Model: MiniMax H3 / Hailuo 3.0
Architecture: MiniMax H3
Type: Hybrid Diffusion Model / Checkpoint
Hybrid: FL2VA + REF2VA
Quantization: INT8 Row-wise ConvRot
Distilled: No
Recommended Steps: 20–25
Trigger Words: None
Strength: N/A
Model Size: ≈19.53 GiB
License: MiniMax H3 Community License Agreement

原作者与官方来源

DaSiWa / Darksidewalker

该模型对应 Darksidewalker 发布的 DaSiWa MiniMax H3 Hybrid 系列。

Civitai 官方模型:

https://civitai.com/models/2877206

Darksidewalker Civitai:

https://civitai.com/user/Darksidewalker

DaSiWa Quant Station:

https://github.com/darksidewalker/dasiwa-quant-station

MiniMax H3 官方实现:

https://github.com/MiniMax-AI/MiniMax-H3

当前文件来源说明

当前文件:

DasiwaMinimaxH3_dasiwaREF2VAHybridV1.safetensors

可确认对应 DaSiWa MiniMax H3 Hybrid v1 / REF2VA-FL2VA Hybrid 配方,并由 DaSiWa Quant Station 生成。

该文件来自社区网盘流通版本,目前未找到与其 SHA256 完全一致的公开下载地址。

Civitai 官方发布的 Hybrid v1 与当前文件属于同一模型版本与合并方案,但公开文件经过不同次构建 / 打包,其 SHA256 与当前文件不同。

DaSiWa Quant Station 会为不同构建写入独立的 provenance watermark,因此即使使用相同模型配方重新构建,最终 safetensors 文件的整体 SHA256 也可能不同。

因此这里将 Civitai 的 DaSiWa MiniMax H3 Hybrid v1 作为该模型的官方版本来源,但不将其描述为当前文件的 SHA256 完全一致下载镜像。

Gallery

No creation yet