跳到正文

0.6.12正式版

原生 H3 推理。
充分发挥你的显卡。

为 SM86 与 SM89 实测优化的 MiniMax H3 引擎。支持 Turbo 与 Base16 关键帧生成,可通过 Python、容器或 HTTP 接入。

SM86 / SM89Turbo4 / Turbo8 / Base16Apache 2.0

选择原生去噪配置RTX / CUDA
48GB显存容量
执行方式
单卡 · 常驻或分块
可用配置
Turbo4 / Turbo8 / Base16

支持文字、参考素材和首尾帧任务;完整 pipeline 按阶段复用同一张卡。

检查硬件,不加载权重
vflash plan ref2va-turbo4-exact-sm89 \ --gpu 0

当前公开版的输入与输出

Ref/T2 Turbo 保持五秒,Base16 与可选544p关键帧支持五至十秒。单SM89 Base16默认近似Sol;原始v0.1关键帧仅显式可选Sol,默认dense。各模式的成片证据单独列出,不宣称普遍画质等价。 了解运行前提

按你的任务开始

理解实现,按需扩展。

PyTorch 与 Triton 原生执行,独立实现 LoRA、显存调度和双卡 collective 布局。

阅读架构

Vflash · 原生 MiniMax H3 推理