一键启动 MiniMax H3 中文可视化工作台,无需本地显卡。集成文生视频、图生视频、全能参考视频、三款 Turbo LoRA、、独立超分、拖拽上传,开箱即用。支持批量生成以及上传视频的独立超分。
NeoVista MiniMax H3 Studio|社区镜像完整使用教程
一键启动的中文可视化 MiniMax H3 视频工作台。支持文生视频、首帧/首尾帧图生视频、全能参考、三款 H3 Turbo LoRA、逐行素材配对批量、FlashVSR 高清放大、GIMM-VFI 帧率提升、任务进度、GPU/显存监控及完整结果参数记录。
本文档对应社区镜像 v1.3.5。不同版本的界面与功能可能略有差异,请以实例页面显示的镜像版本为准。
01、02、03…文件名前缀为不同任务归组;本镜像把 MiniMax H3、ComfyUI、中文 React WebUI、FastAPI 后端、三款适配 H3 的 Turbo LoRA、FlashVSR 超分和 GIMM-VFI 帧率提升工作流整理在同一个云端工作台中。创建实例后无需手动搭建节点,也不需要在本地电脑安装 Python、CUDA 或 ComfyUI。
主要功能:
01、02、03… 文件名前缀归组;本镜像在租用的 GPU 实例内完成推理,不调用 MiniMax 按次收费的视频生成 API。用户仍需承担优云智算实例、系统盘或其他平台资源产生的费用。
适合:
不适合:
768 × 1344 或旋转方向,并非原生 2K;生成速度和可用上限会受到 GPU 型号、显存、系统内存、分辨率、时长、参考素材数量、采样步数和超分设置共同影响。
| 使用目标 | GPU 显存建议 | 系统内存建议 | 建议起步参数 |
|---|---|---|---|
| 快速试用 | 24GB 属于实验配置 | 建议 96GB 或以上 | 480p/544p、2~5 秒、4 步、暂不超分 |
| 日常稳定使用 | 32GB 或以上 | 64GB 或以上 | 768p、5~10 秒、8 步 |
| 全能参考/长视频/高质量 | 32GB~48GB 或以上 | 94GB 或以上更稳 | 先用短时长验证,再逐步增加 |
| 20 步并接高质量超分 | 48GB 或以上更从容 | 94GB 或以上更稳 | 先生成,再单独执行 2× 超分 |
注意:
7860;本镜像只需要把 7860 作为 WebUI 外部入口。内部 ComfyUI 使用 127.0.0.1:8188,无需也不建议开放到公网。
实例第一次启动时需要初始化运行目录并启动 ComfyUI 和 WebUI。通常先等待 1~3 分钟,模型盘或机器初始化较慢时可能需要更久。
如果刚创建实例就看到 502 Bad Gateway / 服务未启动,不要反复新建实例,先等待几分钟后刷新。
回到实例卡片,点击平台显示的 SD-WebUI / WebUI 入口即可进入。当前版本不再设置额外的浏览器 Basic Auth,因此不会再要求输入镜像自己的用户名和密码。
进入页面后,先查看右侧或页面下方的部署状态:
页面分成两个主要区域:
用于选择生成模式、逐行填写提示词、上传素材、设置画幅、时长、质量、LoRA、Seed,以及生成后自动 FlashVSR/GIMM-VFI。图生视频素材按上传列表顺序配对,无需改名;批量全能参考素材才需要任务编号。
用于查看:
桌面宽屏下左右两栏各自滚动;移动端仍按从上到下的单列页面自然滚动。
适合只通过文字描述画面、运动和声音。
操作步骤:
-1 随机,或填写固定整数复现相近结果;提示词示例:
电影感写实画面,一名穿深色风衣的年轻女性站在雨夜街口,霓虹灯在湿润路面形成倒影。
镜头从中景缓慢推进到近景,人物自然抬头并看向镜头,头发和衣摆随风轻微摆动。
背景车辆缓慢驶过,远处传来雨声、轮胎压过积水的声音和低沉氛围音乐,全程一镜到底。
适合让静态图片产生运动,或控制视频开头和结尾的构图。
操作步骤:
素材规则:
提示词示例:
保持人物身份、服装和背景结构一致。人物先自然眨眼,随后缓慢转头看向窗外,表情平静。
镜头轻微向右环绕并缓慢靠近,光线随人物转身产生自然变化。背景只有轻微景深变化,不新增人物。
适合同时参考人物身份、服装、环境风格、动作、镜头节奏、声音或音乐。
操作步骤:
素材数量上限:
| 素材类型 | 数量上限 | 主要用途 |
|---|---|---|
| 参考图片 | 9 张 | 身份、服装、场景、物体、色彩和风格 |
| 参考视频 | 3 段 | 动作、镜头、表情、节奏,并自动读取视频原声作为参考 |
| 独立参考音频 | 3 段 | 人声、对白、音乐、节奏和环境声 |
全能参考模式至少需要一份有效素材,不能只写提示词而不上传参考文件。
“参考图处理尺寸”说明:
全能参考提示词示例:
参考图片保持人物面部身份、发型和黑色外套;参考视频只学习自然走路动作和手臂摆动节奏;
参考音频作为背景音乐节奏。人物从画面左侧走向镜头,经过暖色灯光区域后停下并抬头。
镜头使用稳定器低机位跟拍,不复制参考视频中的场景和其他人物。
建议在提示词中明确写出“哪份素材参考什么”,避免让模型同时继承彼此冲突的身份、动作和场景。
推荐按以下顺序组织:
主体与场景 → 主体动作 → 镜头运动 → 光线与风格 → 对白/声音/音乐 → 不希望出现的变化
可以重点描述:
避免:
选择画面比例和“原生清晰度”后,系统会自动填写实际宽高。宽高必须是 32 的倍数,且总像素不能超过 H3 原生画布上限。
| 画面比例 | 480p | 544p | 768p |
|---|---|---|---|
| 16:9 | 864×480 | 960×544 | 1344×768 |
| 4:3 | 640×480 | 736×544 | 1024×768 |
| 1:1 | 480×480 | 544×544 | 768×768 |
| 3:4 | 480×640 | 544×736 | 768×1024 |
| 9:16 | 480×864 | 544×960 | 768×1344 |
| 21:9 | 1024×448 | 1216×512 | 1344×576 |
常见选择:
“交换宽高”可以快速在横版和竖版之间切换。手动修改宽高时不要超过原生上限。
| 模式 | 文生/图生实际策略 | 全能参考实际策略 | 适用场景 |
|---|---|---|---|
| 超高质量 | 20 步基础模型,不加载 Turbo LoRA | 20 步基础模型 | 最终版本、复杂运动、质量优先 |
| 平衡 | FL2V 8 步 LoRA | 12 步 Ref2V 基础模型 | 日常正式生成,速度与质量均衡 |
| 极速 | FL2V 4 步 LoRA | Ref2V 4 步 LoRA | 快速预览、方向测试、批量探索 |
重要说明:全能参考目前没有对应的官方 8 步 LoRA,因此在全能参考模式选择“平衡”时,系统会自动使用 12 步基础模型,不是错误。
文件:
minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors
文件:
minimax_h3_fl2v_turbo_4step_v1.0_768p_comfyui_bf16.safetensors
文件:
minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors
日常建议保持 自动匹配(推荐)。系统会根据生成模式和质量选择兼容组合,并锁定 LoRA 对应的正确步数。
只有明确要对比 LoRA 时再使用手动选择:
Video shift:控制视频扩散采样过程中的时间/视觉信号偏移;Audio shift:控制音频扩散采样过程中的偏移;Video shift = 12,Audio shift = 3;-1:每次随机生成新的 Seed;Seed + 1。当前版本采用逐行提示词 + 素材自动配对,最多 10 条任务:
图生视频配对规则:
全能参考配对规则:
01_人物.jpg、01_动作.mp4、02_声音.wav;01 素材,第 2 行对应 02 素材,依次到第 10 行和 10 素材;本批所有任务仍共同使用画面比例、分辨率、时长、质量、LoRA、Shift 与自动增强设置。
Seed 规则:
-1:每个任务独立随机;+1。执行规则:
FlashVSR 有两种使用方式。
-1 或填写固定整数;历史视频和本地上传视频只能选择一个。如果已经选择历史视频,不要同时再上传本地文件。
支持常用视频格式,推荐 MP4;界面还接受 MOV、WebM 和 MKV。FlashVSR 处理画面帧后会尽量按原视频帧率并保留原音轨重新封装。
| 预设 | 特点 | 建议用途 |
|---|---|---|
| Tiny | 速度优先 | 短视频、快速查看效果 |
| Tiny-long | 长视频和低显存优先 | 32GB 显存、10 秒视频的日常推荐 |
| Full | 质量优先 | 显存和时间充足时的最终处理 |
建议流程:先关闭自动超分,用 4 步或 8 步筛选满意视频,再从历史结果执行独立 2× 超分。这样可以避免对不满意的试稿浪费 GPU 时间。
GIMM-VFI 同样有两种入口:
系统会读取源视频实际帧率。比如 24fps 选择 2× 后输出约 48fps,选择 4× 后输出约 96fps; 输出总时长不变,原音轨会保留。GIMM-VFI 改善的是运动时间采样与流畅度,不会把 768p 变为 2K, 也不能保证消除源视频已有的变形或运动错误。
可以在一个任务仍运行时继续提交新的生成、超分或帧率提升任务,但需要区分:
页面会显示:
点击 终止当前任务 会向 ComfyUI 发送中断请求。中断可能需要等当前节点响应,不一定在点击瞬间停止。
点击 清空等待队列 只移除尚未开始的任务,不会自动终止当前正在运行的任务。
停止任务不会自动删除已经生成完成的视频。
生成成功后:
记录内容包括:
这些元数据保存在输出视频旁边,WebUI 重启后仍可重新读取。旧版本生成、但没有元数据文件的视频仍可播放和下载,只是不会显示完整参数与耗时。
如果需要一次下载多条视频:
/workspace/minimax-h3-data/output
释放或删除实例前,务必确认所有需要保留的结果已经下载到本地。实例被回收后,临时系统盘数据可能无法恢复。
01~05 文件名前缀编号;先等待 1~3 分钟并刷新。如果仍然无法打开:
cd /workspace/minimax-h3-portable
./compshare/status.sh
需要手动重启时:
cd /workspace/minimax-h3-portable
./compshare/start.sh
查看日志:
tail -n 100 /workspace/minimax-h3-data/logs/comfyui.log
tail -n 100 /workspace/minimax-h3-data/logs/webui.log
如果日志显示缺少项目文件、Python 环境或模型,不要重复执行未知安装命令,请保留完整日志、镜像版本、地区和 GPU 型号后反馈。
7860;8188 当作外部 WebUI 端口。v1.3.5 或更高版本;./compshare/stop.sh 后再执行 ./compshare/start.sh;记录页面列出的完整文件名,并执行:
cd /workspace/minimax-h3-portable
./compshare/status.sh
如果是社区镜像本身缺少或未连接平台模型文件,应提交镜像版本、地区、GPU 型号和缺失文件列表,不要自行下载名称相近但版本不一致的权重覆盖。
按以下顺序降低压力:
不要在同一实例里另外启动一套 ComfyUI 占用显存。
find /workspace/minimax-h3-data/output -type f | tail -n 30
http://;以下命令均在 JupyterLab Terminal 中执行。
cd /workspace/minimax-h3-portable
./compshare/status.sh
cd /workspace/minimax-h3-portable
./compshare/start.sh
cd /workspace/minimax-h3-portable
./compshare/stop.sh
注意:停止脚本只停止实例中的应用服务,不等于关闭或释放云 GPU 实例。是否继续收费以优云智算控制台显示的实例状态和计费规则为准。
推荐使用流程:
请注意:
8188 端口到公网;不是。本镜像是 NeoVista 基于公开模型、公开节点和公开工作流制作的第三方部署与可视化工具,不代表 MiniMax 官方产品。
不会。模型在租用的 GPU 实例中本地推理,但实例本身会产生云算力费用。
H3 原生画布最高为 768×1344 或旋转方向。可以使用 FlashVSR 放大到更高像素尺寸,但那是后处理超分,不是 H3 原生 2K。
不一定。20 步通常更偏向质量和稳定性,但提升幅度取决于镜头、提示词和素材。建议先用 8 步筛选,再对重要镜头用 20 步对比。
不建议。Turbo LoRA 应使用其训练对应的步数。本界面在自动或手动选择 LoRA 时会锁定正确步数。20 步模式直接使用基础模型。
可以。既能从历史结果直接选择,也能上传本地 MP4、MOV、WebM 或 MKV。
可以同时提交,但单 GPU 依次执行,不会同时占用显存推理。
支持。当前版本最多填写 10 行完整提示词,并通过 01、02、03… 文件名前缀为每个任务分别绑定最多 9 图、3 视频和 3 音频。
不是。FlashVSR 增加宽高像素,GIMM-VFI 在相邻画面之间生成中间帧。二者可以分别使用,也可以在生成后依次执行。
旧版本生成的视频可能没有旁路元数据文件。新版本生成的结果会自动记录并在重启后恢复。
使用前必须阅读并遵守 MiniMax H3 Community License、Acceptable Use Policy、适用地域限制以及所在地法律法规。只有在许可允许的地区和场景中才能部署或使用模型。
MiniMax H3 is licensed under the MiniMax H3 Community License Agreement, Copyright © 2026 MiniMax. All Rights Reserved.
生成速度、显存占用、音画表现和最终效果会随硬件、驱动、分辨率、时长、提示词、参考素材和随机 Seed 变化。本文档提供的是功能说明与推荐起点,不承诺所有实例获得完全相同的速度或结果。
遇到问题时,请一并提供:镜像版本、实例地区、GPU 型号、显存、系统内存、所选模式、分辨率、时长、步数、是否启用超分,以及相关日志末尾内容。请先删除私人素材名称后再公开。




