MiniMax-H3 Turbo LoRA 显存优化:低显存显卡 4 步出片的完整配置 📅 发布时间:2026/8/28 9:04:53 👁 浏览次数: MiniMax-H3 Turbo LoRA 显存优化低显存显卡 4 步出片的完整配置【免费下载链接】MiniMax-H3-Turbo-Lora项目地址: https://ai.gitcode.com/hf_mirrors/larryvrh/MiniMax-H3-Turbo-LoraMiniMax-H3 Turbo LoRA 是一个轻量级 LoRA低秩适配权重直接叠加在基础模型上做微调只跑 4 个采样步就能同时输出视频和同步的立体声音轨比常规的约 20 步快约 5 倍。问题在于基础模型约 33B显存是第一个卡住你的瓶颈。本文把推荐参数做成一张表再给出两个省显存开关让你在有限显存下把 4–8 步出片跑稳。参数速查表⚡ 先照抄这张表跑一遍想微调再往下看。参数推荐值一句话原因采样步数4下限4–8 可用6–8 步明显比 4 步干净超过 8 无收益还可能过锐强度1.0专为 4–8 步区间调好的默认别动宽 × 高32 的倍数短边 768如 1344×768对齐模型画布网格超范围会报错帧数124–36224fps约 5–15 秒实测安全区间124 帧约 5 秒检查点minimax_h3_turbo_v4_step600_ema.safetensors目前发布里最强例外情况见下一节 这张表照抄就能跑通只有具体片段出问题才去动强度和检查点。检查点怎么选绝大多数场景用minimax_h3_turbo_v4_step600_ema.safetensors。名字里的 EMA 是权重的指数滑动平均文件更平滑稳定。它是发布以来最强的检查点静态镜头和小运动更稳面部、手指、精细纹理这些微细节明显更好早期 v1约 850 那批的过锐、塑料感也已经修干净。只有一种情况建议换人你只有 4 步、画面又充斥快速大动作——v4 在这个角落容易运动拖影此时minimax_h3_turbo_4step_ema_ckpt850.safetensors更友好。其余场景没必要回头切它。先按 4 步跑再决定加不加步数和强度一起处理。先用默认组合4 步 强度 1.0这是模型的出厂调校。显存富余就直接加到 6–8 步画面明显更好这也是这套 LoRA 的有效区间。别超过 8 步收益归零还会开始出现过度锐化的伪影。画面发糊、有拖影把强度微升到 1.05–1.2只针对出问题的这一条片子。颗粒感重、细节过锐把强度微降到 0.8–0.95同样只救单条问题片。画面正常就保持 1.0别为了调而调。两个省显存开关ComfyUIlow_vram默认保持关闭LoRA 在运行时挂上出图最清晰这也是推荐项。开启后 LoRA 被直接并进基础模型权重峰值显存压到最低代价是在量化位宽压缩底子上画面稍软。真的爆显存了再开。顺带一提节点会自动识别裁剪过的底模并在跑的时候把时间调节时间步到各层条件的映射重新补回去所以一个 LoRA 文件能覆盖所有基础模型不必来回换底模吃显存。Standalone--offload-adaln不走 ComfyUI、直接跑generate.py的话用这个参数。它把时间步投影权重留在 CPU 的 fp32 里offload即把权重挪出 GPU省下约 13GB 显存。代价是一小部分矩阵乘法挪到 CPU 做4 步时这点开销可以忽略。python generate.py \ --comfyui ./ComfyUI \ --base models/diffusion_models/minimax_h3_fl2va_bf16.safetensors \ --lora minimax_h3_turbo_v4_step600_ema.safetensors \ --te models/text_encoders/qwen3vl_32b_minimax_h3_int8_convrot.safetensors \ --video-vae models/vae/minimax_h3_video_vae_fp16.safetensors \ --audio-vae models/vae/minimax_h3_audio_vae_fp32.safetensors \ --prompt A corgi in a chef hat flipping a pancake, sizzling sounds and a cheerful bark. \ --width 1344 --height 768 --frames 124 --steps 6 --out corgi.mp4 \ --offload-adaln # 省约13GB显存投影权重留在CPU的fp32关键参数逐行说明--lora装省显存主力检查点--width/--height取 32 的倍数、短边 768--frames 124在 24fps 下约 5 秒已落在 17·k5 网格--steps 6比 4 步更好看--offload-adaln是本节的主角。分辨率和时长别一次拉满显存大户就是分辨率和时长。安全区间宽和高都是 32 的倍数短边一般取 76824fps 下帧数落在 17·k5 网格上124 帧约 5 秒实测可用的范围约 124–362 帧5–15 秒。 按先低后高试跑先用 768 短边 124 帧验证提示词和画面没问题再逐步加时长、加分辨率每升一级看一眼显存峰值。显存不够时优先级是先降分辨率和时长再打开low_vram与--offload-adaln。参数全是为画面服务的别为了凑参数丢画面。【免费下载链接】MiniMax-H3-Turbo-Lora项目地址: https://ai.gitcode.com/hf_mirrors/larryvrh/MiniMax-H3-Turbo-Lora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考