Attention、人物 LoRA 与低显存路线补全 — MiniMax H3 教程
按需求补上更稳参数、Attention 后端、人物 LoRA 或低显存方案。
适用人群: 已经有基础工作流,想针对性能或角色一致性继续优化的用户。
硬件要求: NVIDIA;不同后端与量化组合需单独测试。
前置条件
- 稳定的原生基线
- 固定 seed、Prompt 与输入素材
执行步骤
- 先记录原生基线的速度、显存和质量。
- 每次只切换一个 Attention、LoRA 或量化变量。
- 保留对比结果,再决定是否进入正式工作流。
注意事项
- 原帖是路线总结;具体参数必须回到各项目最新 README 核验。
查看原始来源 · huangserva · 2026-08-23