MiniMax H3 在 RTX 5090 上的速度与成本:5 秒视频约 46–60 秒
RTX 5090 32GB 运行 MiniMax H3 Turbo 时,带正常音频的 5 秒 0.7MP 视频耗时约 46–60 秒;按 0.508 美元/小时折算,每条约 0.006–0.008 美元。测试同时覆盖步数、量化、SageAttention、分辨率、时长和冷启动。
这个主题下共有 5 篇文章。
RTX 5090 32GB 运行 MiniMax H3 Turbo 时,带正常音频的 5 秒 0.7MP 视频耗时约 46–60 秒;按 0.508 美元/小时折算,每条约 0.006–0.008 美元。测试同时覆盖步数、量化、SageAttention、分辨率、时长和冷启动。
ComfyUI v0.33.1 在 PyTorch 2.6 下导入 comfy-kitchen 时,因 list[int] 无法被 torch.library.custom_op 推断为算子 schema 而启动失败。CPU 对照确认 PyTorch 2.8 修复解析,CUDA 12.8 镜像随后通过 GPU 启动与出图验证。
MiniMax H3 Turbo 在 4 步和 8 步采样时出现爆音、杂音与音色偏移,原因是旧版采样器用同一条 sigma 进度推进视频和音频。升级 ComfyUI 或使用双时钟 Euler 后,两个低步数档位的音频均恢复正常。
MiniMax H3 的视频与音频共用 NestedTensor,通用潜空间放大和加噪节点会触发类型错误或破坏二次采样。本文给出音视频拆分、独立加噪、条件同步放大方案,并比较 1080p 与 2K 的 RTX 5090 实测成本。
魔搭 GPU 实例只有出站网络、不接受入站连接,Cloudflare Tunnel、Tailscale、localtunnel 三类穿透方案实测均不可用。改用 SSH 原生反向端口转发经中转主机接入,并给出可直接落地的启动脚本与两个静默失败的根因。