sskj-h3/throughput

Throughput

MiniMax-H3 在 RTX 6000D-H3 上的 SGLang、Larry LoRA、vLLM-Omni 吞吐实验和性能 Profile。

吞吐与 SSIM 严格分阶段执行:客户端完成并写出吞吐结果后先停止服务,再运行 common/paired_video_ssim.py。因此启用 SSIM 不改变请求参数、并发方式、计时窗口或吞吐汇总。

SSIM 需要一个同拓扑、同任务的 base run 作为 SSIM_REFERENCE_ROOT。未设置时 runner 与原吞吐逻辑一致,不执行质量评分。