# vLLM-Omni 多实例 Base 对应报告:[MiniMax-H3 在 RTX 6000D 上的 vLLM-Omni 多实例部署测试报告(20 steps / 5s)](https://gcn673xpgdxn.feishu.cn/docx/GYXwdRwOgoWuRsxrUKick2Ljn5s)。 ## 实验设计 - 框架/环境:vLLM-Omni,Conda 环境 `deploy`。 - 部署矩阵:1×8 卡、2×4 卡、4×2 卡,总计使用 8 张卡。 - 任务:FL2VA、Ref2VA。 - 分辨率:480、720、768、1080;每任务每档 8 条,总量 32 条。 - 固定生成规格:20 inference steps、5 秒、24 FPS、16:9、lossless MP4。 - 各实例接收相同分辨率比例;不同实例并行、实例内串行。 ## 归档内容 - `scripts/run_vllm_omni_h3_matrix_6000d.sh`:多实例服务和矩阵编排。 - `scripts/minimax_h3_vllm_bench.py`:multipart 请求、MP4 校验和汇总。 - `results/vllm-balanced64-20steps-5s-r2-20260822-225317`:192/192 成功的正式结果。 结果用于整机容量和端到端速度比较,不替代同 seed 的视频效果评分。原始源路径见根目录 `SOURCE_MAP.tsv`。