1.0 KiB
1.0 KiB
vLLM-Omni 多实例 Base
对应报告:MiniMax-H3 在 RTX 6000D 上的 vLLM-Omni 多实例部署测试报告(20 steps / 5s)。
实验设计
- 框架/环境:vLLM-Omni,Conda 环境
deploy。 - 部署矩阵:1×8 卡、2×4 卡、4×2 卡,总计使用 8 张卡。
- 任务:FL2VA、Ref2VA。
- 分辨率:480、720、768、1080;每任务每档 8 条,总量 32 条。
- 固定生成规格:20 inference steps、5 秒、24 FPS、16:9、lossless MP4。
- 各实例接收相同分辨率比例;不同实例并行、实例内串行。
归档内容
scripts/run_vllm_omni_h3_matrix_6000d.sh:多实例服务和矩阵编排。scripts/minimax_h3_vllm_bench.py:multipart 请求、MP4 校验和汇总。results/vllm-balanced64-20steps-5s-r2-20260822-225317:192/192 成功的正式结果。
结果用于整机容量和端到端速度比较,不替代同 seed 的视频效果评分。原始源路径见根目录 SOURCE_MAP.tsv。