sskj-h3

MiniMax-H3 在 RTX 6000D-H3 上的吞吐、稀疏/缓存加速、LoRA、成对 SSIM 和 VBench 可复现实验代码。

目录

  • throughput/common/:共享的统计与成对 SSIM 工具。
  • throughput/sglang-base/SGLang Base runner、配置和正式输入。
  • throughput/sglang-cache-dit/Cache-DiT runner 与参数配置。
  • throughput/sglang-lora/Larry LoRA runner、prompt、records 和兼容补丁。
  • throughput/sglang-profile/:性能分析脚本;采集结果不进入 Git。
  • throughput/vllm-omni-base/vLLM-Omni Base runner。
  • throughput/vllm-omni-fasth3/FastH3 适配与 runner。
  • vbench-score/VBench 生成、评分脚本和环境说明。

版本库边界

Git 只保存复现实验所需的代码、配置、输入清单和必要素材。以下内容只保留在运行服务器,不进入版本库:

  • 所有 results/outputs/ 和成对 SSIM 结果目录;
  • 视频生成结果、服务/客户端日志和运行时状态;
  • SQLite 数据库、Nsight/NCU/Torch Profiler 原始采集;
  • Python/Hugging Face 缓存、临时上传目录和外部源码 checkout。

已经进入历史提交的结果从当前 Git 索引中移除;服务器上的现有结果文件不会因此删除。

指标口径

吞吐和端到端时延由 runner 记录。成对 SSIM 使用相同 prompt、seed、任务、分辨率、时长和宽高比的 Base 视频作为参考VBench 独立评价主体一致性、运动、审美等质量维度。SSIM 与 VBench 互补,均不计入吞吐计时。

Description
No description provided
Readme 1.6 GiB
Languages
Python 54.8%
Shell 45.2%