sskj/.gitignore
shishi 6ba04325d3 feat(910c): 部署解耦 - vLLM-Ascend profile 与 deploy 层接管服务启停
- deploy/profiles/910c/ 新增 dsv4/glm52 两个 vLLM-Ascend profile
  (JSON 参数经 BOOTSTRAP base64 注入避开镜像 entrypoint 转义;per-TP 参数
  由 start 脚本导出后经 profile 模板展开)
- dsv4/glm52 start_vllm_docker.sh 改为 deploy 薄包装(保留 sg docker 重入与
  per-TP 覆盖),新增 stop_vllm_docker.sh
- run_bench.sh / run_adaptive_concurrency*.sh 的 stop/build_server_args 改走
  deploy_stop/deploy_render_args
- runtime.py 修复单节点 dry-run 未跳过健康检查的 bug
- ops/README.md 补 910c 章节;.gitignore 补 910c ops_ 输出规则
- 附带入库 910c adaptive 汇总结果
2026-08-03 15:36:11 +08:00

110 lines
2.7 KiB
Plaintext
Raw Permalink Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 环境/依赖/临时文件
# envs/ 目录下的虚拟环境子目录(具体环境文件不提交,但文档保留)
envs/modelscope-hub/
envs/modelscope-upload/
envs/sglang/
envs/sglang-src/
envs/vllm/
envs/charts/
# 其他一次性工具环境/临时产物
.venv-charts/
.tmp_charts/
# 其他通用忽略
deps/
tmp/
*.pid
__pycache__/
*.pyc
*.pyo
*.egg-info/
# 大文件/压缩包
*.zip
*.tar.gz
*.tar.bz2
# 中间日志
logs/
*.log
*.csv
# 数据集(可重新下载,但保留下载说明文档入库)
# 用 datasets/* 而非 datasets/,否则 !datasets/README.md 例外无法生效
datasets/*
!datasets/README.md
# 原始请求级输出与中间产物不入库:只提交 adaptive_results 下的汇总级文件
# adaptive_points.jsonl / adaptive_shapes.jsonl / adaptive_summary.* / run_manifest.json / shapes.tsv
# tp*_dp*/ 子目录raw_outputs、metrics、logs、gpu_logs、server_cmd.txt一律忽略。
experiments/*/*/adaptive_results/*/tp*_dp*/
# 实验级原始结果目录:保留 report.md / results.json / raw_outputs忽略日志
experiments/*/results/*/logs/
experiments/*/results/*/*/logs/
experiments/*/results/*/*.tsv
experiments/*/results/*/*/*.tsv
# 运行时目录pid 文件、缓存、临时文件)
experiments/**/runtime/
# 无关项目
loomeval_yy/
# 部署层运行时产物
deploy/logs/
.gitignore
dsv4_dspark_h20_sglang_tp_dp_matrix
dsv4_h20_sglang_tp_dp_matrix
glm_old_h20_vllm_tp_dp_matrix
# === 仓库瘦身规范2026-07===
# 约定:实验目录只提交 代码(config.env/*.sh/*.py) + report.md + results.json(小体量汇总)。
# 不提交:逐请求原始日志(raw_outputs)、JIT/算子缓存、编译产物、一次性 bench 输出。
# 历史中 raw_outputs/*.jsonl 是仓库膨胀主因(~1.3GB);本规范从源头不再入库。
# results.json 须保持小体量,禁止嵌入 raw_requests否则单独走 raw_outputs
# 编译产物(每次构建重新生成)
*.o
*.so
*.ninja
*.ninja_deps
*.ninja_log
*.cubin
build/
# JIT / 算子缓存(每次跑重新生成)
sglang_sm120_cache/
vllm_sm120_cache/
*_sm120_cache/
sglang_nightly_cu13_cache/
# 一次性 bench 输出
bench-output/
# 单数 dataset/(可重新下载,与 datasets/ 同源)
dataset/
# 逐请求原始日志(体积大;汇总见 results.json / report.md
experiments/**/raw_outputs/
**/dummy_sharegpt.json
# 统一 bench CLI 的一次性测试输出ops_ 前缀 run_id
experiments/pro6000/*/results/ops_*/
experiments/910c/*/results/ops_*/
# Virtual environments (keep only docs under envs/)
envs/*
!envs/README.md
!envs/SM120_DSV4_DEPLOYMENT_GUIDE.md
!envs/ASCEND_910C_ENV_SETUP.md
!envs/UV_ENV_SETUP.md
# Tooling artifacts
skills-lock.json
# 临时备份文件
*.bak.glm52orig
*.bak
*.bak.*
*.tmp