sskj/.gitignore
shishi cd7b2d4a62 docs(datasets): add README with ShareGPT download instructions
The datasets/ directory is gitignored (large, re-downloadable), but later
agents need to know how to obtain the dataset when it is missing. Add a
tracked README that documents the download steps.

- datasets/README.md: documents the ShareGPT_V3_unfiltered_cleaned_split.json
  source (HF anon8231489123/ShareGPT_Vicuna_unfiltered), the hf-mirror.com
  download command for CN environments, the JSON validity check (94145
  entries), and the container path consistency note.
- .gitignore: change "datasets/" to "datasets/*" so the "!datasets/README.md"
  negation actually works (git cannot re-include a file under a fully-ignored
  directory). The dataset .json stays ignored; only README.md is tracked.
2026-07-28 17:02:19 +08:00

93 lines
2.4 KiB
Plaintext
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 环境/依赖/临时文件
# envs/ 目录下的虚拟环境子目录(具体环境文件不提交,但文档保留)
envs/modelscope-hub/
envs/modelscope-upload/
envs/sglang/
envs/sglang-src/
envs/vllm/
envs/charts/
# 其他一次性工具环境/临时产物
.venv-charts/
.tmp_charts/
# 其他通用忽略
deps/
tmp/
*.pid
__pycache__/
*.pyc
*.pyo
*.egg-info/
# 大文件/压缩包
*.zip
*.tar.gz
*.tar.bz2
# 中间日志
logs/
*.log
*.csv
# 数据集(可重新下载,但保留下载说明文档入库)
# 用 datasets/* 而非 datasets/,否则 !datasets/README.md 例外无法生效
datasets/*
!datasets/README.md
# 原始请求级输出与中间产物不入库:只提交 adaptive_results 下的汇总级文件
# adaptive_points.jsonl / adaptive_shapes.jsonl / adaptive_summary.* / run_manifest.json / shapes.tsv
# tp*_dp*/ 子目录raw_outputs、metrics、logs、gpu_logs、server_cmd.txt一律忽略。
experiments/*/*/adaptive_results/*/tp*_dp*/
# 实验级原始结果目录:保留 report.md / results.json / raw_outputs忽略日志
experiments/*/results/*/logs/
experiments/*/results/*/*/logs/
experiments/*/results/*/*.tsv
experiments/*/results/*/*/*.tsv
# 运行时目录pid 文件、缓存、临时文件)
experiments/**/runtime/
# 无关项目
loomeval_yy/
.gitignore
dsv4_dspark_h20_sglang_tp_dp_matrix
dsv4_h20_sglang_tp_dp_matrix
glm_old_h20_vllm_tp_dp_matrix
# === 仓库瘦身规范2026-07===
# 约定:实验目录只提交 代码(config.env/*.sh/*.py) + report.md + results.json(小体量汇总)。
# 不提交:逐请求原始日志(raw_outputs)、JIT/算子缓存、编译产物、一次性 bench 输出。
# 历史中 raw_outputs/*.jsonl 是仓库膨胀主因(~1.3GB);本规范从源头不再入库。
# results.json 须保持小体量,禁止嵌入 raw_requests否则单独走 raw_outputs
# 编译产物(每次构建重新生成)
*.o
*.so
*.ninja
*.ninja_deps
*.ninja_log
*.cubin
build/
# JIT / 算子缓存(每次跑重新生成)
sglang_sm120_cache/
vllm_sm120_cache/
*_sm120_cache/
# 一次性 bench 输出
bench-output/
# 逐请求原始日志(体积大;汇总见 results.json / report.md
experiments/**/raw_outputs/
**/dummy_sharegpt.json
# Virtual environments (keep only docs under envs/)
envs/*
!envs/README.md
!envs/SM120_DSV4_DEPLOYMENT_GUIDE.md
!envs/ASCEND_910C_ENV_SETUP.md
!envs/UV_ENV_SETUP.md
# Tooling artifacts
skills-lock.json