Per-benchmark Excel: each <bench>/<bench>.xlsx (4 sheets) alongside report.jsonl
Co-Authored-By: Claude <noreply@anthropic.com>
This commit is contained in:
parent
f118f4092b
commit
52872bcbc7
@ -690,6 +690,14 @@ def _cmd_eval_run(args) -> int:
|
||||
bench_dir = _P(out_dir) / name
|
||||
bench_dir.mkdir(parents=True, exist_ok=True)
|
||||
report.save(str(bench_dir / 'report.jsonl'))
|
||||
# per-benchmark Excel (Summary/Perf/Categories/Samples sheets)
|
||||
try:
|
||||
from evalharness.viz import render as _r2
|
||||
|
||||
_r2([report], style='excel',
|
||||
out=str(bench_dir / f'{name}.xlsx'))
|
||||
except Exception:
|
||||
pass # excel is a nice-to-have, never block the run
|
||||
if args.verbose:
|
||||
if not _print_result_panel(console, report, _time.time() - t0):
|
||||
print(render(report, style=args.style))
|
||||
|
||||
Loading…
x
Reference in New Issue
Block a user