# Experiment-level configuration for dsv4_h200_vllm # All values can be overridden via environment variables. EXPERIMENT="${EXPERIMENT:-dsv4_h200_vllm}" MODEL_NAME="${MODEL_NAME:-DeepSeek-V4-Flash}" MODEL_PATH="${MODEL_PATH:-/data/models/DeepSeek-V4-Flash}" SERVED_MODEL_NAME="${SERVED_MODEL_NAME:-deepseek-v4-flash}" PORT="${PORT:-30005}" # This experiment is a plain vLLM baseline. These values override the # vllm-dspark defaults coming from platforms/nvidia_h200.env. BACKEND="vllm" ENGINE="vllm" # Native virtual environments on the host. VENV_SERVER="${VENV_SERVER:-/data/user1/yy/envs/vllm}" VENV_CLIENT="${VENV_CLIENT:-/data/user1/yy/envs/sglang}" # Benchmark scenarios: each element is "concurrency input_len output_len num_prompts". # Following docs/EXPERIMENT_GUIDE.md: num_prompts = concurrency * 5. # Override via SCENARIOS env var as a bash array, e.g.: # SCENARIOS=("32 512 256 160" "128 512 256 640") if [[ -z "${SCENARIOS:-}" ]]; then SCENARIOS=( "32 512 256 160" "128 512 256 640" "32 4000 512 160" ) fi # Legacy fallback: used only if SCENARIOS entries have 3 fields. NUM_PROMPTS="${NUM_PROMPTS:-160}" # Server start script bundled with this experiment. SERVER_START_SCRIPT="${SCRIPT_DIR}/start_server.sh"