Skip to content

Commit 9000fa1

Browse files
authored
[CI] modify weekly cases:dsv4,dsv3.2-EP,GLM5.yaml (vllm-project#13044)
### What this PR does / why we need it? we modify weekly cases:dsv4,dsv3.2-EP,GLM5.yaml ### Does this PR introduce _any_ user-facing change? no ### How was this patch tested? run the cases weekly - vLLM version: v0.25.1 - vLLM main: vllm-project/vllm@fe784ff --------- Signed-off-by: guxin108 <1252896542@qq.com>
1 parent 0838ce8 commit 9000fa1

4 files changed

Lines changed: 7 additions & 10 deletions

File tree

tests/e2e/weekly/multi_node/external_dp/config/DeepSeek-V4-flash-w8a8-PD.yaml

Lines changed: 4 additions & 4 deletions
Original file line numberDiff line numberDiff line change
@@ -76,7 +76,7 @@ templates:
7676
- "16"
7777
- --no-disable-hybrid-kv-cache-manager
7878
- --model-loader-extra-config
79-
- '{"enable_multithread_load": "true", "num_threads": 128}'
79+
- '{"enable_multithread_load": true, "num_threads": 128}'
8080
- --safetensors-load-strategy
8181
- "prefetch"
8282
- --speculative-config
@@ -97,7 +97,7 @@ templates:
9797
- "ascend"
9898
- --enforce-eager
9999
- --additional-config
100-
- '{"enable_cpu_binding": "True", "enable_shared_expert_dp": true, "enable_dsa_cp": true}'
100+
- '{"enable_cpu_binding": true, "enable_shared_expert_dp": true, "enable_dsa_cp": true}'
101101
- --kv-transfer-config
102102
- '{"kv_connector": "MooncakeHybridConnector",
103103
"kv_role": "kv_producer",
@@ -151,7 +151,7 @@ templates:
151151
- --safetensors-load-strategy
152152
- "prefetch"
153153
- --model-loader-extra-config
154-
- '{"enable_multithread_load": "true", "num_threads": 128}'
154+
- '{"enable_multithread_load": true, "num_threads": 128}'
155155
- --trust-remote-code
156156
- --tokenizer-mode
157157
- "deepseek_v4"
@@ -169,7 +169,7 @@ templates:
169169
- --compilation-config
170170
- '{"cudagraph_mode": "FULL_DECODE_ONLY"}'
171171
- --additional-config
172-
- '{"ascend_compilation_config":{"enable_npugraph_ex":true,"enable_static_kernel":false},"enable_cpu_binding":true,"multistream_overlap_shared_expert":true,"recompute_scheduler_enable":true}'
172+
- '{"ascend_compilation_config":{"enable_npugraph_ex": true,"enable_static_kernel":false},"enable_cpu_binding":true,"multistream_overlap_shared_expert":true,"recompute_scheduler_enable":true}'
173173
- --kv-transfer-config
174174
- '{"kv_connector": "MooncakeHybridConnector",
175175
"kv_role": "kv_consumer",

tests/e2e/weekly/multi_node/internal_dp/config/DeepSeek-V3_2-W8A8-EP_weekly.yaml

Lines changed: 2 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -19,8 +19,8 @@ env_common: &env_common
1919

2020
disaggregated_prefill:
2121
enabled: true
22-
prefiller_host_index: [0, 1]
23-
decoder_host_index: [2, 3]
22+
prefiller_host_index: [0]
23+
decoder_host_index: [1]
2424

2525
deployment:
2626
-

tests/e2e/weekly/single_node/configs/GLM-5.yaml

Lines changed: 0 additions & 3 deletions
Original file line numberDiff line numberDiff line change
@@ -34,8 +34,6 @@ _server_cmd: &server_cmd
3434
- "--speculative-config"
3535
- '{"num_speculative_tokens": 3, "method": "deepseek_mtp"}'
3636

37-
_special_dependencies: &special_dependencies
38-
transformers: "5.2.0"
3937

4038
_benchmarks: &benchmarks
4139
acc:
@@ -66,7 +64,6 @@ _benchmarks: &benchmarks
6664
test_cases:
6765
- name: "GLM-5-TP16-DP1-decodegraph"
6866
model: "Eco-Tech/GLM-5-w4a8"
69-
special_dependencies: *special_dependencies
7067
envs:
7168
<<: *envs
7269
server_cmd: *server_cmd

tests/e2e/weekly/single_node/configs/GLM-5_1-W8A8_A3_weekly.yaml

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -148,7 +148,7 @@ test_cases:
148148
server_cmd: *server_cmd
149149
server_cmd_extra:
150150
- "--max-model-len"
151-
- "66600"
151+
- "67584"
152152
- "--max-num-seqs"
153153
- "8"
154154
- "--gpu-memory-utilization"

0 commit comments

Comments
 (0)