From bf96fe96e60bf3a5dddf6a25f4d3b04c41e45ca7 Mon Sep 17 00:00:00 2001 From: Nick Hill Date: Thu, 2 Jul 2026 22:00:37 +0100 Subject: [PATCH] use mrv1 for mrv1-specific test Signed-off-by: Nick Hill --- tests/v1/e2e/general/test_mamba_prefix_cache.py | 4 ++++ 1 file changed, 4 insertions(+) diff --git a/tests/v1/e2e/general/test_mamba_prefix_cache.py b/tests/v1/e2e/general/test_mamba_prefix_cache.py index dd9efc66960..cca31dcaf63 100644 --- a/tests/v1/e2e/general/test_mamba_prefix_cache.py +++ b/tests/v1/e2e/general/test_mamba_prefix_cache.py @@ -743,6 +743,10 @@ def fill_following_kv_cache_block_ids(test_config: TestConfig) -> None: @create_new_process_for_each_test() def test_mamba_prefix_cache_mrv1(monkeypatch: pytest.MonkeyPatch): + # This test patches the V1 model runner, so pin V1 explicitly: MoE/hybrid + # models like Qwen3-Next now default to the V2 runner. + monkeypatch.setenv("VLLM_USE_V2_MODEL_RUNNER", "0") + envs.disable_envs_cache() run_ref_mamba_state_in_subprocess() apply_patch(monkeypatch) prompt_dataset = datasets.load_dataset("heheda/a_long_article")