From 46f95b2ec2cb2115e02cadfa2bb03c6956a78927 Mon Sep 17 00:00:00 2001 From: TJian Date: Sun, 24 May 2026 05:12:58 +0800 Subject: [PATCH] [ROCm][Critical] Fix the GDN import bug (#43486) Signed-off-by: tjtanaa --- tests/compile/passes/test_fusion.py | 2 +- vllm/compilation/passes/fusion/rocm_aiter_fusion.py | 7 +++++-- 2 files changed, 6 insertions(+), 3 deletions(-) diff --git a/tests/compile/passes/test_fusion.py b/tests/compile/passes/test_fusion.py index a13ee94f61b..92d1902b2c2 100644 --- a/tests/compile/passes/test_fusion.py +++ b/tests/compile/passes/test_fusion.py @@ -521,7 +521,7 @@ class _MockGDNLayer: self.head_v_dim = head_v_dim self.tp_size = tp_size - from vllm.model_executor.layers.mamba.gdn_linear_attn import ( + from vllm.model_executor.layers.mamba.gdn.base import ( GatedDeltaNetAttention, ) diff --git a/vllm/compilation/passes/fusion/rocm_aiter_fusion.py b/vllm/compilation/passes/fusion/rocm_aiter_fusion.py index 0ee60d01a81..e7ba3385725 100644 --- a/vllm/compilation/passes/fusion/rocm_aiter_fusion.py +++ b/vllm/compilation/passes/fusion/rocm_aiter_fusion.py @@ -560,11 +560,14 @@ class RocmAiterRMSNormQuantFusionPass(VllmPatternMatcherPass): # Discover (num_heads, head_dim) pairs for gated RMSNorm patterns # from GatedDeltaNetAttention layers in static_forward_context. - from vllm.model_executor.layers.mamba.gdn_linear_attn import ( + from vllm.model_executor.layers.mamba.gdn.base import ( GatedDeltaNetAttention, ) - gdn_layers = get_layers_from_vllm_config(config, GatedDeltaNetAttention) + gdn_layers = get_layers_from_vllm_config( + config, + GatedDeltaNetAttention, # type: ignore[type-abstract] + ) gated_norm_shapes: set[tuple[int, int]] = set() for layer in gdn_layers.values(): gated_norm_shapes.add(