From 305e53ade8f7cbdbece6fd211eb45a612800e657 Mon Sep 17 00:00:00 2001 From: Matt <156021403+mawong-amd@users.noreply.github.com> Date: Fri, 23 Jan 2026 10:24:26 -0600 Subject: [PATCH] [Hardware][AMD][CI][Bugfix] Fix Kernels Attention Cache test (#32904) Signed-off-by: Matthew Wong --- tests/kernels/attention/test_cache.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/tests/kernels/attention/test_cache.py b/tests/kernels/attention/test_cache.py index a130f9acbe8..4ff1e590a14 100644 --- a/tests/kernels/attention/test_cache.py +++ b/tests/kernels/attention/test_cache.py @@ -242,7 +242,7 @@ def test_reshape_and_cache_flash( value_cache_compact = permute_and_compact(value_cache) def convert_fp8_local(output, input, scale, kv_dtype): - fp8_input = input.view(torch.float8_e4m3fn) + fp8_input = input.view(current_platform.fp8_dtype()) if scale.numel() == 1: # per-tensor result = scaled_dequantize( fp8_input.flatten(0, 2), scale, group_shape=None, out_dtype=output.dtype