[llvm] [AMDGPU] op_sel[0] must be zero for v_cvt_sr_fp8/bf8_f16 (PR #227413)
Changpeng Fang via llvm-commits
llvm-commits at lists.llvm.org
Wed Sep 30 17:16:14 PDT 2026
================
@@ -371,7 +371,7 @@ define amdgpu_ps void @test_cvt_sr_bf8_f16_byte0(half %a, i32 %sr, i32 %old, ptr
; GFX1250-SDAG-REAL16-NEXT: v_nop
; GFX1250-SDAG-REAL16-NEXT: global_prefetch_b8 v0, s[64:65] scope:SCOPE_SE
; GFX1250-SDAG-REAL16-NEXT: v_dual_mov_b32 v5, v4 :: v_dual_mov_b32 v4, v3
-; GFX1250-SDAG-REAL16-NEXT: v_cvt_sr_bf8_f16 v2, v0.l, v1
+; GFX1250-SDAG-REAL16-NEXT: v_cvt_sr_bf8_f16 v2, v0, v1
----------------
changpeng wrote:
> Looks like regression. It still needs .l suffix.
What if hi16 is dead (or not defined) for v0? I think there was a mov that is optimized away based on the pattern
https://github.com/llvm/llvm-project/pull/227413
More information about the llvm-commits
mailing list