[llvm] [AArch64][SelectionDAG] Avoid fold bitcast of scalar_to_vector to anyext in big-endian (PR #225442)
via llvm-commits
llvm-commits at lists.llvm.org
Tue Sep 22 08:54:40 PDT 2026
https://github.com/hstk30-hw created https://github.com/llvm/llvm-project/pull/225442
```
int_vt (bitcast (vec_vt (scalar_to_vector elt_vt:x)))
=> int_vt (any_extend elt_vt:x)
```
This pattern not legal in big-endian, so disable in big-endian.
Fix https://github.com/llvm/llvm-project/issues/225436
>From 050e79a7b1f2096e38fd52e114310ad96aceb307 Mon Sep 17 00:00:00 2001
From: hstk30 <hanwei62 at huawei.com>
Date: Tue, 22 Sep 2026 23:49:39 +0800
Subject: [PATCH] [AArch64][SelectionDAG] Avoid fold bitcast of
scalar_to_vector to anyext in big-endian
---
llvm/lib/CodeGen/SelectionDAG/DAGCombiner.cpp | 3 +-
llvm/test/CodeGen/AArch64/scalar_to_vector.ll | 33 +++++++++++++++++++
2 files changed, 35 insertions(+), 1 deletion(-)
create mode 100644 llvm/test/CodeGen/AArch64/scalar_to_vector.ll
diff --git a/llvm/lib/CodeGen/SelectionDAG/DAGCombiner.cpp b/llvm/lib/CodeGen/SelectionDAG/DAGCombiner.cpp
index ae9af86196c86..a0cc6f117b470 100644
--- a/llvm/lib/CodeGen/SelectionDAG/DAGCombiner.cpp
+++ b/llvm/lib/CodeGen/SelectionDAG/DAGCombiner.cpp
@@ -18317,7 +18317,8 @@ SDValue DAGCombiner::visitBITCAST(SDNode *N) {
// int_vt (bitcast (vec_vt (scalar_to_vector elt_vt:x)))
// => int_vt (any_extend elt_vt:x)
- if (N0.getOpcode() == ISD::SCALAR_TO_VECTOR && VT.isScalarInteger()) {
+ if (DAG.getDataLayout().isLittleEndian() &&
+ N0.getOpcode() == ISD::SCALAR_TO_VECTOR && VT.isScalarInteger()) {
SDValue SrcScalar = N0.getOperand(0);
if (SrcScalar.getValueType().isScalarInteger())
return DAG.getNode(ISD::ANY_EXTEND, SDLoc(N), VT, SrcScalar);
diff --git a/llvm/test/CodeGen/AArch64/scalar_to_vector.ll b/llvm/test/CodeGen/AArch64/scalar_to_vector.ll
new file mode 100644
index 0000000000000..89351638c010d
--- /dev/null
+++ b/llvm/test/CodeGen/AArch64/scalar_to_vector.ll
@@ -0,0 +1,33 @@
+; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 5
+; RUN: llc < %s -global-isel=false -verify-machineinstrs -mtriple=aarch64 | FileCheck %s --check-prefix=LE
+; RUN: llc < %s -global-isel=false -verify-machineinstrs -mtriple=aarch64_be | FileCheck %s --check-prefix=BE
+
+declare void @use_i64(i64)
+
+define void @s2v_bitcast_be(i16 %x) {
+; LE-LABEL: s2v_bitcast_be:
+; LE: // %bb.0:
+; LE-NEXT: str x30, [sp, #-16]! // 8-byte Folded Spill
+; LE-NEXT: .cfi_def_cfa_offset 16
+; LE-NEXT: .cfi_offset w30, -16
+; LE-NEXT: // kill: def $w0 killed $w0 def $x0
+; LE-NEXT: bl use_i64
+; LE-NEXT: ldr x30, [sp], #16 // 8-byte Folded Reload
+; LE-NEXT: ret
+;
+; BE-LABEL: s2v_bitcast_be:
+; BE: // %bb.0:
+; BE-NEXT: str x30, [sp, #-16]! // 8-byte Folded Spill
+; BE-NEXT: .cfi_def_cfa_offset 16
+; BE-NEXT: .cfi_offset w30, -16
+; BE-NEXT: fmov s0, w0
+; BE-NEXT: rev64 v0.4h, v0.4h
+; BE-NEXT: fmov x0, d0
+; BE-NEXT: bl use_i64
+; BE-NEXT: ldr x30, [sp], #16 // 8-byte Folded Reload
+; BE-NEXT: ret
+ %v = insertelement <4 x i16> poison, i16 %x, i32 0
+ %c = bitcast <4 x i16> %v to i64
+ call void @use_i64(i64 %c)
+ ret void
+}
More information about the llvm-commits
mailing list