[llvm] [AArch64] Use add_like for new uaddlp patterns (PR #195024)

David Green via llvm-commits llvm-commits at lists.llvm.org
Thu Apr 30 00:13:37 PDT 2026


https://github.com/davemgreen created https://github.com/llvm/llvm-project/pull/195024

This extends the patterns added in #189255 to use add_like, so that they can also match from add-like disjoint ors.

>From f2ac3f407b70825dcaf20df70ba1056028992020 Mon Sep 17 00:00:00 2001
From: David Green <david.green at arm.com>
Date: Thu, 30 Apr 2026 08:09:14 +0100
Subject: [PATCH] [AArch64] Use add_like for new uaddlp patterns

This extends the patterns added in #189255 to use add_like, so that they can
also match from add-like disjoint ors.
---
 llvm/lib/Target/AArch64/AArch64InstrInfo.td | 14 ++---
 llvm/test/CodeGen/AArch64/uaddlp.ll         | 60 +++++++++++++++++++--
 2 files changed, 63 insertions(+), 11 deletions(-)

diff --git a/llvm/lib/Target/AArch64/AArch64InstrInfo.td b/llvm/lib/Target/AArch64/AArch64InstrInfo.td
index f20f978fe7e8a..e4417e2e0a0b7 100644
--- a/llvm/lib/Target/AArch64/AArch64InstrInfo.td
+++ b/llvm/lib/Target/AArch64/AArch64InstrInfo.td
@@ -8645,18 +8645,18 @@ def : Pat<(v2i64 (AArch64saddlv (v2i32 V64:$Rn))),
 def : Pat<(v2i64 (AArch64uaddlv (v2i32 V64:$Rn))),
           (v2i64 (INSERT_SUBREG (v2i64 (IMPLICIT_DEF)), (UADDLPv2i32_v1i64 V64:$Rn), dsub))>;
 
-def : Pat<(add (AArch64bici (v8i16 (bitconvert v16i8:$src)), (i32 255), (i32 8)),
-               (AArch64vlshr (v8i16 (AArch64NvCast v16i8:$src)), (i32 8))),
+def : Pat<(add_like (AArch64bici (v8i16 (bitconvert v16i8:$src)), (i32 255), (i32 8)),
+                    (AArch64vlshr (v8i16 (AArch64NvCast v16i8:$src)), (i32 8))),
           (UADDLPv16i8_v8i16 V128:$src)>;
 
-def : Pat<(add (and (v4i32 (bitconvert v8i16:$src)),
-                    (v4i32 (AArch64NvCast (v2i64 (AArch64movi_edit (i32 51)))))),
-               (AArch64vlshr (v4i32 (AArch64NvCast v8i16:$src)), (i32 16))),
+def : Pat<(add_like  (and (v4i32 (bitconvert v8i16:$src)),
+                          (v4i32 (AArch64NvCast (v2i64 (AArch64movi_edit (i32 51)))))),
+                     (AArch64vlshr (v4i32 (AArch64NvCast v8i16:$src)), (i32 16))),
           (UADDLPv8i16_v4i32 V128:$src)>;
 
-def : Pat<(add (v2i64 (zext (v2i32 (AArch64zip1 (v2i32 (extract_subvector v4i32:$src, (i64 0))),
+def : Pat<(add_like  (v2i64 (zext (v2i32 (AArch64zip1 (v2i32 (extract_subvector v4i32:$src, (i64 0))),
                                          (v2i32 (extract_subvector v4i32:$src, (i64 2))))))),
-               (v2i64 (zext (v2i32 (AArch64zip2 (v2i32 (extract_subvector v4i32:$src, (i64 0))),
+                     (v2i64 (zext (v2i32 (AArch64zip2 (v2i32 (extract_subvector v4i32:$src, (i64 0))),
                                          (v2i32 (extract_subvector v4i32:$src, (i64 2)))))))),
           (UADDLPv4i32_v2i64 V128:$src)>;
 
diff --git a/llvm/test/CodeGen/AArch64/uaddlp.ll b/llvm/test/CodeGen/AArch64/uaddlp.ll
index 015aab48e7255..190e44464b1d7 100644
--- a/llvm/test/CodeGen/AArch64/uaddlp.ll
+++ b/llvm/test/CodeGen/AArch64/uaddlp.ll
@@ -53,13 +53,65 @@ start:
   ret <2 x i64> %4
 }
 
+define <8 x i16> @vpaddlq_or_v16i8(<16 x i8> %a) {
+; CHECK-LABEL: vpaddlq_or_v16i8:
+; CHECK:       // %bb.0: // %start
+; CHECK-NEXT:    xtn v1.8b, v0.8h
+; CHECK-NEXT:    uzp2 v0.16b, v0.16b, v0.16b
+; CHECK-NEXT:    orr v0.8b, v1.8b, v0.8b
+; CHECK-NEXT:    ushll v0.8h, v0.8b, #0
+; CHECK-NEXT:    ret
+start:
+  %0 = shufflevector <16 x i8> %a, <16 x i8> poison, <8 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14>
+  %1 = shufflevector <16 x i8> %a, <16 x i8> poison, <8 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15>
+  %2 = zext <8 x i8> %0 to <8 x i16>
+  %3 = zext <8 x i8> %1 to <8 x i16>
+  %4 = or disjoint <8 x i16> %2, %3
+  ret <8 x i16> %4
+}
+
+define <4 x i32> @vpaddlq_or_v8i16(<8 x i16> %a) {
+; CHECK-LABEL: vpaddlq_or_v8i16:
+; CHECK:       // %bb.0: // %start
+; CHECK-NEXT:    xtn v1.4h, v0.4s
+; CHECK-NEXT:    uzp2 v0.8h, v0.8h, v0.8h
+; CHECK-NEXT:    orr v0.8b, v1.8b, v0.8b
+; CHECK-NEXT:    ushll v0.4s, v0.4h, #0
+; CHECK-NEXT:    ret
+start:
+  %0 = shufflevector <8 x i16> %a, <8 x i16> poison, <4 x i32> <i32 0, i32 2, i32 4, i32 6>
+  %1 = shufflevector <8 x i16> %a, <8 x i16> poison, <4 x i32> <i32 1, i32 3, i32 5, i32 7>
+  %2 = zext <4 x i16> %0 to <4 x i32>
+  %3 = zext <4 x i16> %1 to <4 x i32>
+  %4 = or disjoint <4 x i32> %2, %3
+  ret <4 x i32> %4
+}
+
+define <2 x i64> @vpaddlq_or_v4i32(<4 x i32> %a) {
+; CHECK-LABEL: vpaddlq_or_v4i32:
+; CHECK:       // %bb.0: // %start
+; CHECK-NEXT:    ext v1.16b, v0.16b, v0.16b, #8
+; CHECK-NEXT:    zip1 v2.2s, v0.2s, v1.2s
+; CHECK-NEXT:    zip2 v0.2s, v0.2s, v1.2s
+; CHECK-NEXT:    orr v0.8b, v2.8b, v0.8b
+; CHECK-NEXT:    ushll v0.2d, v0.2s, #0
+; CHECK-NEXT:    ret
+start:
+  %0 = shufflevector <4 x i32> %a, <4 x i32> poison, <2 x i32> <i32 0, i32 2>
+  %1 = shufflevector <4 x i32> %a, <4 x i32> poison, <2 x i32> <i32 1, i32 3>
+  %2 = zext <2 x i32> %0 to <2 x i64>
+  %3 = zext <2 x i32> %1 to <2 x i64>
+  %4 = or disjoint <2 x i64> %2, %3
+  ret <2 x i64> %4
+}
+
 define <8 x i16> @vpaddlq_v16i8_neg(<16 x i8> %a) {
 ; CHECK-LABEL: vpaddlq_v16i8_neg:
 ; CHECK:       // %bb.0: // %start
-; CHECK-NEXT:    adrp x8, .LCPI4_0
-; CHECK-NEXT:    adrp x9, .LCPI4_1
-; CHECK-NEXT:    ldr d1, [x8, :lo12:.LCPI4_0]
-; CHECK-NEXT:    ldr d2, [x9, :lo12:.LCPI4_1]
+; CHECK-NEXT:    adrp x8, .LCPI7_0
+; CHECK-NEXT:    adrp x9, .LCPI7_1
+; CHECK-NEXT:    ldr d1, [x8, :lo12:.LCPI7_0]
+; CHECK-NEXT:    ldr d2, [x9, :lo12:.LCPI7_1]
 ; CHECK-NEXT:    tbl v1.8b, { v0.16b }, v1.8b
 ; CHECK-NEXT:    tbl v0.8b, { v0.16b }, v2.8b
 ; CHECK-NEXT:    uaddl v0.8h, v1.8b, v0.8b



More information about the llvm-commits mailing list