[llvm] [LoongArch][NFC] Add horizontal widening add/sub tests (PR #201487)
via llvm-commits
llvm-commits at lists.llvm.org
Wed Jun 3 19:04:00 PDT 2026
llvmorg-github-actions[bot] wrote:
<!--LLVM PR SUMMARY COMMENT-->
@llvm/pr-subscribers-backend-loongarch
Author: hev (heiher)
<details>
<summary>Changes</summary>
---
Patch is 40.04 KiB, truncated to 20.00 KiB below, full version: https://github.com/llvm/llvm-project/pull/201487.diff
4 Files Affected:
- (added) llvm/test/CodeGen/LoongArch/lasx/vhaddw.ll (+359)
- (added) llvm/test/CodeGen/LoongArch/lasx/vhsubw.ll (+359)
- (added) llvm/test/CodeGen/LoongArch/lsx/vhaddw.ll (+144)
- (added) llvm/test/CodeGen/LoongArch/lsx/vhsubw.ll (+144)
``````````diff
diff --git a/llvm/test/CodeGen/LoongArch/lasx/vhaddw.ll b/llvm/test/CodeGen/LoongArch/lasx/vhaddw.ll
new file mode 100644
index 0000000000000..1e2b681bd9917
--- /dev/null
+++ b/llvm/test/CodeGen/LoongArch/lasx/vhaddw.ll
@@ -0,0 +1,359 @@
+; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 5
+; RUN: llc --mtriple=loongarch32 --mattr=+32s,+lasx < %s | FileCheck %s
+; RUN: llc --mtriple=loongarch64 --mattr=+lasx < %s | FileCheck %s
+
+define <16 x i16> @xvhaddw_h_b(<32 x i8> %a, <32 x i8> %b) nounwind {
+; CHECK-LABEL: xvhaddw_h_b:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 15
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr1, $xr1, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 15
+; CHECK-NEXT: vext2xv.h.b $xr1, $xr2
+; CHECK-NEXT: vext2xv.h.b $xr0, $xr0
+; CHECK-NEXT: xvadd.h $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <32 x i8> %a, <32 x i8> poison,
+ <16 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15,
+ i32 17, i32 19, i32 21, i32 23, i32 25, i32 27, i32 29, i32 31>
+
+ %1 = shufflevector <32 x i8> %b, <32 x i8> poison,
+ <16 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14,
+ i32 16, i32 18, i32 20, i32 22, i32 24, i32 26, i32 28, i32 30>
+
+ %2 = sext <16 x i8> %0 to <16 x i16>
+ %3 = sext <16 x i8> %1 to <16 x i16>
+
+ %4 = add <16 x i16> %2, %3
+ ret <16 x i16> %4
+}
+
+define <8 x i32> @xvhaddw_w_h(<16 x i16> %a, <16 x i16> %b) nounwind {
+; CHECK-LABEL: xvhaddw_w_h:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 3
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 7
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 1
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 2
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 3
+; CHECK-NEXT: xvpermi.d $xr1, $xr1, 14
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 4
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 5
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 6
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 7
+; CHECK-NEXT: vext2xv.w.h $xr1, $xr2
+; CHECK-NEXT: vext2xv.w.h $xr0, $xr0
+; CHECK-NEXT: xvadd.w $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <16 x i16> %a, <16 x i16> poison,
+ <8 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15>
+
+ %1 = shufflevector <16 x i16> %b, <16 x i16> poison,
+ <8 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14>
+
+ %2 = sext <8 x i16> %0 to <8 x i32>
+ %3 = sext <8 x i16> %1 to <8 x i32>
+
+ %4 = add <8 x i32> %2, %3
+ ret <8 x i32> %4
+}
+
+define <4 x i64> @xvhaddw_d_w(<8 x i32> %a, <8 x i32> %b) nounwind {
+; CHECK-LABEL: xvhaddw_d_w:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 1
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 0
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 3
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 1
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 5
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 2
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 7
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 3
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 0
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 0
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 2
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 1
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 4
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 2
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 6
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 3
+; CHECK-NEXT: vext2xv.d.w $xr1, $xr2
+; CHECK-NEXT: vext2xv.d.w $xr0, $xr0
+; CHECK-NEXT: xvadd.d $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <8 x i32> %a, <8 x i32> poison, <4 x i32> <i32 1, i32 3, i32 5, i32 7>
+ %1 = shufflevector <8 x i32> %b, <8 x i32> poison, <4 x i32> <i32 0, i32 2, i32 4, i32 6>
+
+ %2 = sext <4 x i32> %0 to <4 x i64>
+ %3 = sext <4 x i32> %1 to <4 x i64>
+
+ %4 = add <4 x i64> %2, %3
+ ret <4 x i64> %4
+}
+
+define <16 x i16> @xvhaddw_hu_bu(<32 x i8> %a, <32 x i8> %b) nounwind {
+; CHECK-LABEL: xvhaddw_hu_bu:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 15
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr1, $xr1, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 15
+; CHECK-NEXT: vext2xv.hu.bu $xr1, $xr2
+; CHECK-NEXT: vext2xv.hu.bu $xr0, $xr0
+; CHECK-NEXT: xvadd.h $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <32 x i8> %a, <32 x i8> poison,
+ <16 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15,
+ i32 17, i32 19, i32 21, i32 23, i32 25, i32 27, i32 29, i32 31>
+
+ %1 = shufflevector <32 x i8> %b, <32 x i8> poison,
+ <16 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14,
+ i32 16, i32 18, i32 20, i32 22, i32 24, i32 26, i32 28, i32 30>
+
+ %2 = zext <16 x i8> %0 to <16 x i16>
+ %3 = zext <16 x i8> %1 to <16 x i16>
+
+ %4 = add <16 x i16> %2, %3
+ ret <16 x i16> %4
+}
+
+define <8 x i32> @xvhaddw_wu_hu(<16 x i16> %a, <16 x i16> %b) nounwind {
+; CHECK-LABEL: xvhaddw_wu_hu:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 3
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 7
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 1
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 2
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 3
+; CHECK-NEXT: xvpermi.d $xr1, $xr1, 14
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 4
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 5
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 6
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 7
+; CHECK-NEXT: vext2xv.wu.hu $xr1, $xr2
+; CHECK-NEXT: vext2xv.wu.hu $xr0, $xr0
+; CHECK-NEXT: xvadd.w $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <16 x i16> %a, <16 x i16> poison,
+ <8 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15>
+
+ %1 = shufflevector <16 x i16> %b, <16 x i16> poison,
+ <8 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14>
+
+ %2 = zext <8 x i16> %0 to <8 x i32>
+ %3 = zext <8 x i16> %1 to <8 x i32>
+
+ %4 = add <8 x i32> %2, %3
+ ret <8 x i32> %4
+}
+
+define <4 x i64> @xvhaddw_du_wu(<8 x i32> %a, <8 x i32> %b) nounwind {
+; CHECK-LABEL: xvhaddw_du_wu:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 1
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 0
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 3
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 1
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 5
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 2
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr0, 7
+; CHECK-NEXT: vinsgr2vr.w $vr2, $a0, 3
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 0
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 0
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 2
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 1
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 4
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 2
+; CHECK-NEXT: xvpickve2gr.w $a0, $xr1, 6
+; CHECK-NEXT: vinsgr2vr.w $vr0, $a0, 3
+; CHECK-NEXT: vext2xv.du.wu $xr1, $xr2
+; CHECK-NEXT: vext2xv.du.wu $xr0, $xr0
+; CHECK-NEXT: xvadd.d $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <8 x i32> %a, <8 x i32> poison, <4 x i32> <i32 1, i32 3, i32 5, i32 7>
+ %1 = shufflevector <8 x i32> %b, <8 x i32> poison, <4 x i32> <i32 0, i32 2, i32 4, i32 6>
+
+ %2 = zext <4 x i32> %0 to <4 x i64>
+ %3 = zext <4 x i32> %1 to <4 x i64>
+
+ %4 = add <4 x i64> %2, %3
+ ret <4 x i64> %4
+}
diff --git a/llvm/test/CodeGen/LoongArch/lasx/vhsubw.ll b/llvm/test/CodeGen/LoongArch/lasx/vhsubw.ll
new file mode 100644
index 0000000000000..2664c51c13837
--- /dev/null
+++ b/llvm/test/CodeGen/LoongArch/lasx/vhsubw.ll
@@ -0,0 +1,359 @@
+; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py UTC_ARGS: --version 5
+; RUN: llc --mtriple=loongarch32 --mattr=+32s,+lasx < %s | FileCheck %s
+; RUN: llc --mtriple=loongarch64 --mattr=+lasx < %s | FileCheck %s
+
+define <16 x i16> @xvhsubw_h_b(<32 x i8> %a, <32 x i8> %b) nounwind {
+; CHECK-LABEL: xvhsubw_h_b:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 9
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 11
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 13
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr0, 15
+; CHECK-NEXT: vinsgr2vr.b $vr2, $a0, 15
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 1
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 2
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 3
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 4
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 5
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 6
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 7
+; CHECK-NEXT: xvpermi.d $xr1, $xr1, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 8
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 2
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 9
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 4
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 10
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 6
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 11
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 8
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 12
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 10
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 13
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 12
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 14
+; CHECK-NEXT: vpickve2gr.b $a0, $vr1, 14
+; CHECK-NEXT: vinsgr2vr.b $vr0, $a0, 15
+; CHECK-NEXT: vext2xv.h.b $xr1, $xr2
+; CHECK-NEXT: vext2xv.h.b $xr0, $xr0
+; CHECK-NEXT: xvsub.h $xr0, $xr1, $xr0
+; CHECK-NEXT: ret
+entry:
+ %0 = shufflevector <32 x i8> %a, <32 x i8> poison,
+ <16 x i32> <i32 1, i32 3, i32 5, i32 7, i32 9, i32 11, i32 13, i32 15,
+ i32 17, i32 19, i32 21, i32 23, i32 25, i32 27, i32 29, i32 31>
+
+ %1 = shufflevector <32 x i8> %b, <32 x i8> poison,
+ <16 x i32> <i32 0, i32 2, i32 4, i32 6, i32 8, i32 10, i32 12, i32 14,
+ i32 16, i32 18, i32 20, i32 22, i32 24, i32 26, i32 28, i32 30>
+
+ %2 = sext <16 x i8> %0 to <16 x i16>
+ %3 = sext <16 x i8> %1 to <16 x i16>
+
+ %4 = sub <16 x i16> %2, %3
+ ret <16 x i16> %4
+}
+
+define <8 x i32> @xvhsubw_w_h(<16 x i16> %a, <16 x i16> %b) nounwind {
+; CHECK-LABEL: xvhsubw_w_h:
+; CHECK: # %bb.0: # %entry
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 1
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 2
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 3
+; CHECK-NEXT: xvpermi.d $xr0, $xr0, 14
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 1
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 4
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 3
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 5
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 5
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 6
+; CHECK-NEXT: vpickve2gr.h $a0, $vr0, 7
+; CHECK-NEXT: vinsgr2vr.h $vr2, $a0, 7
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 0
+; CHECK-NEXT: vinsgr2vr.h $vr0, $a0, 0
+; CHECK-NEXT: vpickve2gr.h $a0, $vr1, 2
+; CHECK-NEX...
[truncated]
``````````
</details>
https://github.com/llvm/llvm-project/pull/201487
More information about the llvm-commits
mailing list