[llvm] 8024076 - [SLP]Recalculate copyable-element deps after tree reordering

via llvm-commits llvm-commits at lists.llvm.org
Fri Aug 14 18:07:38 PDT 2026


Author: Alexey Bataev
Date: 2026-08-14T21:07:33-04:00
New Revision: 8024076c7591b6477d23c3519652a7c6487d97d3

URL: https://github.com/llvm/llvm-project/commit/8024076c7591b6477d23c3519652a7c6487d97d3
DIFF: https://github.com/llvm/llvm-project/commit/8024076c7591b6477d23c3519652a7c6487d97d3.diff

LOG: [SLP]Recalculate copyable-element deps after tree reordering

Reordering permutes the operand columns of the entries and may move an
operand between copyable-covered and plain edges, making the computed
dependency counts stale and tripping the unscheduled-deps assertion.

Reviewers: 

Pull Request: https://github.com/llvm/llvm-project/pull/216442

Added: 
    llvm/test/Transforms/SLPVectorizer/AArch64/recalc-copyable-deps-on-reorder.ll
    llvm/test/Transforms/SLPVectorizer/RISCV/recalc-copyable-deps-on-reorder.ll

Modified: 
    llvm/lib/Transforms/Vectorize/SLPVectorizer.cpp

Removed: 
    


################################################################################
diff  --git a/llvm/lib/Transforms/Vectorize/SLPVectorizer.cpp b/llvm/lib/Transforms/Vectorize/SLPVectorizer.cpp
index 53816d49de722..dac327e0f68b4 100644
--- a/llvm/lib/Transforms/Vectorize/SLPVectorizer.cpp
+++ b/llvm/lib/Transforms/Vectorize/SLPVectorizer.cpp
@@ -1027,6 +1027,10 @@ class slpvectorizer::BoUpSLP {
   /// during analysis.
   void reorderBottomToTop(bool IgnoreReorder = false);
 
+  /// Marks the schedule data of the copyable-modeled operands of \p TE for
+  /// dependency recalculation at the next bundle scheduling.
+  void markCopyableDepsForRecalc(TreeEntry &TE);
+
   /// \return The vector element size in bits to use when vectorizing the
   /// expression tree ending at \p V. If V is a store, the size is the width of
   /// the stored value. Otherwise, the size is the width of the largest loaded
@@ -4748,6 +4752,20 @@ class slpvectorizer::BoUpSLP {
       return Res;
     }
 
+    /// Reordering \p TE permutes its operand columns and may move an operand
+    /// between the edges covered and not covered by copyable scheduling
+    /// data, making the computed dependency counts stale. Mark the schedule
+    /// data of \p TE's copyable-modeled operands for recalculation at the
+    /// next bundle scheduling.
+    void markCopyableDepsForRecalc(const TreeEntry &TE) {
+      for (unsigned OpIdx : seq<unsigned>(TE.getNumOperands()))
+        for (Value *V : TE.getOperand(OpIdx))
+          if (auto *I = dyn_cast<Instruction>(V))
+            if (ScheduleData *SD = getScheduleData(I);
+                SD && !getScheduleCopyableData(I).empty())
+              RecalcCopyableOperandDeps.insert(SD);
+    }
+
     ScheduleCopyableData &addScheduleCopyableData(const EdgeInfo &EI,
                                                   Instruction *I,
                                                   int SchedulingRegionID,
@@ -7899,6 +7917,14 @@ void BoUpSLP::TreeEntry::reorderSplitNode(unsigned Idx, ArrayRef<int> Mask,
     ReorderIndices.clear();
 }
 
+void BoUpSLP::markCopyableDepsForRecalc(TreeEntry &TE) {
+  if (!TE.hasState())
+    return;
+  if (auto It = BlocksSchedules.find(TE.getMainOp()->getParent());
+      It != BlocksSchedules.end())
+    It->second->markCopyableDepsForRecalc(TE);
+}
+
 void BoUpSLP::reorderTopToBottom() {
   // Maps VF to the graph nodes.
   DenseMap<unsigned, SetVector<TreeEntry *>> VFToOrderedEntries;
@@ -8179,11 +8205,15 @@ void BoUpSLP::reorderTopToBottom() {
         // Build correct orders for extract{element,value}, loads,
         // stores and alternate (split) nodes.
         reorderOrder(TE->ReorderIndices, Mask);
-        if (isa<InsertElementInst, InsertValueInst, StoreInst>(TE->getMainOp()))
+        if (isa<InsertElementInst, InsertValueInst, StoreInst>(
+                TE->getMainOp())) {
           TE->reorderOperands(Mask);
+          markCopyableDepsForRecalc(*TE);
+        }
       } else {
         // Reorder the node and its operands.
         TE->reorderOperands(Mask);
+        markCopyableDepsForRecalc(*TE);
         assert(TE->ReorderIndices.empty() &&
                "Expected empty reorder sequence.");
         reorderScalars(TE->Scalars, Mask);
@@ -8683,8 +8713,10 @@ void BoUpSLP::reorderBottomToTop(bool IgnoreReorder) {
       if (Data.first->State != TreeEntry::Vectorize ||
           !isa<ExtractElementInst, ExtractValueInst, LoadInst>(
               Data.first->getMainOp()) ||
-          IsNotProfitableAltCodeNode(*Data.first))
+          IsNotProfitableAltCodeNode(*Data.first)) {
         Data.first->reorderOperands(Mask);
+        markCopyableDepsForRecalc(*Data.first);
+      }
       if (!isa<InsertElementInst, InsertValueInst, StoreInst>(
               Data.first->getMainOp()) ||
           IsNotProfitableAltCodeNode(*Data.first) ||

diff  --git a/llvm/test/Transforms/SLPVectorizer/AArch64/recalc-copyable-deps-on-reorder.ll b/llvm/test/Transforms/SLPVectorizer/AArch64/recalc-copyable-deps-on-reorder.ll
new file mode 100644
index 0000000000000..f7b2664e57b80
--- /dev/null
+++ b/llvm/test/Transforms/SLPVectorizer/AArch64/recalc-copyable-deps-on-reorder.ll
@@ -0,0 +1,188 @@
+; NOTE: Assertions have been autogenerated by utils/update_test_checks.py UTC_ARGS: --version 6
+; RUN: opt -S --passes=slp-vectorizer -mtriple=aarch64-unknown-linux-gnu < %s | FileCheck %s
+
+define void @test(ptr %0, ptr %1, double %2, ptr %3) {
+; CHECK-LABEL: define void @test(
+; CHECK-SAME: ptr [[TMP0:%.*]], ptr [[TMP1:%.*]], double [[TMP2:%.*]], ptr [[TMP3:%.*]]) {
+; CHECK-NEXT:    br i1 true, label %[[VECTOR_PH:.*]], label %[[DOTPREHEADER511:.*]]
+; CHECK:       [[VECTOR_PH]]:
+; CHECK-NEXT:    [[TMP5:%.*]] = load double, ptr [[TMP0]], align 8
+; CHECK-NEXT:    [[TMP6:%.*]] = fmul double [[TMP5]], 0.000000e+00
+; CHECK-NEXT:    [[TMP7:%.*]] = fadd double [[TMP6]], 0.000000e+00
+; CHECK-NEXT:    [[TMP8:%.*]] = fmul double [[TMP6]], 0.000000e+00
+; CHECK-NEXT:    [[TMP9:%.*]] = fmul double [[TMP8]], 0.000000e+00
+; CHECK-NEXT:    [[TMP10:%.*]] = fadd double [[TMP2]], 0.000000e+00
+; CHECK-NEXT:    [[TMP11:%.*]] = fadd double [[TMP10]], 1.000000e+00
+; CHECK-NEXT:    [[TMP12:%.*]] = fadd double [[TMP9]], [[TMP11]]
+; CHECK-NEXT:    [[TMP13:%.*]] = fmul double [[TMP2]], 0.000000e+00
+; CHECK-NEXT:    [[TMP14:%.*]] = fadd contract double [[TMP13]], 0.000000e+00
+; CHECK-NEXT:    [[TMP15:%.*]] = fmul double [[TMP6]], [[TMP2]]
+; CHECK-NEXT:    [[TMP16:%.*]] = fadd contract double [[TMP15]], 0.000000e+00
+; CHECK-NEXT:    [[TMP17:%.*]] = load double, ptr [[TMP1]], align 8
+; CHECK-NEXT:    [[TMP18:%.*]] = fmul double [[TMP17]], 0.000000e+00
+; CHECK-NEXT:    [[TMP19:%.*]] = fmul double [[TMP18]], [[TMP2]]
+; CHECK-NEXT:    [[TMP20:%.*]] = fmul double [[TMP2]], [[TMP19]]
+; CHECK-NEXT:    [[TMP21:%.*]] = fadd double [[TMP20]], 0.000000e+00
+; CHECK-NEXT:    [[TMP22:%.*]] = load double, ptr [[TMP0]], align 8
+; CHECK-NEXT:    [[TMP23:%.*]] = fmul double [[TMP22]], 0.000000e+00
+; CHECK-NEXT:    [[TMP24:%.*]] = fmul double [[TMP2]], [[TMP23]]
+; CHECK-NEXT:    [[TMP25:%.*]] = fadd double [[TMP24]], 0.000000e+00
+; CHECK-NEXT:    [[TMP26:%.*]] = fmul double [[TMP5]], 0.000000e+00
+; CHECK-NEXT:    [[TMP27:%.*]] = fmul double [[TMP26]], 0.000000e+00
+; CHECK-NEXT:    [[TMP28:%.*]] = fadd double [[TMP27]], 0.000000e+00
+; CHECK-NEXT:    [[TMP29:%.*]] = fmul double [[TMP2]], [[TMP17]]
+; CHECK-NEXT:    [[TMP30:%.*]] = fadd double [[TMP29]], 0.000000e+00
+; CHECK-NEXT:    br label %[[DOTPREHEADER511]]
+; CHECK:       [[_PREHEADER511:.*:]]
+; CHECK-NEXT:    [[DOTSROA_9_0:%.*]] = phi double [ [[TMP30]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4:%.*]] ]
+; CHECK-NEXT:    [[DOTSROA_7_0:%.*]] = phi double [ [[TMP28]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_6887_0:%.*]] = phi double [ [[TMP25]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_5_0:%.*]] = phi double [ [[TMP21]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_4886_0:%.*]] = phi double [ [[TMP16]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_3_0:%.*]] = phi double [ [[TMP14]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_2885_0:%.*]] = phi double [ [[TMP12]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    [[DOTSROA_0884_0:%.*]] = phi double [ [[TMP7]], %[[VECTOR_PH]] ], [ 0.000000e+00, [[TMP4]] ]
+; CHECK-NEXT:    br i1 true, label %[[BB31:.*]], [[DOTPREHEADER498:label %.*]]
+; CHECK:       [[BB31]]:
+; CHECK-NEXT:    [[TMP32:%.*]] = getelementptr i8, ptr [[TMP3]], i64 8
+; CHECK-NEXT:    [[TMP33:%.*]] = load double, ptr [[TMP3]], align 8
+; CHECK-NEXT:    [[TMP34:%.*]] = fmul double [[DOTSROA_0884_0]], [[TMP33]]
+; CHECK-NEXT:    [[TMP35:%.*]] = load double, ptr [[TMP32]], align 8
+; CHECK-NEXT:    [[TMP36:%.*]] = fmul double [[DOTSROA_2885_0]], [[TMP35]]
+; CHECK-NEXT:    [[TMP37:%.*]] = fadd double [[TMP34]], [[TMP36]]
+; CHECK-NEXT:    [[TMP38:%.*]] = fmul double [[DOTSROA_4886_0]], 0.000000e+00
+; CHECK-NEXT:    [[TMP39:%.*]] = fadd double [[TMP37]], [[TMP38]]
+; CHECK-NEXT:    [[TMP40:%.*]] = fadd double [[TMP39]], 0.000000e+00
+; CHECK-NEXT:    [[TMP41:%.*]] = fadd double [[TMP40]], 1.000000e+00
+; CHECK-NEXT:    [[TMP42:%.*]] = fmul double [[DOTSROA_2885_0]], [[TMP33]]
+; CHECK-NEXT:    [[TMP43:%.*]] = fmul double [[DOTSROA_3_0]], [[TMP35]]
+; CHECK-NEXT:    [[TMP44:%.*]] = fadd double [[TMP42]], [[TMP43]]
+; CHECK-NEXT:    [[TMP45:%.*]] = fmul double [[DOTSROA_5_0]], 0.000000e+00
+; CHECK-NEXT:    [[TMP46:%.*]] = fadd double [[TMP44]], [[TMP45]]
+; CHECK-NEXT:    [[TMP47:%.*]] = fadd double [[TMP46]], [[TMP2]]
+; CHECK-NEXT:    [[TMP48:%.*]] = fadd double [[TMP47]], 0.000000e+00
+; CHECK-NEXT:    [[TMP49:%.*]] = fmul double [[DOTSROA_4886_0]], [[TMP33]]
+; CHECK-NEXT:    [[TMP50:%.*]] = fmul double [[DOTSROA_5_0]], [[TMP35]]
+; CHECK-NEXT:    [[TMP51:%.*]] = fadd double [[TMP49]], [[TMP50]]
+; CHECK-NEXT:    [[TMP52:%.*]] = load double, ptr [[TMP0]], align 8
+; CHECK-NEXT:    [[TMP53:%.*]] = fmul double [[DOTSROA_6887_0]], [[TMP52]]
+; CHECK-NEXT:    [[TMP54:%.*]] = fadd double [[TMP51]], [[TMP53]]
+; CHECK-NEXT:    [[TMP55:%.*]] = fmul double [[DOTSROA_9_0]], [[TMP2]]
+; CHECK-NEXT:    [[TMP56:%.*]] = fadd double [[TMP54]], [[TMP55]]
+; CHECK-NEXT:    [[TMP57:%.*]] = fadd double [[TMP56]], 0.000000e+00
+; CHECK-NEXT:    [[TMP58:%.*]] = fmul double [[DOTSROA_7_0]], [[TMP33]]
+; CHECK-NEXT:    [[TMP59:%.*]] = fadd double [[TMP58]], [[TMP2]]
+; CHECK-NEXT:    [[TMP60:%.*]] = fmul double [[DOTSROA_9_0]], 0.000000e+00
+; CHECK-NEXT:    [[TMP61:%.*]] = fadd double [[TMP59]], [[TMP60]]
+; CHECK-NEXT:    [[TMP62:%.*]] = fadd double [[TMP61]], 0.000000e+00
+; CHECK-NEXT:    [[TMP63:%.*]] = fadd double [[TMP62]], 1.000000e+00
+; CHECK-NEXT:    br [[DOTPREHEADER498]]
+; CHECK:       [[_PREHEADER498:.*:]]
+; CHECK-NEXT:    [[DOTSROA_0913_0:%.*]] = phi double [ [[TMP41]], %[[BB31]] ], [ 0.000000e+00, %[[DOTPREHEADER511]] ]
+; CHECK-NEXT:    [[DOTSROA_6915_0:%.*]] = phi double [ [[TMP48]], %[[BB31]] ], [ 0.000000e+00, %[[DOTPREHEADER511]] ]
+; CHECK-NEXT:    [[DOTSROA_10918_0:%.*]] = phi double [ [[TMP57]], %[[BB31]] ], [ 0.000000e+00, %[[DOTPREHEADER511]] ]
+; CHECK-NEXT:    [[DOTSROA_14921_0:%.*]] = phi double [ [[TMP63]], %[[BB31]] ], [ 0.000000e+00, %[[DOTPREHEADER511]] ]
+; CHECK-NEXT:    [[DOTSROA_18924_0:%.*]] = phi double [ [[TMP33]], %[[BB31]] ], [ 0.000000e+00, %[[DOTPREHEADER511]] ]
+; CHECK-NEXT:    store double [[DOTSROA_0913_0]], ptr [[TMP1]], align 8
+; CHECK-NEXT:    [[DOTSROA_6915_0__SROA_IDX916:%.*]] = getelementptr i8, ptr [[TMP1]], i64 8
+; CHECK-NEXT:    store double [[DOTSROA_6915_0]], ptr [[DOTSROA_6915_0__SROA_IDX916]], align 8
+; CHECK-NEXT:    [[DOTSROA_10918_0__SROA_IDX919:%.*]] = getelementptr i8, ptr [[TMP1]], i64 16
+; CHECK-NEXT:    store double [[DOTSROA_10918_0]], ptr [[DOTSROA_10918_0__SROA_IDX919]], align 8
+; CHECK-NEXT:    [[DOTSROA_14921_0__SROA_IDX922:%.*]] = getelementptr i8, ptr [[TMP1]], i64 24
+; CHECK-NEXT:    store double [[DOTSROA_14921_0]], ptr [[DOTSROA_14921_0__SROA_IDX922]], align 8
+; CHECK-NEXT:    store double [[DOTSROA_18924_0]], ptr [[TMP0]], align 8
+; CHECK-NEXT:    ret void
+;
+  br i1 true, label %vector.ph, label %.preheader511
+
+vector.ph:
+  %5 = load double, ptr %0, align 8
+  %6 = fmul double %5, 0.000000e+00
+  %7 = fadd double %6, 0.000000e+00
+  %8 = fmul double %6, 0.000000e+00
+  %9 = fmul double %8, 0.000000e+00
+  %10 = fadd double %2, 0.000000e+00
+  %11 = fadd double %10, 1.000000e+00
+  %12 = fadd double %9, %11
+  %13 = fmul double %2, 0.000000e+00
+  %14 = fadd contract double %13, 0.000000e+00
+  %15 = fmul double %6, %2
+  %16 = fadd contract double %15, 0.000000e+00
+  %17 = load double, ptr %1, align 8
+  %18 = fmul double %17, 0.000000e+00
+  %19 = fmul double %18, %2
+  %20 = fmul double %2, %19
+  %21 = fadd double %20, 0.000000e+00
+  %22 = load double, ptr %0, align 8
+  %23 = fmul double %22, 0.000000e+00
+  %24 = fmul double %2, %23
+  %25 = fadd double %24, 0.000000e+00
+  %26 = fmul double %5, 0.000000e+00
+  %27 = fmul double %26, 0.000000e+00
+  %28 = fadd double %27, 0.000000e+00
+  %29 = fmul double %2, %17
+  %30 = fadd double %29, 0.000000e+00
+  br label %.preheader511
+
+.preheader511:
+  %.sroa.9.0 = phi double [ %30, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.7.0 = phi double [ %28, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.6887.0 = phi double [ %25, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.5.0 = phi double [ %21, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.4886.0 = phi double [ %16, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.3.0 = phi double [ %14, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.2885.0 = phi double [ %12, %vector.ph ], [ 0.000000e+00, %4 ]
+  %.sroa.0884.0 = phi double [ %7, %vector.ph ], [ 0.000000e+00, %4 ]
+  br i1 true, label %31, label %.preheader498
+
+31:
+  %32 = getelementptr i8, ptr %3, i64 8
+  %33 = load double, ptr %3, align 8
+  %34 = fmul double %.sroa.0884.0, %33
+  %35 = load double, ptr %32, align 8
+  %36 = fmul double %.sroa.2885.0, %35
+  %37 = fadd double %34, %36
+  %38 = fmul double %.sroa.4886.0, 0.000000e+00
+  %39 = fadd double %37, %38
+  %40 = fadd double %39, 0.000000e+00
+  %41 = fadd double %40, 1.000000e+00
+  %42 = fmul double %.sroa.2885.0, %33
+  %43 = fmul double %.sroa.3.0, %35
+  %44 = fadd double %42, %43
+  %45 = fmul double %.sroa.5.0, 0.000000e+00
+  %46 = fadd double %44, %45
+  %47 = fadd double %46, %2
+  %48 = fadd double %47, 0.000000e+00
+  %49 = fmul double %.sroa.4886.0, %33
+  %50 = fmul double %.sroa.5.0, %35
+  %51 = fadd double %49, %50
+  %52 = load double, ptr %0, align 8
+  %53 = fmul double %.sroa.6887.0, %52
+  %54 = fadd double %51, %53
+  %55 = fmul double %.sroa.9.0, %2
+  %56 = fadd double %54, %55
+  %57 = fadd double %56, 0.000000e+00
+  %58 = fmul double %.sroa.7.0, %33
+  %59 = fadd double %58, %2
+  %60 = fmul double %.sroa.9.0, 0.000000e+00
+  %61 = fadd double %59, %60
+  %62 = fadd double %61, 0.000000e+00
+  %63 = fadd double %62, 1.000000e+00
+  br label %.preheader498
+
+.preheader498:
+  %.sroa.0913.0 = phi double [ %41, %31 ], [ 0.000000e+00, %.preheader511 ]
+  %.sroa.6915.0 = phi double [ %48, %31 ], [ 0.000000e+00, %.preheader511 ]
+  %.sroa.10918.0 = phi double [ %57, %31 ], [ 0.000000e+00, %.preheader511 ]
+  %.sroa.14921.0 = phi double [ %63, %31 ], [ 0.000000e+00, %.preheader511 ]
+  %.sroa.18924.0 = phi double [ %33, %31 ], [ 0.000000e+00, %.preheader511 ]
+  store double %.sroa.0913.0, ptr %1, align 8
+  %.sroa.6915.0..sroa_idx916 = getelementptr i8, ptr %1, i64 8
+  store double %.sroa.6915.0, ptr %.sroa.6915.0..sroa_idx916, align 8
+  %.sroa.10918.0..sroa_idx919 = getelementptr i8, ptr %1, i64 16
+  store double %.sroa.10918.0, ptr %.sroa.10918.0..sroa_idx919, align 8
+  %.sroa.14921.0..sroa_idx922 = getelementptr i8, ptr %1, i64 24
+  store double %.sroa.14921.0, ptr %.sroa.14921.0..sroa_idx922, align 8
+  store double %.sroa.18924.0, ptr %0, align 8
+  ret void
+}

diff  --git a/llvm/test/Transforms/SLPVectorizer/RISCV/recalc-copyable-deps-on-reorder.ll b/llvm/test/Transforms/SLPVectorizer/RISCV/recalc-copyable-deps-on-reorder.ll
new file mode 100644
index 0000000000000..64671f36fe324
--- /dev/null
+++ b/llvm/test/Transforms/SLPVectorizer/RISCV/recalc-copyable-deps-on-reorder.ll
@@ -0,0 +1,50 @@
+; NOTE: Assertions have been autogenerated by utils/update_test_checks.py UTC_ARGS: --version 6
+; RUN: opt -S --passes=slp-vectorizer -mtriple=riscv64-unknown-linux-gnu -mattr=+v,+zvl512b < %s | FileCheck %s
+
+define ptr @test(ptr %this, ptr %this.addr, i32 %0, i32 %1) {
+; CHECK-LABEL: define ptr @test(
+; CHECK-SAME: ptr [[THIS:%.*]], ptr [[THIS_ADDR:%.*]], i32 [[TMP0:%.*]], i32 [[TMP1:%.*]]) #[[ATTR0:[0-9]+]] {
+; CHECK-NEXT:  [[ENTRY:.*:]]
+; CHECK-NEXT:    [[STATE:%.*]] = getelementptr i8, ptr [[THIS]], i64 64
+; CHECK-NEXT:    [[TMP2:%.*]] = load i32, ptr [[STATE]], align 4
+; CHECK-NEXT:    store i32 0, ptr [[THIS_ADDR]], align 4
+; CHECK-NEXT:    [[AND219:%.*]] = and i32 [[TMP2]], 1
+; CHECK-NEXT:    [[TMP3:%.*]] = load i32, ptr [[THIS]], align 4
+; CHECK-NEXT:    [[AND:%.*]] = and i32 [[TMP0]], [[TMP1]]
+; CHECK-NEXT:    [[ADD80:%.*]] = or i32 [[AND]], 1
+; CHECK-NEXT:    [[XOR261:%.*]] = xor i32 [[AND]], 1
+; CHECK-NEXT:    [[ADD265:%.*]] = add i32 [[XOR261]], 1
+; CHECK-NEXT:    [[AND816:%.*]] = and i32 [[ADD265]], [[TMP0]]
+; CHECK-NEXT:    [[XOR819:%.*]] = xor i32 [[AND816]], [[XOR261]]
+; CHECK-NEXT:    [[AND21610:%.*]] = and i32 [[TMP3]], [[ADD80]]
+; CHECK-NEXT:    [[AND8361:%.*]] = xor i32 [[AND21610]], 1
+; CHECK-NEXT:    [[ADD842:%.*]] = or i32 [[XOR819]], [[AND8361]]
+; CHECK-NEXT:    [[XOR22011:%.*]] = xor i32 [[AND]], [[AND219]]
+; CHECK-NEXT:    [[XOR778:%.*]] = xor i32 [[TMP0]], [[AND21610]]
+; CHECK-NEXT:    [[ADD779:%.*]] = or i32 [[XOR22011]], [[XOR778]]
+; CHECK-NEXT:    [[ADD903:%.*]] = or i32 [[ADD842]], [[ADD779]]
+; CHECK-NEXT:    store i32 [[ADD903]], ptr [[THIS_ADDR]], align 4
+; CHECK-NEXT:    ret ptr null
+;
+entry:
+  %State = getelementptr i8, ptr %this, i64 64
+  %2 = load i32, ptr %State, align 4
+  store i32 0, ptr %this.addr, align 4
+  %and219 = and i32 %2, 1
+  %3 = load i32, ptr %this, align 4
+  %and = and i32 %0, %1
+  %add80 = or i32 %and, 1
+  %xor261 = xor i32 %and, 1
+  %add265 = add i32 %xor261, 1
+  %and816 = and i32 %add265, %0
+  %xor819 = xor i32 %and816, %xor261
+  %and21610 = and i32 %3, %add80
+  %and8361 = xor i32 %and21610, 1
+  %add842 = or i32 %xor819, %and8361
+  %xor22011 = xor i32 %and, %and219
+  %xor778 = xor i32 %0, %and21610
+  %add779 = or i32 %xor22011, %xor778
+  %add903 = or i32 %add842, %add779
+  store i32 %add903, ptr %this.addr, align 4
+  ret ptr null
+}


        


More information about the llvm-commits mailing list