[llvm] X86: Emit adox instead of adc for overflow add (PR #216609)

via llvm-commits llvm-commits at lists.llvm.org
Sun Aug 16 15:39:57 PDT 2026


https://github.com/AZero13 updated https://github.com/llvm/llvm-project/pull/216609

>From f9d375acd81c77cc1094ca569cb149343dd5b03e Mon Sep 17 00:00:00 2001
From: AZero13 <gfunni234 at gmail.com>
Date: Sun, 16 Aug 2026 18:07:16 -0400
Subject: [PATCH 1/2] [X86] Precommit adox.ll test

---
 llvm/test/CodeGen/X86/adox.ll | 146 ++++++++++++++++++++++++++++++++++
 1 file changed, 146 insertions(+)
 create mode 100644 llvm/test/CodeGen/X86/adox.ll

diff --git a/llvm/test/CodeGen/X86/adox.ll b/llvm/test/CodeGen/X86/adox.ll
new file mode 100644
index 0000000000000..8db269dddba62
--- /dev/null
+++ b/llvm/test/CodeGen/X86/adox.ll
@@ -0,0 +1,146 @@
+; NOTE: Assertions have been autogenerated by utils/update_llc_test_checks.py
+; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mattr=+adx | FileCheck %s --check-prefixes=CHECK,ADX
+; RUN: llc < %s -mtriple=x86_64-unknown-unknown -mattr=-adx | FileCheck %s --check-prefixes=CHECK,NOADX
+
+define i32 @adox_test_i32(i32 %a, i32 %b, i8 %c, i8 %d) {
+; ADX-LABEL: adox_test_i32:
+; ADX:       # %bb.0:
+; ADX-NEXT:    # kill: def $esi killed $esi def $rsi
+; ADX-NEXT:    # kill: def $edi killed $edi def $rdi
+; ADX-NEXT:    leal (%rdi,%rsi), %eax
+; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    cmpb %cl, %dl
+; ADX-NEXT:    adoxl %esi, %eax
+; ADX-NEXT:    retq
+;
+; NOADX-LABEL: adox_test_i32:
+; NOADX:       # %bb.0:
+; NOADX-NEXT:    # kill: def $esi killed $esi def $rsi
+; NOADX-NEXT:    # kill: def $edi killed $edi def $rdi
+; NOADX-NEXT:    xorl %eax, %eax
+; NOADX-NEXT:    cmpb %cl, %dl
+; NOADX-NEXT:    seto %al
+; NOADX-NEXT:    addl %edi, %eax
+; NOADX-NEXT:    addl %esi, %eax
+; NOADX-NEXT:    retq
+  %ssub = call { i8, i1 } @llvm.ssub.with.overflow.i8(i8 %c, i8 %d)
+  %ov = extractvalue { i8, i1 } %ssub, 1
+  %ov.ext = zext i1 %ov to i32
+  %sum = add i32 %a, %b
+  %res = add i32 %sum, %ov.ext
+  ret i32 %res
+}
+
+define i64 @adox_test_i64(i64 %a, i64 %b, i8 %c, i8 %d) {
+; ADX-LABEL: adox_test_i64:
+; ADX:       # %bb.0:
+; ADX-NEXT:    leaq (%rdi,%rsi), %rax
+; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    cmpb %cl, %dl
+; ADX-NEXT:    adoxq %rsi, %rax
+; ADX-NEXT:    retq
+;
+; NOADX-LABEL: adox_test_i64:
+; NOADX:       # %bb.0:
+; NOADX-NEXT:    xorl %eax, %eax
+; NOADX-NEXT:    cmpb %cl, %dl
+; NOADX-NEXT:    seto %al
+; NOADX-NEXT:    addq %rdi, %rax
+; NOADX-NEXT:    addq %rsi, %rax
+; NOADX-NEXT:    retq
+  %ssub = call { i8, i1 } @llvm.ssub.with.overflow.i8(i8 %c, i8 %d)
+  %ov = extractvalue { i8, i1 } %ssub, 1
+  %ov.ext = zext i1 %ov to i64
+  %sum = add i64 %a, %b
+  %res = add i64 %sum, %ov.ext
+  ret i64 %res
+}
+
+declare { i8, i1 } @llvm.ssub.with.overflow.i8(i8, i8)
+
+define i32 @adox_test_i32_mem(i32 %a, ptr %b_ptr, i8 %c, i8 %d) {
+; ADX-LABEL: adox_test_i32_mem:
+; ADX:       # %bb.0:
+; ADX-NEXT:    movl %edi, %eax
+; ADX-NEXT:    addl (%rsi), %eax
+; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    cmpb %cl, %dl
+; ADX-NEXT:    adoxl %esi, %eax
+; ADX-NEXT:    retq
+;
+; NOADX-LABEL: adox_test_i32_mem:
+; NOADX:       # %bb.0:
+; NOADX-NEXT:    xorl %eax, %eax
+; NOADX-NEXT:    cmpb %cl, %dl
+; NOADX-NEXT:    seto %al
+; NOADX-NEXT:    addl (%rsi), %edi
+; NOADX-NEXT:    addl %edi, %eax
+; NOADX-NEXT:    retq
+  %b = load i32, ptr %b_ptr
+  %ssub = call { i8, i1 } @llvm.ssub.with.overflow.i8(i8 %c, i8 %d)
+  %ov = extractvalue { i8, i1 } %ssub, 1
+  %ov.ext = zext i1 %ov to i32
+  %add = add i32 %a, %b
+  %add2 = add i32 %add, %ov.ext
+  ret i32 %add2
+}
+
+define i64 @adox_test_i64_mem(i64 %a, ptr %b_ptr, i8 %c, i8 %d) {
+; ADX-LABEL: adox_test_i64_mem:
+; ADX:       # %bb.0:
+; ADX-NEXT:    movq %rdi, %rax
+; ADX-NEXT:    addq (%rsi), %rax
+; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    cmpb %cl, %dl
+; ADX-NEXT:    adoxq %rsi, %rax
+; ADX-NEXT:    retq
+;
+; NOADX-LABEL: adox_test_i64_mem:
+; NOADX:       # %bb.0:
+; NOADX-NEXT:    xorl %eax, %eax
+; NOADX-NEXT:    cmpb %cl, %dl
+; NOADX-NEXT:    seto %al
+; NOADX-NEXT:    addq (%rsi), %rdi
+; NOADX-NEXT:    addq %rdi, %rax
+; NOADX-NEXT:    retq
+  %b = load i64, ptr %b_ptr
+  %ssub = call { i8, i1 } @llvm.ssub.with.overflow.i8(i8 %c, i8 %d)
+  %ov = extractvalue { i8, i1 } %ssub, 1
+  %ov.ext = zext i1 %ov to i64
+  %add = add i64 %a, %b
+  %add2 = add i64 %add, %ov.ext
+  ret i64 %add2
+}
+
+define i32 @adox_test_sadd_i32(i32 %a, i32 %b, i8 %c, i8 %d) {
+; ADX-LABEL: adox_test_sadd_i32:
+; ADX:       # %bb.0:
+; ADX-NEXT:    # kill: def $esi killed $esi def $rsi
+; ADX-NEXT:    # kill: def $edi killed $edi def $rdi
+; ADX-NEXT:    leal (%rdi,%rsi), %eax
+; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    addb %cl, %dl
+; ADX-NEXT:    adoxl %esi, %eax
+; ADX-NEXT:    retq
+;
+; NOADX-LABEL: adox_test_sadd_i32:
+; NOADX:       # %bb.0:
+; NOADX-NEXT:    # kill: def $esi killed $esi def $rsi
+; NOADX-NEXT:    # kill: def $edi killed $edi def $rdi
+; NOADX-NEXT:    xorl %eax, %eax
+; NOADX-NEXT:    addb %cl, %dl
+; NOADX-NEXT:    seto %al
+; NOADX-NEXT:    addl %edi, %eax
+; NOADX-NEXT:    addl %esi, %eax
+; NOADX-NEXT:    retq
+  %sadd = call { i8, i1 } @llvm.sadd.with.overflow.i8(i8 %c, i8 %d)
+  %ov = extractvalue { i8, i1 } %sadd, 1
+  %ov.ext = zext i1 %ov to i32
+  %add = add i32 %a, %b
+  %add2 = add i32 %add, %ov.ext
+  ret i32 %add2
+}
+
+declare { i8, i1 } @llvm.sadd.with.overflow.i8(i8, i8)
+;; NOTE: These prefixes are unused and the list is autogenerated. Do not add tests below this line:
+; CHECK: {{.*}}

>From 3ffb1d2aa7e760644a2d59659c713d28276da5e2 Mon Sep 17 00:00:00 2001
From: AZero13 <gfunni234 at gmail.com>
Date: Sun, 16 Aug 2026 18:16:27 -0400
Subject: [PATCH 2/2] X86: Emit adox instead of adc for overflow add

Fold ADOX(ADD(X,Y),0,OF) -> ADOX(X,Y,OF) like ADC
---
 llvm/lib/Target/X86/X86ISelLowering.cpp   | 37 +++++++++++++++++++++--
 llvm/lib/Target/X86/X86InstrArithmetic.td | 12 ++++++++
 llvm/lib/Target/X86/X86InstrFragments.td  |  1 +
 llvm/lib/Target/X86/X86InstrPredicates.td |  2 ++
 llvm/test/CodeGen/X86/adox.ll             | 21 +++----------
 5 files changed, 55 insertions(+), 18 deletions(-)

diff --git a/llvm/lib/Target/X86/X86ISelLowering.cpp b/llvm/lib/Target/X86/X86ISelLowering.cpp
index 0dc3340a13c73..a4217cdb8a085 100644
--- a/llvm/lib/Target/X86/X86ISelLowering.cpp
+++ b/llvm/lib/Target/X86/X86ISelLowering.cpp
@@ -25338,8 +25338,9 @@ static bool isX86LogicalCmp(SDValue Op) {
     return true;
   if (Op.getResNo() == 1 &&
       (Opc == X86ISD::ADD || Opc == X86ISD::SUB || Opc == X86ISD::ADC ||
-       Opc == X86ISD::SBB || Opc == X86ISD::SMUL || Opc == X86ISD::UMUL ||
-       Opc == X86ISD::OR || Opc == X86ISD::XOR || Opc == X86ISD::AND))
+       Opc == X86ISD::ADOX || Opc == X86ISD::SBB || Opc == X86ISD::SMUL ||
+       Opc == X86ISD::UMUL || Opc == X86ISD::OR || Opc == X86ISD::XOR ||
+       Opc == X86ISD::AND))
     return true;
 
   return false;
@@ -53535,6 +53536,13 @@ static SDValue combineAddOrSubToADCOrSBB(bool IsSub, const SDLoc &DL, EVT VT,
                        DAG.getConstant(0, DL, VT), EFLAGS);
   }
 
+  if (!IsSub && CC == X86::COND_O &&
+      DAG.getSubtarget<X86Subtarget>().hasADX()) {
+    // X + (overflow_from_OF ? 1 : 0) --> adox X, 0
+    return DAG.getNode(X86ISD::ADOX, DL, DAG.getVTList(VT, MVT::i32), X,
+                       DAG.getConstant(0, DL, VT), EFLAGS);
+  }
+
   if (ZeroSecondOpOnly)
     return SDValue();
 
@@ -59769,6 +59777,30 @@ static SDValue combineADC(SDNode *N, SelectionDAG &DAG,
   return SDValue();
 }
 
+// Optimize RES, EFLAGS = X86ISD::ADOX LHS, RHS, EFLAGS
+static SDValue combineADOX(SDNode *N, SelectionDAG &DAG) {
+  SDValue LHS = N->getOperand(0);
+  SDValue RHS = N->getOperand(1);
+  SDValue CarryIn = N->getOperand(2);
+  auto *LHSC = dyn_cast<ConstantSDNode>(LHS);
+  auto *RHSC = dyn_cast<ConstantSDNode>(RHS);
+
+  // Canonicalize constant to RHS.
+  if (LHSC && !RHSC)
+    return DAG.getNode(X86ISD::ADOX, SDLoc(N), N->getVTList(), RHS, LHS,
+                       CarryIn);
+
+  // Fold ADOX(ADD(X,Y),0,Carry) -> ADOX(X,Y,Carry)
+  // ISD::ADD produces no EFLAGS, so we only need to ensure the ADOX's own
+  // flag output is not needed before replacing it with a 2-operand ADOX.
+  if (LHS.getOpcode() == ISD::ADD && RHSC && RHSC->isZero() &&
+      !needCarryOrOverflowFlag(SDValue(N, 1)))
+    return DAG.getNode(X86ISD::ADOX, SDLoc(N), N->getVTList(),
+                       LHS.getOperand(0), LHS.getOperand(1), CarryIn);
+
+  return SDValue();
+}
+
 static SDValue matchPMADDWD(SelectionDAG &DAG, SDNode *N,
                             const SDLoc &DL, EVT VT,
                             const X86Subtarget &Subtarget) {
@@ -63454,6 +63486,7 @@ SDValue X86TargetLowering::PerformDAGCombine(SDNode *N,
   case X86ISD::CLOAD:
   case X86ISD::CSTORE:      return combineX86CloadCstore(N, DAG);
   case X86ISD::SBB:         return combineSBB(N, DAG);
+  case X86ISD::ADOX:        return combineADOX(N, DAG);
   case X86ISD::ADC:         return combineADC(N, DAG, DCI);
   case ISD::MUL:            return combineMul(N, DAG, DCI, Subtarget);
   case ISD::UDIV:
diff --git a/llvm/lib/Target/X86/X86InstrArithmetic.td b/llvm/lib/Target/X86/X86InstrArithmetic.td
index c91600525d1eb..12bf5d870d507 100644
--- a/llvm/lib/Target/X86/X86InstrArithmetic.td
+++ b/llvm/lib/Target/X86/X86InstrArithmetic.td
@@ -1493,3 +1493,15 @@ let Form = MRMSrcMem in {
     def ADOX64rm_ND : BinOpRMF_RF<0x66, "adox", Xi64, null_frag, 1>, XS;
   }
 }
+
+// ADOX patterns
+let Predicates = [HasADX] in {
+  def : Pat<(X86adox_flag GR32:$src1, GR32:$src2, EFLAGS),
+            (ADOX32rr GR32:$src1, GR32:$src2)>;
+  def : Pat<(X86adox_flag GR64:$src1, GR64:$src2, EFLAGS),
+            (ADOX64rr GR64:$src1, GR64:$src2)>;
+  def : Pat<(X86adox_flag GR32:$src1, (loadi32 addr:$src2), EFLAGS),
+            (ADOX32rm GR32:$src1, addr:$src2)>;
+  def : Pat<(X86adox_flag GR64:$src1, (loadi64 addr:$src2), EFLAGS),
+            (ADOX64rm GR64:$src1, addr:$src2)>;
+}
diff --git a/llvm/lib/Target/X86/X86InstrFragments.td b/llvm/lib/Target/X86/X86InstrFragments.td
index c183849d4f575..9e6048b93cb00 100644
--- a/llvm/lib/Target/X86/X86InstrFragments.td
+++ b/llvm/lib/Target/X86/X86InstrFragments.td
@@ -390,6 +390,7 @@ def X86smul_flag : SDNode<"X86ISD::SMUL", SDTBinaryArithWithFlags,
 def X86umul_flag : SDNode<"X86ISD::UMUL", SDTBinaryArithWithFlags,
                           [SDNPCommutative]>;
 def X86adc_flag  : SDNode<"X86ISD::ADC",  SDTBinaryArithWithFlagsInOut>;
+def X86adox_flag : SDNode<"X86ISD::ADOX", SDTBinaryArithWithFlagsInOut>;
 def X86sbb_flag  : SDNode<"X86ISD::SBB",  SDTBinaryArithWithFlagsInOut>;
 
 def X86or_flag   : SDNode<"X86ISD::OR",   SDTBinaryArithWithFlags,
diff --git a/llvm/lib/Target/X86/X86InstrPredicates.td b/llvm/lib/Target/X86/X86InstrPredicates.td
index fd03fa24a18c8..5c104d6c44101 100644
--- a/llvm/lib/Target/X86/X86InstrPredicates.td
+++ b/llvm/lib/Target/X86/X86InstrPredicates.td
@@ -269,3 +269,5 @@ def NotUseIndirectThunkCalls : Predicate<"!Subtarget->useIndirectThunkCalls()">;
 defvar X86_32 = DefaultMode;
 def X86_64 : HwMode<[In64BitMode, NotX32Mode]>;
 def X86_64_X32 : HwMode<[IsX32Mode]>;
+def HasADX : Predicate<"Subtarget->hasADX()">;
+
diff --git a/llvm/test/CodeGen/X86/adox.ll b/llvm/test/CodeGen/X86/adox.ll
index 8db269dddba62..9932604662ea6 100644
--- a/llvm/test/CodeGen/X86/adox.ll
+++ b/llvm/test/CodeGen/X86/adox.ll
@@ -5,10 +5,7 @@
 define i32 @adox_test_i32(i32 %a, i32 %b, i8 %c, i8 %d) {
 ; ADX-LABEL: adox_test_i32:
 ; ADX:       # %bb.0:
-; ADX-NEXT:    # kill: def $esi killed $esi def $rsi
-; ADX-NEXT:    # kill: def $edi killed $edi def $rdi
-; ADX-NEXT:    leal (%rdi,%rsi), %eax
-; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    movl %edi, %eax
 ; ADX-NEXT:    cmpb %cl, %dl
 ; ADX-NEXT:    adoxl %esi, %eax
 ; ADX-NEXT:    retq
@@ -34,8 +31,7 @@ define i32 @adox_test_i32(i32 %a, i32 %b, i8 %c, i8 %d) {
 define i64 @adox_test_i64(i64 %a, i64 %b, i8 %c, i8 %d) {
 ; ADX-LABEL: adox_test_i64:
 ; ADX:       # %bb.0:
-; ADX-NEXT:    leaq (%rdi,%rsi), %rax
-; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    movq %rdi, %rax
 ; ADX-NEXT:    cmpb %cl, %dl
 ; ADX-NEXT:    adoxq %rsi, %rax
 ; ADX-NEXT:    retq
@@ -62,10 +58,8 @@ define i32 @adox_test_i32_mem(i32 %a, ptr %b_ptr, i8 %c, i8 %d) {
 ; ADX-LABEL: adox_test_i32_mem:
 ; ADX:       # %bb.0:
 ; ADX-NEXT:    movl %edi, %eax
-; ADX-NEXT:    addl (%rsi), %eax
-; ADX-NEXT:    xorl %esi, %esi
 ; ADX-NEXT:    cmpb %cl, %dl
-; ADX-NEXT:    adoxl %esi, %eax
+; ADX-NEXT:    adoxl (%rsi), %eax
 ; ADX-NEXT:    retq
 ;
 ; NOADX-LABEL: adox_test_i32_mem:
@@ -89,10 +83,8 @@ define i64 @adox_test_i64_mem(i64 %a, ptr %b_ptr, i8 %c, i8 %d) {
 ; ADX-LABEL: adox_test_i64_mem:
 ; ADX:       # %bb.0:
 ; ADX-NEXT:    movq %rdi, %rax
-; ADX-NEXT:    addq (%rsi), %rax
-; ADX-NEXT:    xorl %esi, %esi
 ; ADX-NEXT:    cmpb %cl, %dl
-; ADX-NEXT:    adoxq %rsi, %rax
+; ADX-NEXT:    adoxq (%rsi), %rax
 ; ADX-NEXT:    retq
 ;
 ; NOADX-LABEL: adox_test_i64_mem:
@@ -115,10 +107,7 @@ define i64 @adox_test_i64_mem(i64 %a, ptr %b_ptr, i8 %c, i8 %d) {
 define i32 @adox_test_sadd_i32(i32 %a, i32 %b, i8 %c, i8 %d) {
 ; ADX-LABEL: adox_test_sadd_i32:
 ; ADX:       # %bb.0:
-; ADX-NEXT:    # kill: def $esi killed $esi def $rsi
-; ADX-NEXT:    # kill: def $edi killed $edi def $rdi
-; ADX-NEXT:    leal (%rdi,%rsi), %eax
-; ADX-NEXT:    xorl %esi, %esi
+; ADX-NEXT:    movl %edi, %eax
 ; ADX-NEXT:    addb %cl, %dl
 ; ADX-NEXT:    adoxl %esi, %eax
 ; ADX-NEXT:    retq



More information about the llvm-commits mailing list