[Mlir-commits] [clang] [llvm] [mlir] [clang][NVPTX][MLIR][NVVM] Add overloaded fadd intrinsics (PR #217336)

Durgadoss R llvmlistbot at llvm.org
Tue Aug 25 03:54:52 PDT 2026


================
@@ -7017,22 +7018,44 @@ static SDValue sinkProxyReg(SDValue R, SDValue Chain,
   }
 }
 
-static unsigned getF16SubOpc(Intrinsic::ID AddIntrinsicID) {
-  switch (AddIntrinsicID) {
+static unsigned getFAddWithNegOpcode(EVT VT, Intrinsic::ID IID,
+                                     APFloat::roundingMode RoundingMode) {
+  const bool IsFTZ = nvvm::FAddShouldFTZ(IID);
+  switch (VT.getScalarType().getSimpleVT().SimpleTy) {
+  case MVT::f16:
+    if (nvvm::FAddShouldSaturate(IID))
+      return IsFTZ ? NVPTXISD::SUB_RN_FTZ_SAT : NVPTXISD::SUB_RN_SAT;
+    return IsFTZ ? NVPTXISD::SUB_RN_FTZ : NVPTXISD::SUB_RN;
----------------
durga4github wrote:

optional: can a 2d array simplify this?
```
// [IsSat][IsFTZ] -> NVPTXISD opcode for f16
static const unsigned SubOpcF16[2][2] = {
      {NVPTXISD::SUB_RN,     NVPTXISD::SUB_RN_FTZ},
      {NVPTXISD::SUB_RN_SAT, NVPTXISD::SUB_RN_FTZ_SAT},
};
```


https://github.com/llvm/llvm-project/pull/217336


More information about the Mlir-commits mailing list