[llvm] [AMDGPU][True16][CodeGen] Do not fold hi16 SGPR copy (PR #220858)

Matt Arsenault via llvm-commits llvm-commits at lists.llvm.org
Sat Sep 5 09:59:02 PDT 2026


================
@@ -2215,7 +2215,8 @@ bool SIFoldOperandsImpl::tryFoldFoldableCopy(
       OpToFold.getSubReg()) {
     if (DstRC == &AMDGPU::SReg_32RegClass &&
         DstRC == MRI->getRegClass(OpToFold.getReg())) {
-      assert(OpToFold.getSubReg() == AMDGPU::lo16);
+      if (OpToFold.getSubReg() != AMDGPU::lo16)
+        return false;
----------------
arsenm wrote:

Instead of special casing this, can you check getSubClassWithSubReg or getMatchingSuperRegClass

https://github.com/llvm/llvm-project/pull/220858


More information about the llvm-commits mailing list