[llvm] [AMDGPU] Fuse dword load + sign/zero-extension into subword load (PR #219019)

Jay Foad via llvm-commits llvm-commits at lists.llvm.org
Thu Aug 27 07:22:53 PDT 2026


jayfoad wrote:

> I tried implementing this earlier in AMDGPULowerKernelArguments.cpp, but I found that it inhibits fusing adjacent loads into a wider load.

So if a B8 load is adjacent to a B32 load, you still want them merged into a single B64 load? I guess that makes sense. I'm not sure what to suggest. Teach AMDGPULowerKernelArguments how to do its own merging without relying on SILoadStoreOptimizer? Teach SILoadStoreOptimizer how to merge adjacent loads with different sizes?

https://github.com/llvm/llvm-project/pull/219019


More information about the llvm-commits mailing list