[clang] [llvm] [AMDGPU] Track tensor load/store DMAs with asyncmark (PR #200775)
Krzysztof Drewniak via cfe-commits
cfe-commits at lists.llvm.org
Wed Jun 3 08:46:04 PDT 2026
================
@@ -50,6 +50,19 @@ memory and LDS memory.
void @llvm.amdgcn.global.store.async.from.lds.type(ptr %dst, ptr %src)
void @llvm.amdgcn.cluster.load.async.to.lds.type(ptr %dst, ptr %src)
+**GFX1250 Tensor DMA Instructions**
+
+.. code-block:: llvm
+
+ void @llvm.amdgcn.tensor.load.to.lds(...)
----------------
krzysz00 wrote:
Ok, I can see an argument for sticking `.async` in the name just to reduce user confusion, but that's also some solid bikeshedding
https://github.com/llvm/llvm-project/pull/200775
More information about the cfe-commits
mailing list