[clang] [llvm] [AMDGPU] Track tensor load/store DMAs with asyncmark (PR #200775)

Krzysztof Drewniak via cfe-commits cfe-commits at lists.llvm.org
Wed Jun 3 08:46:04 PDT 2026


================
@@ -50,6 +50,19 @@ memory and LDS memory.
   void @llvm.amdgcn.global.store.async.from.lds.type(ptr %dst, ptr %src)
   void @llvm.amdgcn.cluster.load.async.to.lds.type(ptr %dst, ptr %src)
 
+**GFX1250 Tensor DMA Instructions**
+
+.. code-block:: llvm
+
+  void @llvm.amdgcn.tensor.load.to.lds(...)
----------------
krzysz00 wrote:

Ok, I can see an argument for sticking `.async` in the name just to reduce user confusion, but that's also some solid bikeshedding

https://github.com/llvm/llvm-project/pull/200775


More information about the cfe-commits mailing list