summaryrefslogtreecommitdiff
path: root/llvm/test/Analysis/UniformityAnalysis
AgeCommit message (Expand)Author
2025-09-17[AMDGPU] Mark cluster_workgroup_id_* intrinsics always uniform (#159439)Stanislav Mekhanoshin
2025-09-10AMDGPU/UniformityAnalysis: fix G_ZEXTLOAD and G_SEXTLOAD (#157845)Petar Avramovic
2025-09-10AMDGPU: Add uniformity analysis test for G_ZEXTLOAD and G_SEXTLOAD (#157844)Petar Avramovic
2025-08-29[AMDGPU] Mark workitem IDs uniform in more cases (#152581)Krzysztof Drewniak
2025-08-28[Uniformity] Fix typo in assumed divergent cycles output (NFC) (#155750)Carl Ritson
2025-08-15Reapply "[AMDGPU] Intrinsic for launching whole wave functions" (#153584)Diana Picus
2025-08-06[AMDGPU] Mark address space cast from private to flat as divergent if target ...Shilei Tian
2025-08-04[AMDGPU] gfx1250 v_wmma_scale[16]_f32_16x16x128_f8f6f4 codegen (#152036)Stanislav Mekhanoshin
2025-08-01[AMDGPU] gfx1250 v_permlane_* instructions (#151749)Stanislav Mekhanoshin
2025-07-21AMDGPU: Support v_wmma_f32_16x16x128_f8f6f4 on gfx1250 (#149684)Changpeng Fang
2025-07-15AMDGPU: Remove a non-existent wmma instruction from gfx1250 (#148989)Changpeng Fang
2025-07-15AMDGPU: Support intrinsic selection for gfx1250 wmma instructions (#148957)Changpeng Fang
2025-06-29AMDGPU: Implement intrinsic/builtins for gfx1250 load transpose instructions ...Changpeng Fang
2025-05-29[Uniformity] Fixed control-div early stop (#139667)Junjie Gu
2025-05-08[AMDGPU] Add missing intrinsic declaration to intrinsics.ll. NFC. (#138954)Stanislav Mekhanoshin
2025-04-30[CodeGen] Port MachineUniformityAnalysis to new pass manager (#137578)paperchalice
2025-02-26[AMDGPU] Do not allow M0 as v_readfirstlane_b32 dst (#128851)Pierre van Houtryve
2025-02-20[AMDGPU] Add llvm.amdgcn.dead intrinsic (#123190)Diana Picus
2025-01-24MachineUniformityAnalysis: Improve isConstantOrUndefValuePhi (#112866)Petar Avramovic
2025-01-07[NVPTX] Switch front-ends and tests to ptx_kernel cc (#120806)Alex MacLean
2024-12-02AMDGPU: Allow f16/bf16 for DS_READ_TR16_B64 gfx950 builtins (#118297)Matt Arsenault
2024-11-25AMDGPU: Add support for load transpose instructions for gfx950 (#117378)Matt Arsenault
2024-11-22AMDGPU: Add v_permlane16_swap_b32 and v_permlane32_swap_b32 for gfx950 (#117260)Matt Arsenault
2024-11-22AMDGPU: Add v_smfmac_f32_32x32x64_fp8_fp8 for gfx950 (#117259)Matt Arsenault
2024-11-22AMDGPU: Add v_smfmac_f32_32x32x32x64_fp8_bf8 for gfx950 (#117258)Matt Arsenault
2024-11-22AMDGPU: Add v_smfmac_f32_32x32x64_bf8_fp8 for gfx950 (#117257)Matt Arsenault
2024-11-22AMDGPU: Add v_smfmac_f32_32x32x64_bf8_bf8 for gfx950 (#117256)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x128_fp8_fp8 for gfx950 (#117235)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x128_fp8_bf8 for gfx950 (#117234)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x128_bf8_fp8 for gfx950 (#117233)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x128_bf8_bf8 for gfx950 (#117232)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_i32_32x32x64_i8 for gfx950 (#117214)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x64_bf16 for gfx950 (#117211)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_32x32x32_f16 for gfx950 (#117205)Matt Arsenault
2024-11-21AMDGPU: Add v_smfmac_f32_16x16x64_f16 for gfx950 (#117202)Matt Arsenault
2024-11-21AMDGPU: Add v_mfma_f32_16x16x32_bf16 for gfx950 (#117053)Matt Arsenault
2024-11-21AMDGPU: Add v_mfma_i32_32x32x32_i8 for gfx950 (#117052)Matt Arsenault
2024-11-21AMDGPU: Add v_mfma_i32_16x16x64_i8 for gfx950 (#116728)Matt Arsenault
2024-11-21AMDGPU: Define v_mfma_f32_{16x16x128|32x32x64}_f8f6f4 instructions (#116723)Matt Arsenault
2024-11-18AMDGPU: Define v_mfma_f32_32x32x16_bf16 for gfx950 (#116679)Matt Arsenault
2024-11-18AMDGPU: Add first gfx950 mfma instructions (#116312)Matt Arsenault
2024-10-12[LLVM] New NoDivergenceSource function attribute (#111832)Tim Renouf
2024-09-27[AMDGPU] Overload resource descriptor in image intrinsics. (#107255)sstipano
2024-08-06AMDGPU: Add some leaf intrinsics to isAlwaysUniform (#101925)Matt Arsenault
2024-08-05[AMDGPU] Mark workgroup_id intrinsics always uniform (#102042)Stanislav Mekhanoshin
2024-07-18AMDGPU: Add back half and bfloat support for global_load_tr16 pats (#99540)Changpeng Fang
2024-06-26[AMDGPU] Extend permlane16, permlanex16 and permlane64 intrinsic lowering for...Vikram Hegde
2024-06-25[AMDGPU] Extend readlane, writelane and readfirstlane intrinsic lowering for ...Vikram Hegde
2024-06-18AMDGPU: Support local atomicrmw fmin/fmax for float/double (#95590)Matt Arsenault
2024-06-10[RFC][AMDGPU] Remove old llvm.amdgcn.buffer.* and tbuffer intrinsics (#93801)Jay Foad