KernelOPT: Dispatch-Aware Agentic Search for GPU Kernel Optimization
#Triton #CUDA #DeepLearning #LLM
hgpu.org?p=31275
hgpu.org
KernelOPT: Dispatch-Aware Agentic Search for GPU Kernel Optimization
Deep learning inference and training performance depends critically on GPU kernel efficiency. Modern compilers such as PyTorch Inductor automatically generate GPU kernels from high-level model code…