]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commitdiff
cuda : disables launch_fattn PDL enrollment due to compiler bug (#23825)
authorAndreas Kieslinger <redacted>
Fri, 29 May 2026 04:46:10 +0000 (06:46 +0200)
committerGitHub <redacted>
Fri, 29 May 2026 04:46:10 +0000 (07:46 +0300)
ggml/src/ggml-cuda/fattn-common.cuh

index debcb6e5447828df416ce6ca1cd0ca9a528a0be9..d650b5fbd0f7cf61498dede4997db70588632c10 100644 (file)
@@ -1153,8 +1153,8 @@ void launch_fattn(
 
     GGML_ASSERT(block_dim.x % warp_size == 0);
 
-    const ggml_cuda_kernel_launch_params launch_params = ggml_cuda_kernel_launch_params(blocks_num, block_dim, nbytes_shared, main_stream);
-    ggml_cuda_kernel_launch(fattn_kernel, launch_params,
+        // disabled PDL enrollment for now due to a compiler bug.
+        fattn_kernel<<<blocks_num, block_dim, nbytes_shared, main_stream>>>(
         (const char *) Q->data,
         K_data,
         V_data,