]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commitdiff
opencl: q8_0 gemv precision improvement (#24923)
authorShawn Gu <redacted>
Tue, 23 Jun 2026 05:25:21 +0000 (22:25 -0700)
committerGitHub <redacted>
Tue, 23 Jun 2026 05:25:21 +0000 (22:25 -0700)
ggml/src/ggml-opencl/kernels/gemv_noshuffle_q8_0_f32.cl

index 9703b693e567a89aaabd1dfc14e6774072a35938..f5c6fb3e8437a867e0357d303473be8c6af06ebb 100644 (file)
@@ -174,7 +174,7 @@ __kernel void kernel_gemv_noshuffle_q8_0_f32(
         regA.s6 = read_imageui(src0_q, (gid + k * BLOCK_STRIDE_A + LINE_STRIDE_A * 6)).x;
         regA.s7 = read_imageui(src0_q, (gid + k * BLOCK_STRIDE_A + LINE_STRIDE_A * 7)).x;
 
-        dequantizeBlockAccum_ns_sgbroadcast_1(totalSum, regA, regS, regB);
+        dequantizeBlockAccum_ns_sgbroadcast_1(totalSum, regA, convert_float(regS), regB);
     }
 
     // reduction in local memory, assumes #wave=4