]> git.djapps.eu Git - pkg/ggml/sources/whisper.cpp/commit
ggml-webgpu: add Q1_0 support (llama/22374)
authorRithik Sharma <redacted>
Mon, 27 Apr 2026 22:50:59 +0000 (15:50 -0700)
committerGeorgi Gerganov <redacted>
Thu, 30 Apr 2026 08:29:21 +0000 (11:29 +0300)
commit9c233f11f09c0ea3d7d8df0056c3c312ef9248f3
treeb123af95b7febf62624a91b5cfaedb38251fade1
parentf675a8c9264682c720ae0d3b7badb06227065cc3
ggml-webgpu: add Q1_0 support (llama/22374)

* add fast matmul matvec q1_0 kernel

* ggml-webgpu: drop redundant zero-fills in Q1_0 shmem init
ggml/src/ggml-webgpu/ggml-webgpu-shader-lib.hpp
ggml/src/ggml-webgpu/ggml-webgpu.cpp
ggml/src/ggml-webgpu/wgsl-shaders/get_rows.wgsl
ggml/src/ggml-webgpu/wgsl-shaders/mul_mat_decls.tmpl
ggml/src/ggml-webgpu/wgsl-shaders/mul_mat_vec.wgsl