]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
vulkan: add iq4_nl support back to FA (#24585)
authorJeff Bolz <redacted>
Tue, 28 Jul 2026 12:06:03 +0000 (13:06 +0100)
committerGitHub <redacted>
Tue, 28 Jul 2026 12:06:03 +0000 (07:06 -0500)
commit81616410050cb5d8b733b39863807f4852591d8a
tree7ee9b6ddddbaa2d67ae43ec5128bf2844a45086e
parentb62b3509813dd3169663885975c2306e96df2242
vulkan: add iq4_nl support back to FA (#24585)

* vulkan: add iq4_nl support back to FA

I was originally concerned about wasting shared memory on the LUT, but it's small
and unlikely to matter in practice.

Also support q1_0 for non-coopmat2.

Fixes #23681

* remove q1_0 FA support
ggml/src/ggml-vulkan/ggml-vulkan.cpp
ggml/src/ggml-vulkan/vulkan-shaders/flash_attn.comp
ggml/src/ggml-vulkan/vulkan-shaders/flash_attn_base.glsl
ggml/src/ggml-vulkan/vulkan-shaders/flash_attn_cm1.comp
ggml/src/ggml-vulkan/vulkan-shaders/flash_attn_cm2.comp
ggml/src/ggml-vulkan/vulkan-shaders/flash_attn_dequant.glsl
ggml/src/ggml-vulkan/vulkan-shaders/vulkan-shaders-gen.cpp