]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
Add Q2_0 quantization: type definition and CPU backend (#24448)
authorPasha Khosravi <redacted>
Tue, 7 Jul 2026 19:05:47 +0000 (12:05 -0700)
committerGitHub <redacted>
Tue, 7 Jul 2026 19:05:47 +0000 (12:05 -0700)
commitbec4772f6a2527d371557b5d2032641e5ff7619c
tree0499d58a1a5408ffbfd29991b59475c71a52d3a7
parentc198af4dc24f8e0ab8a569a60f931e03a192fd79
Add Q2_0 quantization: type definition and CPU backend (#24448)
17 files changed:
ggml/include/ggml.h
ggml/src/ggml-common.h
ggml/src/ggml-cpu/arch-fallback.h
ggml/src/ggml-cpu/arch/arm/quants.c
ggml/src/ggml-cpu/ggml-cpu.c
ggml/src/ggml-cpu/ops.cpp
ggml/src/ggml-cpu/quants.c
ggml/src/ggml-cpu/quants.h
ggml/src/ggml-quants.c
ggml/src/ggml-quants.h
ggml/src/ggml.c
gguf-py/gguf/constants.py
include/llama.h
src/llama-model-loader.cpp
src/llama-quant.cpp
tests/test-quantize-fns.cpp
tools/quantize/quantize.cpp