]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
llama: add default load-mode auto, which avoids mmap on iGPUs (#26081)
authorRuben Ortlam <redacted>
Tue, 11 Aug 2026 06:20:46 +0000 (08:20 +0200)
committerGitHub <redacted>
Tue, 11 Aug 2026 06:20:46 +0000 (09:20 +0300)
commit153d324bcf86d220b235ca010eeb11213f32b5d1
treef34c7980beeeddf5776f0c96b55e78f620b02ff4
parentb3df57286c336255fd02c2162b0b5fe3adc2965e
llama: add default load-mode auto, which avoids mmap on iGPUs (#26081)

* llama: add new default load-mode auto which picks mmap unless a non-Metal iGPU is used

* Update ggml/src/ggml-hexagon/ggml-hexagon.cpp

Co-authored-by: Max Krasnyansky <redacted>
* set mmap_support to false on OpenCL backend

* fix order of load modes

* use -1 for auto

* resolve load mode auto earlier to correctly pick gpu host or cpu memory

* add load mode auto to llama-bench

* bump virtgpu api version, regenerate docs

---------

Co-authored-by: Piotr Wilkin (ilintar) <redacted>
Co-authored-by: Max Krasnyansky <redacted>
Co-authored-by: Georgi Gerganov <redacted>
33 files changed:
common/arg.cpp
common/common.h
ggml/include/ggml-backend.h
ggml/src/ggml-backend-meta.cpp
ggml/src/ggml-blas/ggml-blas.cpp
ggml/src/ggml-cann/ggml-cann.cpp
ggml/src/ggml-cpu/ggml-cpu.cpp
ggml/src/ggml-cuda/ggml-cuda.cu
ggml/src/ggml-et/ggml-et.cpp
ggml/src/ggml-hexagon/ggml-hexagon.cpp
ggml/src/ggml-metal/ggml-metal.cpp
ggml/src/ggml-opencl/ggml-opencl.cpp
ggml/src/ggml-openvino/ggml-openvino.cpp
ggml/src/ggml-rpc/ggml-rpc.cpp
ggml/src/ggml-sycl/ggml-sycl.cpp
ggml/src/ggml-virtgpu/backend/backend-dispatched-device.cpp
ggml/src/ggml-virtgpu/backend/shared/api_remoting.h
ggml/src/ggml-virtgpu/ggml-backend-buffer-type.cpp
ggml/src/ggml-virtgpu/ggml-backend-device.cpp
ggml/src/ggml-virtgpu/virtgpu-forward-device.cpp
ggml/src/ggml-virtgpu/virtgpu-forward.gen.h
ggml/src/ggml-vulkan/ggml-vulkan.cpp
ggml/src/ggml-webgpu/ggml-webgpu.cpp
ggml/src/ggml-zdnn/ggml-zdnn.cpp
ggml/src/ggml-zendnn/ggml-zendnn.cpp
include/llama.h
src/llama-model-loader.cpp
src/llama-model.cpp
src/llama.cpp
tools/cli/README.md
tools/completion/README.md
tools/llama-bench/llama-bench.cpp
tools/server/README.md