]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
llama : add Gemma4 MTP (#23398)
authorAman Gupta <redacted>
Sun, 7 Jun 2026 12:50:54 +0000 (20:50 +0800)
committerGitHub <redacted>
Sun, 7 Jun 2026 12:50:54 +0000 (20:50 +0800)
commit04eb4c446d22b63449d5dc41c038987d4d8cc3a6
treef1abba923a92e3480f5ad2db13e3ad0374d96c96
parent8a091c47abe67e0a03b85bc7c9eee8bdb9b14b05
llama : add Gemma4 MTP (#23398)
31 files changed:
common/speculative.cpp
conversion/__init__.py
conversion/gemma.py
gguf-py/gguf/constants.py
gguf-py/gguf/tensor_mapping.py
include/llama.h
src/llama-arch.cpp
src/llama-arch.h
src/llama-context.cpp
src/llama-context.h
src/llama-cparams.h
src/llama-ext.h
src/llama-graph.cpp
src/llama-graph.h
src/llama-hparams.cpp
src/llama-hparams.h
src/llama-kv-cache-dsa.cpp
src/llama-kv-cache-iswa.cpp
src/llama-kv-cache-iswa.h
src/llama-kv-cache.cpp
src/llama-kv-cache.h
src/llama-memory-hybrid-iswa.cpp
src/llama-memory-hybrid.cpp
src/llama-memory.h
src/llama-model.cpp
src/llama-model.h
src/models/gemma4-assistant.cpp [new file with mode: 0644]
src/models/gemma4.cpp
src/models/models.h
tests/test-llama-archs.cpp
tools/server/server-context.cpp