]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
model: add Mellum architecture (#23966)
authorMikhail Podvitskii <redacted>
Tue, 2 Jun 2026 19:11:12 +0000 (21:11 +0200)
committerGitHub <redacted>
Tue, 2 Jun 2026 19:11:12 +0000 (22:11 +0300)
commit4fb16eccce5e451b40014355f97374d692480a4d
tree215d2e4086e198f4097e2af4b2e5fd791e7d3d1c
parentbfb4308b058b334c6e68085c661ec9eb7e3d59f4
model: add Mellum architecture (#23966)

* model: support for Mellum architecture

* model: improve mellum.py formatting

* model: improve mellum.py formatting once again

* deps: downgrade transformers to 4.57.6 (to fix CI)

* deps: remove huggingface_hub dependency

* deps: remove huggingface_hub from test requirements

---------

Co-authored-by: Sigbjørn Skjæret <redacted>
20 files changed:
README.md
conversion/__init__.py
conversion/base.py
conversion/mellum.py [new file with mode: 0644]
convert_hf_to_gguf_update.py
gguf-py/gguf/constants.py
pyproject.toml
requirements/requirements-convert_legacy_llama.txt
requirements/requirements-tool_bench.txt
src/llama-arch.cpp
src/llama-arch.h
src/llama-model-saver.cpp
src/llama-model.cpp
src/llama-model.h
src/llama-vocab.cpp
src/llama-vocab.h
src/models/mellum.cpp [new file with mode: 0644]
src/models/models.h
tests/test-llama-archs.cpp
tools/server/tests/requirements.txt