]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
model: Add Mimo v2.5 model support (#22493)
authorAesSedai <redacted>
Thu, 7 May 2026 11:21:58 +0000 (04:21 -0700)
committerGitHub <redacted>
Thu, 7 May 2026 11:21:58 +0000 (13:21 +0200)
commit8e52631d55636029ad437985ed8c14ff80ab8714
tree0dddfe5860fc79dfa06d35e73ae8d820fb80dcfd
parentf4b5a2ee91dfe7ed48e7f0b553c66051736cc62a
model: Add Mimo v2.5 model support (#22493)

* add mimo-v2.5 support

* mimo-v2.5: fix modify_tensors row split

* mimi-v2.5: forgot `add_attn_value_scale` plumbing

* mimi-v2.5: fix tp dequant to detect tp rows

* mimo-v2.5: fix TP iteration to be descending

* mimo-v2.5: fix comment

* mimo-v2.5: retain fused qkv

* mimo-v2.5: missed the attn_value scale during merge

* mimo-v2.5: fused QKV needs contiguous for scaling attention value

* mimo-v2.5: move `speech_embeddings.` to TextModel filter_tensors

* Update src/llama-hparams.h

Co-authored-by: Sigbjørn Skjæret <redacted>
* Update src/models/mimo2.cpp

Co-authored-by: Sigbjørn Skjæret <redacted>
* Update src/models/mimo2.cpp

Co-authored-by: Sigbjørn Skjæret <redacted>
* Update convert_hf_to_gguf.py

Co-authored-by: Sigbjørn Skjæret <redacted>
* Update convert_hf_to_gguf.py

Co-authored-by: Sigbjørn Skjæret <redacted>
* Update src/models/mimo2.cpp

Co-authored-by: Sigbjørn Skjæret <redacted>
* mimo-v2.5: include MTP weights in gguf

---------

Co-authored-by: Sigbjørn Skjæret <redacted>
convert_hf_to_gguf.py
gguf-py/gguf/constants.py
gguf-py/gguf/gguf_writer.py
src/llama-arch.cpp
src/llama-arch.h
src/llama-hparams.h
src/llama-model-saver.cpp
src/llama-model.cpp
src/models/mimo2.cpp