]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
Add arch support for cohere2-MoE (#24260)
authorMichael Wand <redacted>
Sat, 13 Jun 2026 17:49:00 +0000 (10:49 -0700)
committerGitHub <redacted>
Sat, 13 Jun 2026 17:49:00 +0000 (19:49 +0200)
commit4988f6e866057afd130c1515ecef0c9bab9a15f8
tree97c854a834b63fb5cca6e76ad6a5248ce90ade19
parentf05cf4676af46c2f017c0e6ba25b6e20204f700e
Add arch support for cohere2-MoE (#24260)

* Add arch support for cohere2-MoE

* Removed redundant gating_func checks

* Changed ffn lookup to prefer prefix_dense_intermediate_size

* Renamed arch to cohere2moe

* Removed redundant lmhead check and chat template changes

* Removed lm_head.weight check from modify tensors, load output tensor not required, fallback to token_embd.weight

* Changed to (routed+shared)*0.5 for shared expert combined avg

* fixed sliding_window_pattern issue and pattern

* Fixed transformers crash 'first_k_dense_replace' error

* Remove comment

* Removed cohere2-moe as a tokenizer type and kept as tiny_aya.  Renamed North-Mini-Code-1.0.

* Fixed MTP fail, changed to use iSWA

* Fixed remaining todos: cohere2moe renamed, changed swa parsing to use get_key_or_arr, removed extra get_arr use

* Force metadata usage

Co-authored-by: Sigbjørn Skjæret <redacted>
* Remove Cohere2 checkpoint comment

Co-authored-by: Sigbjørn Skjæret <redacted>
* Remove MTP comment

Co-authored-by: Sigbjørn Skjæret <redacted>
* Regenerate cohere2moe tokenizer hash

* Add cohere2moe to Llama Model Saver supported list

* Check for zerobios tensors and add support for Command to use LayerNorm

* Map expert_selection_fn to sigmoid in base.py instead of command.py

* use bools for foundnorm/foundnormrms

Co-authored-by: Sigbjørn Skjæret <redacted>
---------

Co-authored-by: Sigbjørn Skjæret <redacted>
13 files changed:
conversion/__init__.py
conversion/base.py
conversion/command_r.py
convert_hf_to_gguf_update.py
gguf-py/gguf/constants.py
src/llama-arch.cpp
src/llama-arch.h
src/llama-model-saver.cpp
src/llama-model.cpp
src/models/cohere2.cpp
src/models/cohere2moe.cpp [new file with mode: 0644]
src/models/models.h
tests/test-llama-archs.cpp