]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
hparams : refactor `hparams.n_layer` (#24060)
authorGeorgi Gerganov <redacted>
Fri, 5 Jun 2026 08:09:36 +0000 (11:09 +0300)
committerGitHub <redacted>
Fri, 5 Jun 2026 08:09:36 +0000 (11:09 +0300)
commit7acb4e8cd2ce21f457d1298e75fad729520d263c
tree5a77024ea13397365f3be1610bee5573b0c42f1f
parent3ecfb150a4bd2d92b2a7974bb1af954c8a5e2985
hparams : refactor `hparams.n_layer` (#24060)

* hparams : refactor hparams.n_layer

* cont : remove `n_layer_kv()`, use n_layer_all instead

* cont : type consistency

* pi : update SYSTEM.md

* models : fix Step3.5 MTP

* cont : remove duplicate switch cases

* cont : explicitly set `false` to extra layers for `is_swa` and `is_recr`

* cont : fix nextn layer count handling

Co-authored-by: Sigbjørn Skjæret <redacted>
---------

Co-authored-by: Sigbjørn Skjæret <redacted>
129 files changed:
.pi/gg/SYSTEM.md
src/llama-adapter.cpp
src/llama-context.cpp
src/llama-graph.cpp
src/llama-hparams.cpp
src/llama-hparams.h
src/llama-kv-cache.cpp
src/llama-memory-recurrent.cpp
src/llama-model-loader.cpp
src/llama-model-saver.cpp
src/llama-model.cpp
src/llama-model.h
src/llama-quant.cpp
src/models/afmoe.cpp
src/models/apertus.cpp
src/models/arcee.cpp
src/models/arctic.cpp
src/models/arwkv7.cpp
src/models/baichuan.cpp
src/models/bailingmoe.cpp
src/models/bailingmoe2.cpp
src/models/bert.cpp
src/models/bitnet.cpp
src/models/bloom.cpp
src/models/chameleon.cpp
src/models/chatglm.cpp
src/models/codeshell.cpp
src/models/cogvlm.cpp
src/models/cohere2.cpp
src/models/command-r.cpp
src/models/dbrx.cpp
src/models/deci.cpp
src/models/deepseek2.cpp
src/models/deepseek2ocr.cpp
src/models/deepseek32.cpp
src/models/dots1.cpp
src/models/dream.cpp
src/models/ernie4-5.cpp
src/models/eurobert.cpp
src/models/exaone-moe.cpp
src/models/exaone.cpp
src/models/exaone4.cpp
src/models/falcon-h1.cpp
src/models/falcon.cpp
src/models/gemma-embedding.cpp
src/models/gemma.cpp
src/models/gemma2.cpp
src/models/gemma3.cpp
src/models/gemma3n.cpp
src/models/gemma4.cpp
src/models/glm-dsa.cpp
src/models/glm4-moe.cpp
src/models/glm4.cpp
src/models/gpt2.cpp
src/models/gptneox.cpp
src/models/granite-hybrid.cpp
src/models/granite-moe.cpp
src/models/granite.cpp
src/models/grok.cpp
src/models/grovemoe.cpp
src/models/hunyuan-moe.cpp
src/models/internlm2.cpp
src/models/jais.cpp
src/models/jais2.cpp
src/models/jamba.cpp
src/models/jina-bert-v2.cpp
src/models/jina-bert-v3.cpp
src/models/kimi-linear.cpp
src/models/lfm2.cpp
src/models/lfm2moe.cpp
src/models/llada-moe.cpp
src/models/llada.cpp
src/models/llama.cpp
src/models/llama4.cpp
src/models/maincoder.cpp
src/models/mamba.cpp
src/models/mamba2.cpp
src/models/mellum.cpp
src/models/mimo2.cpp
src/models/minicpm.cpp
src/models/minicpm3.cpp
src/models/minimax-m2.cpp
src/models/mistral3.cpp
src/models/modern-bert.cpp
src/models/mpt.cpp
src/models/nemotron-h.cpp
src/models/nemotron.cpp
src/models/neo-bert.cpp
src/models/nomic-bert-moe.cpp
src/models/nomic-bert.cpp
src/models/olmo.cpp
src/models/olmo2.cpp
src/models/olmoe.cpp
src/models/openai-moe.cpp
src/models/openelm.cpp
src/models/orion.cpp
src/models/pangu-embed.cpp
src/models/phi2.cpp
src/models/phi3.cpp
src/models/phimoe.cpp
src/models/plamo.cpp
src/models/plamo2.cpp
src/models/plamo3.cpp
src/models/plm.cpp
src/models/qwen.cpp
src/models/qwen2.cpp
src/models/qwen2moe.cpp
src/models/qwen3.cpp
src/models/qwen35.cpp
src/models/qwen35moe.cpp
src/models/qwen3moe.cpp
src/models/qwen3next.cpp
src/models/qwen3vl.cpp
src/models/qwen3vlmoe.cpp
src/models/refact.cpp
src/models/rnd1.cpp
src/models/rwkv6.cpp
src/models/rwkv6qwen2.cpp
src/models/rwkv7.cpp
src/models/seed-oss.cpp
src/models/smallthinker.cpp
src/models/smollm3.cpp
src/models/stablelm.cpp
src/models/starcoder.cpp
src/models/starcoder2.cpp
src/models/step35.cpp
src/models/t5.cpp
src/models/talkie.cpp
src/models/xverse.cpp