]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
chat : pass reasoning_effort to template
authorAndy Williams <redacted>
Fri, 14 Aug 2026 18:23:11 +0000 (03:53 +0930)
committerGitHub <redacted>
Fri, 14 Aug 2026 18:23:11 +0000 (13:23 -0500)
commit7e4c0a96880dae4fc4268ad441f8a6446bd5460a
treebdd94e7604350d251efecfda41277bade52bb14d
parent9b05354ec6fb58b4e665e9a39ebc40285c015638
chat : pass reasoning_effort to template

* chat: add reasoning_effort to common_chat_templates_inputs

Store OpenAI Chat Completions reasoning_effort and make it
available to jinja templates (with model specific translations
where required).

Assisted-by: llama.cpp:Muse-Glimmer-30B
* server : fixup reading reasoning effort from body

server_chat_convert_responses_to_chatcmpl already handles conversion of
Responses API reasoning.effort to reasoning_effort

* chat : expose reasoning effort

Assisted-by: Claude Opus 5
* chat : add reasoning_effort to generation_params

Assisted-by: Claude Opus 5
* chat : move reasoning_effort next to enable_thinking

Assisted-by: Claude Opus 5
* cont : mirror preserve_reasoning

* cont : pass context through analyze function

---------

Co-authored-by: Alde Rojas <redacted>
common/arg.cpp
common/chat.cpp
common/jinja/caps.cpp
common/jinja/caps.h
tests/test-chat.cpp
tools/cli/README.md
tools/completion/README.md
tools/server/README.md
tools/server/server-common.cpp