]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
docs: fix metrics endpoint description in server README (#22879)
authorwilljoha <redacted>
Mon, 11 May 2026 16:32:26 +0000 (18:32 +0200)
committerGitHub <redacted>
Mon, 11 May 2026 16:32:26 +0000 (18:32 +0200)
commitef22b3e4ac9444d1dca1c44164861e0317b5579d
tree213d0e634a338c125a5f749c068fa2570a8bd96c
parent68e7ea3eabef29a3e222681c81e0cc7ed070c09d
docs: fix metrics endpoint description in server README (#22879)

* docs: fix metrics endpoint description in server README

Required model query parameter for router mode described.

Removed metrics:
- llamacpp:kv_cache_usage_ratio
- llamacpp:kv_cache_tokens

Added metrics:
- llamacpp:prompt_seconds_total
- llamacpp:tokens_predicted_seconds_total
- llamacpp:n_decode_total
- llamacpp:n_busy_slots_per_decode

* server: fix metrics type for n_busy_slots_per_decode metric
tools/server/README.md
tools/server/server-context.cpp