]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commitdiff
server: Expose build_info in router mode (#21835)
authorGaspard Petit <redacted>
Mon, 13 Apr 2026 09:14:42 +0000 (05:14 -0400)
committerGitHub <redacted>
Mon, 13 Apr 2026 09:14:42 +0000 (11:14 +0200)
tools/server/server-models.cpp
tools/server/tests/unit/test_router.py

index c4ef62d2ea89d08e70fe20d1993ceba52e7312bb..5667c98ef8a233f5ca367606ab513e88139eb38c 100644 (file)
@@ -926,7 +926,8 @@ void server_models_routes::init_routes() {
             res_ok(res, {
                 // TODO: add support for this on web UI
                 {"role",          "router"},
-                {"max_instances", 4}, // dummy value for testing
+                {"max_instances", params.models_max},
+                {"models_autoload", params.models_autoload},
                 // this is a dummy response to make sure webui doesn't break
                 {"model_alias", "llama-server"},
                 {"model_path",  "none"},
@@ -935,6 +936,7 @@ void server_models_routes::init_routes() {
                     {"n_ctx",  0},
                 }},
                 {"webui_settings", webui_settings},
+                {"build_info",     build_info},
             });
             return res;
         }
index 717007a446d2bb01b38c7736f2799707447dfbe9..79e60db40830c6ab9458ca9c73504841c5f50705 100644 (file)
@@ -9,6 +9,19 @@ def create_server():
     server = ServerPreset.router()
 
 
+def test_router_props():
+    global server
+    server.models_max = 2
+    server.no_models_autoload = True
+    server.start()
+    res = server.make_request("GET", "/props")
+    assert res.status_code == 200
+    assert res.body["role"] == "router"
+    assert res.body["max_instances"] == 2
+    assert res.body["models_autoload"] is False
+    assert res.body["build_info"].startswith("b")
+
+
 @pytest.mark.parametrize(
     "model,success",
     [