]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commitdiff
llama : use LLM_KV for quantization_version & file_type (#24802)
authorAdrien Gallouët <redacted>
Sat, 20 Jun 2026 18:07:01 +0000 (20:07 +0200)
committerGitHub <redacted>
Sat, 20 Jun 2026 18:07:01 +0000 (20:07 +0200)
Signed-off-by: Adrien Gallouët <redacted>
src/llama-quant.cpp

index cf92ce4bb8b7b222f088d11cb5375e0fed4b88bc..89b7fe8d4301897b30c7e1d94711811ab18c3f6e 100644 (file)
@@ -932,8 +932,8 @@ static void llama_model_quantize_impl(const std::string & fname_inp, const std::
 
     // copy the KV pairs from the input file
     gguf_set_kv     (ctx_out.get(), ml.metadata);
-    gguf_set_val_u32(ctx_out.get(), "general.quantization_version", GGML_QNT_VERSION); // TODO: use LLM_KV
-    gguf_set_val_u32(ctx_out.get(), "general.file_type", ftype); // TODO: use LLM_KV
+    gguf_set_val_u32(ctx_out.get(), ml.llm_kv(LLM_KV_GENERAL_QUANTIZATION_VERSION).c_str(), GGML_QNT_VERSION);
+    gguf_set_val_u32(ctx_out.get(), ml.llm_kv(LLM_KV_GENERAL_FILE_TYPE).c_str(), ftype);
 
     // Remove split metadata
     gguf_remove_key(ctx_out.get(), ml.llm_kv(LLM_KV_SPLIT_NO).c_str());