From: Georgi Gerganov Date: Tue, 4 Aug 2026 13:56:49 +0000 (+0300) Subject: models : fix dflash wo_a reshape on load (#26577) X-Git-Tag: upstream/0.0.10438~169 X-Git-Url: https://git.djapps.eu/?a=commitdiff_plain;h=1c3c9674de4d455f1e571bed808252af54932767;p=pkg%2Fggml%2Fsources%2Fllama.cpp models : fix dflash wo_a reshape on load (#26577) --- diff --git a/src/models/dflash.cpp b/src/models/dflash.cpp index 6c82ab3da..daff6e78f 100644 --- a/src/models/dflash.cpp +++ b/src/models/dflash.cpp @@ -125,7 +125,7 @@ void llama_model_dflash::load_arch_tensors(llama_model_loader &) { layer.wq_b = create_tensor(tn(LLM_TENSOR_ATTN_Q_B, "weight", i), {q_lora_rank, n_head * n_embd_head}, 0); layer.wkv = create_tensor(tn(LLM_TENSOR_ATTN_KV, "weight", i), {n_embd, n_embd_head}, 0); layer.attn_kv_norm = create_tensor(tn(LLM_TENSOR_ATTN_KV_NORM, "weight", i), {n_embd_head}, 0); - layer.wo_a = create_tensor(tn(LLM_TENSOR_ATTN_OUT_A, "weight", i), {n_head * n_embd_head / o_groups, o_lora_rank * o_groups}, 0); + layer.wo_a = create_tensor(tn(LLM_TENSOR_ATTN_OUT_A, "weight", i), {n_head * n_embd_head / o_groups, o_lora_rank, o_groups}, TENSOR_ALLOW_RESHAPE); layer.wo_b = create_tensor(tn(LLM_TENSOR_ATTN_OUT_B, "weight", i), {o_groups * o_lora_rank, n_embd}, 0); layer.hc_attn_fn = create_tensor(tn(LLM_TENSOR_HC_ATTN_FN, "weight", i), {hc_dim, hc_mix_dim}, 0);