]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/commit
ggml-cpu/ops: vectorize flash-attention V-cache F16 to F32 conversion (#26947)
authorjinzihao <redacted>
Thu, 13 Aug 2026 09:04:46 +0000 (17:04 +0800)
committerGitHub <redacted>
Thu, 13 Aug 2026 09:04:46 +0000 (12:04 +0300)
commiteeae28b67e94cbce01f016576803509dbad11d09
tree5c57cb7810d5da41742b0f29b8ab40c19ec0cb5d
parent154d57af3eec0ae309a7efbc644cc47774f58d70
ggml-cpu/ops: vectorize flash-attention V-cache F16 to F32 conversion (#26947)

Co-authored-by: jinzihao <redacted>
ggml/src/ggml-cpu/ops.cpp