]> git.djapps.eu Git - pkg/ggml/sources/llama.cpp/shortlog
pkg/ggml/sources/llama.cpp
2026-05-31 o7sivocab : add tokenizer support for jina-embeddings-v2...
2026-05-31 Eric Zhangui: fix ETag truncation with MSVC compiler (#23917)
2026-05-31 Vladislavdocs : update ZenDNN docs for Q8 support (#23791)
2026-05-31 Ruben Ortlamllama: only use one iGPU device by default (#23897)
2026-05-30 Pascalwebui: add custom CSS injection via config (#23904)
2026-05-30 Gaurav GargSupport `-fa auto` in llama-bench (#23714)
2026-05-30 lhezopencl: support bf16 by converting to f16 (#23839)
2026-05-30 Pascalui: exclude generated build dirs from prettier and...
2026-05-30 Johannes GäßlerTP: fix granularity for Qwen 3.5/3.6 + 3 GPUs (#23843)
2026-05-30 Georgi Gerganovmetal : restore im2col implementation for large kernels...
2026-05-30 Xuan-Son Nguyentest: (test-llama-archs) log the config name first...
2026-05-30 Georgi Gerganovci : update ios-xcode release job to macos-26 (#23906)
2026-05-30 Jinyang Heggml : add some lsx support (#23798)
2026-05-30 Ruben Ortlamvulkan: add Flash Attention support for BFloat16 KV...
2026-05-30 Georgi Gerganovci : fix s390x release job (#23898)
2026-05-30 Georgi Gerganovci : clear cache instead of "no timestamp" keys + fix...
2026-05-30 Radoslav Gerganovllama : do not skip iGPU when only RPC devices are...
2026-05-29 Xuan-Son Nguyenserver: in SSE mode, send HTTP headers when slot starts...
2026-05-29 Reese Levineggml-webgpu: Check earlier for WebGPU required features...
2026-05-29 Reese Levineggml-webgpu: add q4_0/q8_0 SET_ROWS (#23760)
2026-05-29 Ruixiang Wangserver-bench : add speed-bench for speculative decoding...
2026-05-29 Pascalapp: add llama update self updater (#23865)
2026-05-29 ValdikSSui: handle audio/vnd.wave as audio WAV file (#23754)
2026-05-29 Tarek Dakhranvocab : support tokenizer for LFM2.5-8B-A1B (#23826)
2026-05-29 Sigbjørn Skjæretgraph : ensure DS32 kq_mask_lid is F32 (#23864)
2026-05-29 Xuan-Son Nguyenserver: remove obsolete scripts (#23870)
2026-05-29 Georgi Gerganovci : update macos release to use macos-26 runner (...
2026-05-29 Xuan-Son Nguyendownload: add option to skip_download (#23059)
2026-05-29 Saba Fallahmtmd: Add DeepSeekOCR 2 Support (#20975)
2026-05-29 Oliver SimonsCUDA: Check PTX version on host side to guard PDL dispa...
2026-05-29 Xuan-Son Nguyenserver: bump timeout to 3600s (#23842)
2026-05-29 fairydreamingmodel : support for DeepseekV32ForCausalLM with generic...
2026-05-29 Aman Guptallama: use f16 mask for FA to save VRAM (#23764)
2026-05-29 Georgi Gerganovsync : ggml
2026-05-29 Georgi Gerganovggml : bump version to 0.13.1 (ggml/1523)
2026-05-29 Omid Azizingram-mod : Add missing include (#23857)
2026-05-29 Aman Guptallama: add llm_graph_input_mtp (#23643)
2026-05-29 Adrien Gallouëtapp : move licences to llama-app (#23824)
2026-05-29 Andreas Kieslingercuda : disables launch_fattn PDL enrollment due to...
2026-05-29 Matt Corallometa : Add missing `buffer` set in allreduce fallback...
2026-05-28 Max Krasnyanskyhexagon: basic/generic op fusion support and RMS_NORM...
2026-05-28 Xuan-Son Nguyenmtmd-debug: add color and rainbow mode (#23829)
2026-05-28 Xuan-Son Nguyenmtmd: fix gemma 4 projector pre_norm (#23822)
2026-05-28 lhezopencl: move backend info printing into its own functio...
2026-05-28 Sigbjørn Skjæretci : run ui publish on ubuntu-slim (#23818)
2026-05-28 ValdikSSui: fix audio and video modality detection (#23756)
2026-05-28 Georgi Gerganovci : releases use Github-hosted builds for the UI ...
2026-05-28 Adrien Gallouëtapp : improve help output (#23805)
2026-05-28 Saba Fallahmtmd: n_head_kv defaults to n_head (#23782)
2026-05-28 Xuan-Son Nguyenmtmd: fix gemma 4 audio rms norm eps (#23815)
2026-05-28 Georgi Gerganovci : change Vulkan builds to Release to reduce ccache...
2026-05-28 Mikolaj Kucharskiarg: Add LLAMA_ARG_API_KEY_FILE environment variable...
2026-05-28 Johannes Gäßlertest-llama-archs: fix table format [no release] (#23810)
2026-05-28 fl0rianrggml: auto apply iGPU flag CUDA/HIP if integrated devic...
2026-05-28 redfoxmmvq Optim: add MMVQ_PARAMETERS_TURING(mmvq_parameter_...
2026-05-28 Jaden_MachCUDA: route batch>=4 quantized matmul to MMQ on AMD...
2026-05-28 Funtowicz Morganserver: minor tweaks to use more cpp features (#23785)
2026-05-28 Max Krasnyanskyhexagon: minor refresh for HMX FA and MM (#23796)
2026-05-28 Jeff Bolzvulkan: fast path for walsh-hadamard transform (#23687)
2026-05-28 Jesus Talaverachat : add Granite 4.1 chat template (#23518)
2026-05-28 Winston Mavulkan: fix wrong index variable in inner loop (#23665)
2026-05-28 Winston Mavulkan: Fix memory logger unsafe iterator access (...
2026-05-28 Markus Tavenrathserver, ui : Add support for HTTP ETags in llama-server...
2026-05-28 Sachin Sharmadocker : add ZenDNN Dockerfile (#23716)
2026-05-28 fairydreamingcuda : fix KQ mask offset integer overflow in fattn...
2026-05-28 Adrien Gallouëtperplexity : fix format specifier in LOG_ERR (#23788)
2026-05-28 ynankaniconvert : add FP8 to Q8 conversion (#23250)
2026-05-28 Martin Klacerggml: fixed Arm SVE usage bug in vec.h, vec.cpp (#22841)
2026-05-28 Georgi Gerganovci : refactor (#23789)
2026-05-28 ymckiHexagon: OP_GATED_DELTA_NET K>1 support (#23531)
2026-05-28 ymckiopencl: OP_GATED_DELTA_NET (#23312)
2026-05-27 Reese Levineggml-webgpu: remove legacy constants (#23672)
2026-05-27 Max Krasnyanskyhexagon: add support for Q4_1 in MUL_MAT and MUL_MAT_ID...
2026-05-27 Masashi Yoshimuraggml-webgpu: Fix how to dispatch WG to some ops (#23750)
2026-05-27 Matt Corallovulkan: Switch MUL_MAT_VEC to 4 K per iteration for...
2026-05-27 Jeff Bolzvulkan: use GL_NV_cooperative_matrix_decode_vector...
2026-05-27 l8bloomvulkan: add REPEAT op support for f16 to f16. (#23298)
2026-05-27 Georgi Gerganovci : move ARM jobs to self-hosted + disable kleidiai...
2026-05-27 Alessandro... vendor : update cpp-httplib to 0.46.0 (#23650)
2026-05-27 Sigbjørn Skjæretpyproject : add conversion folder and update dependenci...
2026-05-27 Oliver SimonsCUDA: restrict PDL to CTK >= 12.3 due to MSVC issues...
2026-05-27 Sigbjørn Skjæretci : bump cuda release to 13.3 (#23749)
2026-05-27 Georgi Gerganovcommon : fix env names to all have LLAMA_ARG_ prefix...
2026-05-27 Georgi Gerganovci : fix windows ccaches (#23777)
2026-05-27 Sigbjørn Skjæretci : remove wasm test (#23733)
2026-05-27 Winston Mavulkan: avoid preferring transfer queue on AMD UMA...
2026-05-27 Georgi Gerganovci : add ccache to server builds + fix undefined saniti...
2026-05-27 quyentonndbsdocs : fix duplicated "the" in granitevision and model...
2026-05-27 zhangtao2-1convert: add MiniCPM5 tokenizer support (#23384)
2026-05-27 Radoslav Gerganovserver : fix the log message when using SSL (#23393)
2026-05-26 Vladislavggml-zendnn : fixed naming of matmul function (#20964)
2026-05-26 Georgi Gerganovci : do not allocate ccache for 3rd-party hosted runner...
2026-05-26 Georgi Gerganovci : move [no release] check to dedicated check_release...
2026-05-26 Georgi Gerganovci : add `[no release]` keyword + fix sanitizer builds...
2026-05-26 Georgi Gerganovci : move macos jobs to the apple workflow + fix names...
2026-05-26 Jeff Bolzvulkan: optimize conv2d and implement coopmat1 support...
2026-05-26 Georgi Gerganovci : remove vulkan SDK dep from webgpu job (#23718)
2026-05-26 Max Krasnyanskyhexagon: add support for CONCAT op (#23648)
2026-05-26 Georgi Gerganovci : move more CPU jobs to self-hosted runners (#23715)
2026-05-26 Georgi Gerganovci : move sanitizer jobs to self-hosted runners (#23713)
next