]> git.djapps.eu Git - pkg/ggml/sources/whisper.cpp/shortlog
pkg/ggml/sources/whisper.cpp
2026-04-30 Zijun Yuopenvino: driver setup, CI split, thread safety, and...
2026-04-30 Georgi Gerganovmetal : workaround macOS GPU interactivity watchdog...
2026-04-30 Jeff Bolzvulkan: Support F16 OP_FILL (llama/22177)
2026-04-30 Georgi Gerganovggml : bump version to 0.10.0 (ggml/1463)
2026-04-30 leonardHONGggml-cuda: flush legacy pool on OOM and retry (llama...
2026-04-30 Gaurav GargTensor-parallel: Fix delayed AllReduce on Gemma-4 MoE...
2026-04-30 Johannes GäßlerTP: fix 0-sized tensor slices, AllReduce fallback ...
2026-04-30 pl752ggml-cpu: Optimized x86 and generic cpu q1_0 dot (follo...
2026-04-30 neha-haggml-webgpu: updated matrix-vector multiplication ...
2026-04-30 KatostrofikFix reorder MMVQ assert on unaligned vocab sizes (llama...
2026-04-30 Johannes GäßlerCUDA: refactor mma data loading for AMD (llama/22051)
2026-04-30 uvosHIP: Remove unesscary NCCL_CHECK (llama/21914)
2026-04-30 Gaurav Gargggml : reduce CPU overhead in meta backend (llama/22041)
2026-04-30 texasichcmake: remove CMP0194 policy to restore MSVC builds...
2026-04-30 Radoslav Gerganovrpc : refactor the RPC transport (llama/21998)
2026-04-30 SamareshSinghggml-backend-meta: add multi-segment read support in...
2026-04-30 Reese Levineggml-webgpu: fix compiler warnings and refactor FlashAt...
2026-04-30 Aman GuptaCUDA: use LRU based eviction for cuda graphs (llama...
2026-04-30 lhezopencl: refactor q8_0 set_tensor and mul_mat host side...
2026-04-30 nullnamehexagon: optimize HMX matmul operations (llama/21071)
2026-04-30 shaofeiqiopencl: add q5_K gemm and gemv kernels for Adreno ...
2026-04-30 Aman Guptaggml: add graph_reused (llama/21764)
2026-04-30 Kusha Gharahimetal: Implement ROLL op (llama/21946)
2026-04-30 rehan-10xengineerggml-cpu: add 128-bit RVV implementation for Quantizati...
2026-04-30 rehan-10xengineerggml : implemented simd_gemm kernel for riscv vector...
2026-04-30 Reese Levineggml-webgpu: compute pass batching and removing profili...
2026-04-30 KatostrofikFix Q8_0 reorder: garbage on 2nd prompt + crash on...
2026-04-30 Ruben Ortlamvulkan: optimize im2col (llama/21713)
2026-04-30 Pasha Khosravicuda: Q1_0 initial backend (llama/21629)
2026-04-30 Reese Levineggml-webgpu: Fix dequantization helpers to not pass...
2026-04-30 Johannes GäßlerCUDA: require explicit opt-in for P2P access (llama...
2026-04-30 Johannes GäßlerCUDA: manage NCCL communicators in context (llama/21891)
2026-04-30 Valeriy Dubovrpc : add native RDMA transport for RPC backend (RoCEv2...
2026-04-30 Xuan-Son Nguyendocs: more extensive RoPE documentation [no ci] (llama...
2026-04-30 Yiwei Shaohexagon: optimization for HMX mat_mul (llama/21554)
2026-04-30 Xuan-Son Nguyenggml : remove ggml-ext.h (llama/21869)
2026-04-30 Georgi Gerganovmetal : fix FA support logic (llama/21898)
2026-04-30 Jeff Bolzvulkan: Programmatically add RoundingModeRTE to all...
2026-04-30 Georgi Gerganovci : re-enable mac workflows (llama/21894)
2026-04-30 Seyoung Jeongmetal : add XIELU unary op (llama/20802)
2026-04-30 Richard Davisonggml : fix ARM NEON nvfp4 dot product on non-dotprod...
2026-04-30 texasichcmake: fix CMP0194 warning on Windows with MSVC (llama...
2026-04-30 Reese Levineggml-webgpu: Update register tiling matmul to use f32...
2026-04-30 Jeff Bolzvulkan: Support GGML_TYPE_NVFP4 (llama/21455)
2026-04-30 Ruben Ortlamvulkan: Flash Attention DP4A shader for quantized KV...
2026-04-30 Oliver SimonsCUDA: Limit DeviceSegmentedSort to immediate mode ...
2026-04-30 Masashi YoshimuraRemove extra conditional check on debug mode. (llama...
2026-04-30 Akarshan Biswassycl: disable Q1_0 in backend and cleanup unused variab...
2026-04-30 Stephen Coxmtmd: add Gemma 4 audio conformer encoder support ...
2026-04-30 Johannes GäßlerCUDA: skip compilation of superfluous FA kernels (llama...
2026-04-30 shaofeiqiopencl: add basic support for q5_k (llama/21593)
2026-04-30 Sigbjørn Skjæretggml : fix a few instances of missing GGML_TYPE_Q1_0...
2026-04-30 Aman GuptaCUDA: also store node->src ne/nb for graph equality...
2026-04-30 Max Krasnyanskyhexagon: improved Op queuing, buffer and cache manageme...
2026-04-30 Rithik Sharmaggml-webgpu: support non-square subgroup matrix configs...
2026-04-30 Chen Yuanggml-webgpu: address quantization precision and backend...
2026-04-30 Jeff Bolzvulkan: Support Q1_0 (llama/21539)
2026-04-30 Aman GuptaCUDA: fuse muls (llama/21665)
2026-04-30 andyluo7HIP: add CDNA4 (gfx950) architecture support for MI350X...
2026-04-30 Johannes Gäßlerggml: backend-agnostic tensor parallelism (experimental...
2026-04-30 fairydreamingggml : check return value of CUB calls used in argsort...
2026-04-30 Georgi Gerganovmetal : add missing mm-id specializations for q1_0...
2026-04-30 Akarshan Biswassycl : add flash-attn support for head size 512 (llama...
2026-04-30 Ruben Ortlamvulkan: unify type macros to use Vx instead of _VECx...
2026-04-30 Aman GuptaCUDA: also store `node->src->data` ptrs for equality...
2026-04-30 RealOrkofix: free ctx_copy in ggml_opt_free to plug per-trainin...
2026-04-30 Reese Levinewebgpu : Query for adapter support when registering...
2026-04-30 Pasha Khosravimetal: Q1_0 backend (llama/21528)
2026-04-30 Aman GuptaCUDA: make cuda graphs props check faster (llama/21472)
2026-04-30 iacopPBKggml-cuda: ds_read_b128 for q4_0 and q4_1 mmq kernels...
2026-04-30 Reese Levineggml-webgpu: parameterize submission size and add iOS...
2026-04-30 Aman GuptaCUDA: check for buffer overlap before fusing (llama...
2026-04-30 Georgi Gerganovggml : deprecate GGML_OP_ADD1 (llama/21363)
2026-04-30 Tom Overlundggml: Vulkan build, Linux -- output error string for...
2026-04-30 mkokervulkan: add FA dequant for q4_1, q5_0, q5_1, iq4_nl...
2026-04-30 Antoine Viallonggml-cuda : fix CDNA2 compute capability constant for...
2026-04-30 PMZFXAdd Q8_0 reorder optimization (~3x tg speedup on Intel...
2026-04-30 Masashi Yoshimuraggml-webgpu: Add the support of `MUL_MAT_ID` (llama...
2026-04-30 Pasha Khosraviggml: add Q1_0 1-bit quantization support (CPU) (llama...
2026-04-30 Gaurav GargWrite an optimized flash_attn_stream_k_fixup kernel...
2026-04-30 Neo Zhangsycl : handle other FA case (llama/21377)
2026-04-30 Yarden Talhexagon: slight optimization for argosrt output init...
2026-04-30 Reese Levineggml-webgpu: move from parameter buffer pool to single...
2026-04-30 Vishal Singhggml-zendnn : add MUL_MAT_ID op support for MoE models...
2026-04-30 Radoslav Gerganovrpc : reuse compute graph buffers (llama/21299)
2026-04-30 Zheyuan Chenggml-webgpu: add vectorized flash attention (llama...
2026-04-30 Neo Zhangsycl : fix llama_kv_cache hang when kv_cache is huge...
2026-04-30 Georgi Gerganovggml : bump version to 0.9.11 (ggml/1456)
2026-04-30 Todor Boinovskihexagon : add cumsum op support (llama/21246)
2026-04-30 lhezopencl: fix leak in Adreno q8_0 path (llama/21212)
2026-04-30 Johannes GäßlerCUDA: fix FA kernel selection logic (llama/21271)
2026-04-30 Aparna M Phexagon: improve RMS_NORM and DIV accuracy (llama/21251)
2026-04-30 Neo Zhangsycl : support nvfp4 type in mul_mat (llama/21227)
2026-04-30 Michael Wandggml-cuda: Add generic NVFP4 MMQ kernel (llama/21074)
2026-04-30 Georgi Gerganovggml : bump version to 0.9.10 (ggml/1454)
2026-04-30 uvosCUDA/HIP: Fix kernel slection for mmvq mmid kernel...
2026-04-30 Georgi Gerganovggml : fix RWKV ops thread assignment (llama/21226)
2026-04-30 Taimur Ahmadggml-cpu: fix fallback for RVV kernels without zvfh...
2026-04-30 Anav PrasadCUDA: Add Flash Attention Support for Head Dimension...
2026-04-30 Reese Levineggml webgpu: quantized buffers to u32 + wider browser...
next