koboldcpp/ggml
Robert Esclapez e1a1abb787
ggml-cuda: Allow transpose-free gemmv computation (#26171)
When matrix's weights are shaped 1xK is leverage a transpose-free
computation to use mat_mul_vec_f.
2026-07-30 21:39:46 +08:00
..
cmake ggml : Parallelize quant LUT init (#23595) 2026-05-25 10:15:46 +03:00
include RPC: add tensor_memset (#25912) 2026-07-29 15:04:30 +08:00
src ggml-cuda: Allow transpose-free gemmv computation (#26171) 2026-07-30 21:39:46 +08:00
.gitignore vulkan : cmake integration (#8119) 2024-07-13 18:12:39 +02:00
CMakeLists.txt ggml : bump version to 0.18.0 (ggml/1576) 2026-07-30 15:44:24 +03:00