koboldcpp/tools
Concedo 3265983620 Merge commit '2fb989b9e7' into concedo_experimental
# Conflicts:
#	.github/actions/ccache-clear/action.yml
#	.github/workflows/build-cpu.yml
#	.github/workflows/make-release.yml
#	.github/workflows/release.yml
#	.pi/gg/SYSTEM.md
#	AGENTS.md
#	README.md
#	docs/build.md
#	ggml/src/ggml-opencl/CMakeLists.txt
#	ggml/src/ggml-opencl/ggml-opencl.cpp
#	ggml/src/ggml-opencl/kernels/moe_combine.cl
#	ggml/src/ggml-sycl/convert.cpp
#	ggml/src/ggml-sycl/dequantize.hpp
#	ggml/src/ggml-sycl/dmmv.cpp
#	ggml/src/ggml-sycl/esimd.hpp
#	ggml/src/ggml-sycl/ggml-sycl.cpp
#	ggml/src/ggml-sycl/mmvq.cpp
#	ggml/src/ggml-sycl/quants.hpp
#	ggml/src/ggml-sycl/vecdotq.hpp
#	src/CMakeLists.txt
#	tests/test-llama-archs.cpp
#	tools/llama-bench/llama-bench.cpp
#	tools/mtmd/CMakeLists.txt
2026-08-25 20:30:15 +08:00
..
batched-bench
cli mtmd: add --mmproj-device argument (#23255) 2026-08-20 18:45:37 +02:00
completion common: migrate the deprecated --mmap/--no-mmap to --load-mode (#26934) 2026-08-15 16:35:53 +08:00
fit-params fit: also take into account n_streams (#27496) 2026-08-22 16:16:06 +02:00
gguf-split Merge branch 'upstream' into concedo_experimental 2026-08-14 18:10:18 +08:00
llama-bench fit: also take into account n_streams (#27496) 2026-08-22 16:16:06 +02:00
mtmd Merge commit '2fb989b9e7' into concedo_experimental 2026-08-25 20:30:15 +08:00
parser chat : enable tool call in thinking for DS4 (#26269) 2026-08-01 00:13:07 -05:00
perplexity quant : Optimise memory usage by evicting weights after processing each layer (#22877) 2026-08-18 16:22:32 +02:00
quantize Merge branch 'upstream' into concedo_experimental 2026-08-14 18:10:18 +08:00
rpc
server Merge commit '2fb989b9e7' into concedo_experimental 2026-08-25 20:30:15 +08:00
tts Merge commit '873e5d8e39' into concedo_experimental 2026-08-24 21:15:18 +08:00
ui Merge commit '873e5d8e39' into concedo_experimental 2026-08-24 21:15:18 +08:00
kcpplauncherhook.py