mirror of
https://github.com/LostRuins/koboldcpp.git
synced 2026-08-27 17:29:52 +00:00
tests : disable DOTS3NOTE arch test for WebGPU (#27654)
python-type-check.yml #443 -Commit
7584430716
pushed by
vrr
opencl: make the MoE expert scatter deterministic (#26464)
update-ops-docs.yml #442 -Commit
9ee9fc04c1
pushed by
vrr
opencl: make the MoE expert scatter deterministic (#26464)
python-type-check.yml #441 -Commit
9ee9fc04c1
pushed by
vrr
opencl: make the MoE expert scatter deterministic (#26464)
pre-tokenizer-hashes.yml #440 -Commit
9ee9fc04c1
pushed by
vrr
vendor: update BoringSSL to 0.20260813.0 (#27099)
python-type-check.yml #439 -Commit
adb55e5148
pushed by
vrr
mtmd: fix Granite4 Vision image sequence assembly (#26653)
python-type-check.yml #438 -Commit
9d57ce456c
pushed by
vrr
tests : replace personal home directory paths with generic placeholders (#27043)
python-type-check.yml #437 -Commit
885c5bbe8e
pushed by
vrr
ui: add read_media tool (#25877)
python-type-check.yml #436 -Commit
4dd127584b
pushed by
vrr
ui: add read_media tool (#25877)
python-check-requirements.yml #435 -Commit
4dd127584b
pushed by
vrr
ui: add read_media tool (#25877)
pre-tokenizer-hashes.yml #434 -Commit
4dd127584b
pushed by
vrr
llama: add default load-mode auto, which avoids mmap on iGPUs (#26081)
python-type-check.yml #433 -Commit
153d324bcf
pushed by
vrr
ggml-cpu : fix CPU affinity mask being ignored on Android (#26838)
python-type-check.yml #432 -Commit
d2f83055d6
pushed by
vrr
tts: account for the vocoder pass in the timings line (#26733)
update-ops-docs.yml #431 -Commit
3653e6d6d5
pushed by
vrr
tts: account for the vocoder pass in the timings line (#26733)
python-type-check.yml #430 -Commit
3653e6d6d5
pushed by
vrr
server: fix empty response for /cors-proxy (#26656)
update-ops-docs.yml #429 -Commit
6a32c29a74
pushed by
vrr
server: fix empty response for /cors-proxy (#26656)
python-type-check.yml #428 -Commit
6a32c29a74
pushed by
vrr
server: fix empty response for /cors-proxy (#26656)
python-check-requirements.yml #427 -Commit
6a32c29a74
pushed by
vrr
server: correct accepted tokens when need draft token replay (#26320)
python-type-check.yml #426 -Commit
000547513f
pushed by
vrr
fit : count nextn (MTP) blocks in n_gpu_layers so front layers stay on GPU (#26177)
python-type-check.yml #425 -Commit
0324696b8e
pushed by
vrr
fit : count nextn (MTP) blocks in n_gpu_layers so front layers stay on GPU (#26177)
pre-tokenizer-hashes.yml #424 -Commit
0324696b8e
pushed by
vrr
opencl: cache compiled cl_program binaries on disk (#26050)
update-ops-docs.yml #423 -Commit
ed7adbfefd
pushed by
vrr
opencl: cache compiled cl_program binaries on disk (#26050)
python-type-check.yml #422 -Commit
ed7adbfefd
pushed by
vrr
opencl: cache compiled cl_program binaries on disk (#26050)
python-check-requirements.yml #421 -Commit
ed7adbfefd
pushed by
vrr
opencl: cache compiled cl_program binaries on disk (#26050)
pre-tokenizer-hashes.yml #420 -Commit
ed7adbfefd
pushed by
vrr
opencl: load and use `kernel_gemm_moe_q6_k_f32_ns` from bin kernel lib (#25797)
python-type-check.yml #419 -Commit
86a9c79f86
pushed by
vrr
DeepseekV4: reduce graph splits (#25702)
update-ops-docs.yml #418 -Commit
33a75f41c3
pushed by
vrr
DeepseekV4: reduce graph splits (#25702)
python-type-check.yml #417 -Commit
33a75f41c3
pushed by
vrr
DeepseekV4: reduce graph splits (#25702)
python-check-requirements.yml #416 -Commit
33a75f41c3
pushed by
vrr
DeepseekV4: reduce graph splits (#25702)
pre-tokenizer-hashes.yml #415 -Commit
33a75f41c3
pushed by
vrr
tests: Harmonize header use (#25616)
python-type-check.yml #414 -Commit
f4253ef965
pushed by
vrr