koboldcpp/tools/server
Concedo 82e15c08bf Merge branch 'upstream' into concedo_experimental
# Conflicts:
#	docs/backend/SYCL.md
#	docs/backend/snapdragon/developer.md
#	examples/convert-llama2c-to-ggml/convert-llama2c-to-ggml.cpp
#	examples/sycl/run-llama2.sh
#	examples/sycl/start-svr.sh
#	examples/sycl/test.sh
#	examples/sycl/win-run-llama2.bat
#	examples/sycl/win-start-svr.bat
#	examples/sycl/win-test.bat
#	ggml/CMakeLists.txt
#	ggml/src/ggml-et/et-kernels/src/ssm_scan_f32.c
#	ggml/src/ggml-et/ggml-et-ops.cpp
#	ggml/src/ggml-et/ggml-et-ops.h
#	ggml/src/ggml-sycl/ssm_scan.cpp
#	ggml/src/ggml-webgpu/ggml-webgpu.cpp
#	ggml/src/ggml-webgpu/wgsl-shaders/ssm_scan.wgsl
#	scripts/bench-models.sh
#	scripts/snapdragon/adb/run-bench.sh
#	scripts/snapdragon/adb/run-cli.sh
#	scripts/snapdragon/adb/run-completion.sh
#	scripts/snapdragon/adb/run-mtmd.sh
#	scripts/snapdragon/windows/run-bench.ps1
#	scripts/snapdragon/windows/run-cli.ps1
#	scripts/snapdragon/windows/run-completion.ps1
#	scripts/snapdragon/windows/run-mtmd.ps1
#	scripts/sync-ggml.last
#	scripts/sync_vendor.py
#	tests/CMakeLists.txt
#	tests/test-backend-ops.cpp
#	tests/test-chat.cpp
#	tests/test-jinja.cpp
#	tests/test-llama-archs.cpp
#	tools/cli/README.md
#	tools/completion/README.md
#	tools/llama-bench/README.md
#	tools/server/README.md
2026-08-15 22:50:04 +08:00
..
bench Merge branch 'upstream' into concedo_experimental 2026-06-16 17:55:04 +08:00
tests Merge branch 'upstream' into concedo_experimental 2026-08-14 18:10:18 +08:00
main.cpp app : introduce the llama unified executable (#23296) 2026-05-20 13:22:22 +02:00
README-dev.md server: add more tool isolation support (ssh remote + podman rootless) (#26774) 2026-08-10 13:31:09 +02:00
server-chat.cpp server: support "reasoning_effort": "none" in OAI API (#26045) 2026-07-24 19:19:10 +02:00
server-chat.h server: (router) Forward form-data to model server (Fixes #22044) (#22118) 2026-04-27 23:55:00 +02:00
server-common.cpp chat : pass reasoning_effort to template 2026-08-14 13:23:11 -05:00
server-common.h server: refactor + correctness fixes for metrics (#26920) 2026-08-13 10:02:01 +02:00
server-context.cpp server: allow accessing /metrics and /slots during llama_decode() (#27041) 2026-08-14 13:23:10 +02:00
server-context.h llama : add llama_model_ftype_name() (#25134) 2026-07-02 17:26:47 +02:00
server-cors-proxy.h common,server: handle bracketed IPv6 literals in URL authority (#25140) 2026-06-30 16:16:44 +02:00
server-http.cpp server : serve index.html with no-cache (#27006) 2026-08-13 16:59:45 +02:00
server-http.h server: refactor server_stream (#25541) 2026-07-11 12:41:47 +02:00
server-mcp.cpp common: add subproc.h wrapper, disabled on android/ios (#26102) 2026-07-26 20:54:25 +02:00
server-mcp.h server: support MCP stdio (#26062) 2026-07-26 01:08:49 +02:00
server-models.cpp server: (router) add LRU scheduler (#26572) 2026-08-07 14:46:53 +02:00
server-models.h server: (router) add LRU scheduler (#26572) 2026-08-07 14:46:53 +02:00
server-queue.cpp server: allow accessing /metrics and /slots during llama_decode() (#27041) 2026-08-14 13:23:10 +02:00
server-queue.h server: allow accessing /metrics and /slots during llama_decode() (#27041) 2026-08-14 13:23:10 +02:00
server-schema.cpp server : clarify comment in eval_llama_cmpl_schema [no ci] [no release] (#26720) 2026-08-07 15:39:33 +02:00
server-schema.h sampler : remove "full-context windows" from history-based samplers (#26524) 2026-08-04 21:28:55 +03:00
server-stream.cpp server + ui: fix stream routes for model names containing a slash (#26137) 2026-07-27 07:34:47 +02:00
server-stream.h server + ui: fix stream routes for model names containing a slash (#26137) 2026-07-27 07:34:47 +02:00
server-task.cpp server: refactor + correctness fixes for metrics (#26920) 2026-08-13 10:02:01 +02:00
server-task.h server: refactor + correctness fixes for metrics (#26920) 2026-08-13 10:02:01 +02:00
server-tools.cpp ui: add read_media tool (#25877) 2026-08-12 12:03:32 +02:00
server-tools.h server: add more tool isolation support (ssh remote + podman rootless) (#26774) 2026-08-10 13:31:09 +02:00
server.cpp server: add more tool isolation support (ssh remote + podman rootless) (#26774) 2026-08-10 13:31:09 +02:00
ui.cpp can build llama server now 2026-06-14 15:06:37 +08:00
ui.h can build llama server now 2026-06-14 15:06:37 +08:00