koboldcpp/tools/server
Concedo 73cc7d9287 Merge branch 'upstream' into concedo_experimental
# Conflicts:
#	.devops/cann.Dockerfile
#	.devops/cpu.Dockerfile
#	.devops/cuda.Dockerfile
#	.devops/intel.Dockerfile
#	.devops/musa.Dockerfile
#	.devops/openvino.Dockerfile
#	.devops/rocm.Dockerfile
#	.devops/s390x.Dockerfile
#	.devops/vulkan.Dockerfile
#	.devops/zendnn.Dockerfile
#	.dockerignore
#	.pi/gg/SYSTEM.md
#	ggml/CMakeLists.txt
#	ggml/src/ggml-webgpu/ggml-webgpu.cpp
#	scripts/sync-ggml.last
#	scripts/sync_vendor.py
#	tools/cli/README.md
#	tools/cli/cli.cpp
#	tools/mtmd/clip.cpp
#	tools/server/README.md
2026-06-20 17:16:19 +08:00
..
bench Merge branch 'upstream' into concedo_experimental 2026-06-16 17:55:04 +08:00
tests Merge branch 'upstream' into concedo_experimental 2026-06-20 17:16:19 +08:00
main.cpp app : introduce the llama unified executable (#23296) 2026-05-20 13:22:22 +02:00
README-dev.md server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
server-chat.cpp Support for Codex CLI by skipping unsupported Responses tools (#23041) 2026-05-15 09:03:24 +02:00
server-chat.h server: (router) Forward form-data to model server (Fixes #22044) (#22118) 2026-04-27 23:55:00 +02:00
server-common.cpp server : optimize get_token_probabilities (#24796) 2026-06-19 23:26:54 +02:00
server-common.h server : optimize get_token_probabilities (#24796) 2026-06-19 23:26:54 +02:00
server-context.cpp server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
server-context.h server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
server-cors-proxy.h server: (router) Forward form-data to model server (Fixes #22044) (#22118) 2026-04-27 23:55:00 +02:00
server-http.cpp server: add "X-Accel-Buffering": "no" header to streaming endpoints (#24774) 2026-06-18 22:01:24 +02:00
server-http.h server: (router) add model management API (#23976) 2026-06-17 18:04:58 +02:00
server-models.cpp server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
server-models.h server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
server-queue.cpp server: (router) add model management API (#23976) 2026-06-17 18:04:58 +02:00
server-queue.h server: (router) add model management API (#23976) 2026-06-17 18:04:58 +02:00
server-schema.cpp server: add "schema" and validation (#24150) 2026-06-18 15:40:58 +02:00
server-schema.h server: add "schema" and validation (#24150) 2026-06-18 15:40:58 +02:00
server-task.cpp server: add "schema" and validation (#24150) 2026-06-18 15:40:58 +02:00
server-task.h server: add "schema" and validation (#24150) 2026-06-18 15:40:58 +02:00
server-tools.cpp server : validate --tools CLI argument against known tool names (#22538) 2026-05-05 06:35:27 +03:00
server-tools.h server: add built-in tools backend support (#20898) 2026-03-27 10:07:11 +01:00
server.cpp server: refactor child --> router communication (#24821) 2026-06-20 01:02:26 +02:00
ui.cpp can build llama server now 2026-06-14 15:06:37 +08:00
ui.h can build llama server now 2026-06-14 15:06:37 +08:00