koboldcpp/tools/server
Concedo f57cd915a9 Merge branch 'upstream' into concedo_experimental
# Conflicts:
#	.github/workflows/ui-publish.yml
#	CODEOWNERS
#	docs/ops.md
#	ggml/CMakeLists.txt
#	ggml/src/CMakeLists.txt
#	ggml/src/ggml-hexagon/htp/CMakeLists.txt
#	ggml/src/ggml-hexagon/htp/argsort-ops.c
#	scripts/sync-ggml.last
#	tools/mtmd/tests/test-deepseek-ocr.py
2026-07-11 11:36:59 +08:00
..
bench Merge branch 'upstream' into concedo_experimental 2026-06-16 17:55:04 +08:00
tests Merge branch 'upstream' into concedo_experimental 2026-07-11 11:36:59 +08:00
main.cpp app : introduce the llama unified executable (#23296) 2026-05-20 13:22:22 +02:00
README-dev.md server-stream: follow-up on SSE Replay Buffer (#23226) (#25047) 2026-07-08 12:02:50 +03:00
server-chat.cpp Support for Codex CLI by skipping unsupported Responses tools (#23041) 2026-05-15 09:03:24 +02:00
server-chat.h server: (router) Forward form-data to model server (Fixes #22044) (#22118) 2026-04-27 23:55:00 +02:00
server-common.cpp server: improve user message detection and create checkpoints at every user message (#24176) 2026-06-23 08:27:28 +03:00
server-common.h server: improve user message detection and create checkpoints at every user message (#24176) 2026-06-23 08:27:28 +03:00
server-context.cpp server : move chat-template thinking probe inside the init try/catch (#24093) 2026-07-09 18:37:39 +02:00
server-context.h llama : add llama_model_ftype_name() (#25134) 2026-07-02 17:26:47 +02:00
server-cors-proxy.h common,server: handle bracketed IPv6 literals in URL authority (#25140) 2026-06-30 16:16:44 +02:00
server-http.cpp server: remove loading.html (#25500) 2026-07-10 14:42:17 +02:00
server-http.h server + ui: SSE Replay Buffer (#23226) 2026-06-26 09:31:29 +02:00
server-models.cpp cli : move to HTTP-based implementation (#24948) 2026-07-08 14:52:43 +02:00
server-models.h server + ui: SSE Replay Buffer (#23226) 2026-06-26 09:31:29 +02:00
server-queue.cpp server: (router) add model management API (#23976) 2026-06-17 18:04:58 +02:00
server-queue.h server: (router) add model management API (#23976) 2026-06-17 18:04:58 +02:00
server-schema.cpp server: accept null sampling params (#25538) 2026-07-10 22:07:29 +02:00
server-schema.h server: add "schema" and validation (#24150) 2026-06-18 15:40:58 +02:00
server-stream.cpp server-stream: follow-up on SSE Replay Buffer (#23226) (#25047) 2026-07-08 12:02:50 +03:00
server-stream.h server-stream: follow-up on SSE Replay Buffer (#23226) (#25047) 2026-07-08 12:02:50 +03:00
server-task.cpp server : add timings and progress to /responses API stream (#25348) 2026-07-07 16:13:03 +02:00
server-task.h server : add timings and progress to /responses API stream (#25348) 2026-07-07 16:13:03 +02:00
server-tools.cpp server: improve tools, remove apply_diff (#25498) 2026-07-10 11:52:59 +02:00
server-tools.h server: improve tools, remove apply_diff (#25498) 2026-07-10 11:52:59 +02:00
server.cpp cli : move to HTTP-based implementation (#24948) 2026-07-08 14:52:43 +02:00
ui.cpp can build llama server now 2026-06-14 15:06:37 +08:00
ui.h can build llama server now 2026-06-14 15:06:37 +08:00