koboldcpp/tools/server
Concedo 317e0a2e76 Merge branch 'upstream' into concedo_experimental
# Conflicts:
#	.github/workflows/build-cmake-pkg.yml
#	.github/workflows/build-cpu.yml
#	.github/workflows/server-sanitize.yml
#	CMakeLists.txt
#	docs/ops.md
#	docs/ops/CUDA.csv
#	docs/ops/SYCL.csv
#	examples/model-conversion/Makefile
#	ggml/CMakeLists.txt
#	ggml/include/ggml-sycl.h
#	ggml/src/ggml-hexagon/ggml-hexagon.cpp
#	ggml/src/ggml-hexagon/htp/dma-queue.h
#	ggml/src/ggml-hexagon/htp/flash-attn-ops.c
#	ggml/src/ggml-opencl/ggml-opencl.cpp
#	ggml/src/ggml-sycl/fusion.cpp
#	ggml/src/ggml-sycl/getrows.cpp
#	ggml/src/ggml-sycl/getrows.hpp
#	ggml/src/ggml-sycl/ggml-sycl.cpp
#	ggml/src/ggml-sycl/mmvq.cpp
#	ggml/src/ggml-sycl/mmvq.hpp
#	ggml/src/ggml-sycl/norm.cpp
#	ggml/src/ggml-sycl/norm.hpp
#	ggml/src/ggml-vulkan/CMakeLists.txt
#	scripts/make-release-desc.sh
#	scripts/make-release-summary.txt
#	scripts/sync-ggml.last
#	tests/test-backend-ops.cpp
#	tests/test-jinja.cpp
#	tests/test-llama-archs.cpp
#	tests/test-save-load-state.cpp
#	tools/mtmd/CMakeLists.txt
2026-09-24 16:44:08 +08:00
..
bench Merge branch 'upstream' into concedo_experimental 2026-06-16 17:55:04 +08:00
tests Merge branch 'upstream' into concedo_experimental 2026-09-24 16:44:08 +08:00
main.cpp app : introduce the llama unified executable (#23296) 2026-05-20 13:22:22 +02:00
README-dev.md server: refactor sleep handling, allow access /metrics during sleep (#27376) 2026-08-19 20:48:09 +02:00
server-chat.cpp server: support input_image in function_call_output (#20663) (#22575) 2026-09-22 21:04:58 +02:00
server-chat.h common: add json.h abstraction (#27511) 2026-08-22 16:28:28 +02:00
server-common.cpp server: accept OpenAI video_url content type and data: video URIs (#27921) 2026-09-23 12:58:09 +02:00
server-common.h server: refactor subproc handling (#28555) 2026-09-12 00:53:07 +02:00
server-context.cpp server,common : fix the GCC 12 stringop-overread false positive (again) (#29325) 2026-09-24 08:40:06 +02:00
server-context.h server: fix token counting API crash on sleep (#29309) 2026-09-23 15:28:49 +02:00
server-cors-proxy.h common,server: handle bracketed IPv6 literals in URL authority (#25140) 2026-06-30 16:16:44 +02:00
server-http.cpp server: Add support for binding to multiple addresses (#28690) 2026-09-22 15:16:40 +02:00
server-http.h server: Add support for binding to multiple addresses (#28690) 2026-09-22 15:16:40 +02:00
server-mcp.cpp common: add subproc.h wrapper, disabled on android/ios (#26102) 2026-07-26 20:54:25 +02:00
server-mcp.h server: support MCP stdio (#26062) 2026-07-26 01:08:49 +02:00
server-models.cpp server: allow preset to set log file (#29334) 2026-09-24 01:16:00 +02:00
server-models.h server: refactor subproc handling (#28555) 2026-09-12 00:53:07 +02:00
server-queue.cpp server: refactor sleep handling, allow access /metrics during sleep (#27376) 2026-08-19 20:48:09 +02:00
server-queue.h server: refactor sleep handling, allow access /metrics during sleep (#27376) 2026-08-19 20:48:09 +02:00
server-schema.cpp common : implement common_schema internal representation for JSON schemas (#28736) 2026-09-12 16:14:50 -05:00
server-schema.h sampler : remove "full-context windows" from history-based samplers (#26524) 2026-08-04 21:28:55 +03:00
server-stream.cpp server + ui: fix stream routes for model names containing a slash (#26137) 2026-07-27 07:34:47 +02:00
server-stream.h server + ui: fix stream routes for model names containing a slash (#26137) 2026-07-27 07:34:47 +02:00
server-task.cpp common: add json.h abstraction (#27511) 2026-08-22 16:28:28 +02:00
server-task.h common: add json.h abstraction (#27511) 2026-08-22 16:28:28 +02:00
server-tools.cpp common: add json.h abstraction (#27511) 2026-08-22 16:28:28 +02:00
server-tools.h ui: Refactor Built-In Tools naming (Server/Browser) (#27271) 2026-08-17 22:23:22 +02:00
server.cpp server: Add support for binding to multiple addresses (#28690) 2026-09-22 15:16:40 +02:00
ui.cpp can build llama server now 2026-06-14 15:06:37 +08:00
ui.h can build llama server now 2026-06-14 15:06:37 +08:00