koboldcpp/src
Chris Peterson 9e71716247
models : move build_arch_graph() after graph() template specialization (#28934)
Move build_arch_graph()'s function definitions after the graph<true>
and graph<false> template specializations have been explicitly defined.
2026-09-15 12:33:26 +03:00
..
models models : move build_arch_graph() after graph() template specialization (#28934) 2026-09-15 12:33:26 +03:00
CMakeLists.txt cmake : remove precompiled headers (#28892) 2026-09-14 16:07:28 +02:00
llama-adapter.cpp llama : check LoRA tensor data is within file bounds (#27056) 2026-08-16 09:38:01 +03:00
llama-adapter.h
llama-arch.cpp llama: add Maple 20B-A1B ternary MoE architecture (CPU) (#27000) 2026-09-14 14:04:05 +03:00
llama-arch.h llama: add Maple 20B-A1B ternary MoE architecture (CPU) (#27000) 2026-09-14 14:04:05 +03:00
llama-batch.cpp
llama-batch.h
llama-chat.cpp
llama-chat.h
llama-context.cpp metal : single-source fusion table + fusion debug rework (#28164) 2026-09-11 12:41:54 +03:00
llama-context.h
llama-cparams.cpp
llama-cparams.h context : autoscale n_ctx_train when yarn scaling specified (#28030) 2026-09-01 19:59:54 +03:00
llama-ext.h spec : add DFlash2 support (local convolution + candidate selector) (#27342) (#27816) 2026-08-27 19:17:07 +02:00
llama-grammar.cpp grammar : coalesce find + insert into a single insert and adjust move/copy mechanics (#26885) 2026-09-13 16:56:46 -05:00
llama-grammar.h
llama-graph.cpp llama: add Maple 20B-A1B ternary MoE architecture (CPU) (#27000) 2026-09-14 14:04:05 +03:00
llama-graph.h llama : add missing headers (#28566) 2026-09-08 12:59:53 +02:00
llama-hparams.cpp src : add n_expert_used_max function (#28323) 2026-09-04 06:36:51 +02:00
llama-hparams.h model : add Tencent Hy 4 (hy_v4) preview architecture support (#28127) 2026-09-04 14:31:36 +02:00
llama-impl.cpp
llama-impl.h
llama-io.cpp
llama-io.h
llama-kv-cache-dsa-iswa.cpp model: add dots3-note (#27060) 2026-08-21 19:52:34 +02:00
llama-kv-cache-dsa-iswa.h model: add dots3-note (#27060) 2026-08-21 19:52:34 +02:00
llama-kv-cache-dsa.cpp
llama-kv-cache-dsa.h
llama-kv-cache-dsv4.cpp Deepseek 4: -sm tensor (#26490) 2026-08-24 09:20:25 +03:00
llama-kv-cache-dsv4.h
llama-kv-cache-iswa.cpp
llama-kv-cache-iswa.h
llama-kv-cache-msa.cpp model: M3: Move MSA into a new memory implementation (#26338) 2026-08-03 16:30:08 +03:00
llama-kv-cache-msa.h model: M3: Move MSA into a new memory implementation (#26338) 2026-08-03 16:30:08 +03:00
llama-kv-cache.cpp model, mtmd: fix gemma4 vision handling (#28335) 2026-09-04 12:23:27 +02:00
llama-kv-cache.h model: add Qwen3.8-Flash-Next (qwen4exp) (#27742) 2026-08-27 21:32:31 +02:00
llama-kv-cells.h kv-cells: look up the n-gram history in the sequence position index (#28040) 2026-09-01 20:16:07 +02:00
llama-memory-hybrid-idx.cpp memory : avoid allocating V cache for indexer (it's not used) (#28330) 2026-09-10 10:55:46 +02:00
llama-memory-hybrid-idx.h qwen4exp: fix seq_cp, block position keying, mtmd input, cuda abort, add tests (#27941) 2026-09-01 13:22:04 +03:00
llama-memory-hybrid-iswa.cpp
llama-memory-hybrid-iswa.h
llama-memory-hybrid.cpp
llama-memory-hybrid.h
llama-memory-recurrent.cpp model: add Qwen3.8-Flash-Next (qwen4exp) (#27742) 2026-08-27 21:32:31 +02:00
llama-memory-recurrent.h model: add Qwen3.8-Flash-Next (qwen4exp) (#27742) 2026-08-27 21:32:31 +02:00
llama-memory.cpp
llama-memory.h
llama-mmap.cpp llama : add missing headers (#28566) 2026-09-08 12:59:53 +02:00
llama-mmap.h llama: model_loader: add TENSOR_READ_LAZY (#27794) 2026-08-27 15:14:34 +02:00
llama-model-loader.cpp src : add n_expert_used_max function (#28323) 2026-09-04 06:36:51 +02:00
llama-model-loader.h llama: improve TENSOR_READ_LAZY handling (#27837) 2026-08-30 16:59:48 +02:00
llama-model-saver.cpp llama: add Maple 20B-A1B ternary MoE architecture (CPU) (#27000) 2026-09-14 14:04:05 +03:00
llama-model-saver.h model: add Qwen3.8-Flash-Next (qwen4exp) (#27742) 2026-08-27 21:32:31 +02:00
llama-model.cpp llama: add Maple 20B-A1B ternary MoE architecture (CPU) (#27000) 2026-09-14 14:04:05 +03:00
llama-model.h model: fix all granite family parameter counts (#28643) 2026-09-10 09:49:56 +03:00
llama-quant.cpp quantize: row-slab stream to avoid thread starvation (#27830) 2026-09-01 11:18:54 +02:00
llama-quant.h
llama-sampler.cpp llama : use int32_t for llama_sampler_chain_n return type (#28631) 2026-09-09 15:27:25 +03:00
llama-sampler.h llama : support multi-output backend sampling (#25532) 2026-08-10 16:58:56 +03:00
llama-version.h.in llama: fix whole source code rebuilt on each new commit (#28278) 2026-09-03 23:53:04 +02:00
llama-vocab.cpp llama : add missing headers (#28566) 2026-09-08 12:59:53 +02:00
llama-vocab.h [Model] Support for Spark2_5ForCausalLM implementation (#27868) 2026-09-06 17:43:58 +02:00
llama.cpp llama: fix whole source code rebuilt on each new commit (#28278) 2026-09-03 23:53:04 +02:00
unicode-data.cpp
unicode-data.h
unicode.cpp unicode : include '~' in collapsed symbol class (#26972) 2026-08-18 15:15:22 +02:00
unicode.h