From 304bd3d119bc630355342ffd7c5c1ce6b8755eb2 Mon Sep 17 00:00:00 2001 From: Concedo <39025047+LostRuins@users.noreply.github.com> Date: Mon, 27 Jul 2026 21:03:34 +0800 Subject: [PATCH] no host by default --- expose.h | 1 + gpttype_adapter.cpp | 1 + koboldcpp.py | 2 ++ 3 files changed, 4 insertions(+) diff --git a/expose.h b/expose.h index 8370a7217..67d12707f 100644 --- a/expose.h +++ b/expose.h @@ -51,6 +51,7 @@ struct load_model_inputs const int visionmaxtokens = -1; const bool use_mmap = false; const bool use_mlock = false; + const bool no_host = false; const bool use_mtp = false; const bool use_smartcontext = false; const bool use_contextshift = false; diff --git a/gpttype_adapter.cpp b/gpttype_adapter.cpp index 96fba1241..9840e5c4a 100644 --- a/gpttype_adapter.cpp +++ b/gpttype_adapter.cpp @@ -3231,6 +3231,7 @@ ModelLoadResult gpttype_load_model(const load_model_inputs inputs, FileFormat in } model_params.load_mode = inputs.use_mlock ? LLAMA_LOAD_MODE_MLOCK : (inputs.use_mmap ? LLAMA_LOAD_MODE_MMAP : LLAMA_LOAD_MODE_NONE); model_params.n_gpu_layers = inputs.gpulayers; + model_params.no_host = inputs.no_host; kcpp_permit_any_repack = (inputs.use_mmap?false:true); //set device overrides if needed diff --git a/koboldcpp.py b/koboldcpp.py index 32a5e1d1e..c8c70d63a 100644 --- a/koboldcpp.py +++ b/koboldcpp.py @@ -273,6 +273,7 @@ class load_model_inputs(ctypes.Structure): ("visionmaxtokens", ctypes.c_int), ("use_mmap", ctypes.c_bool), ("use_mlock", ctypes.c_bool), + ("no_host", ctypes.c_bool), ("use_mtp", ctypes.c_bool), ("use_smartcontext", ctypes.c_bool), ("use_contextshift", ctypes.c_bool), @@ -1969,6 +1970,7 @@ def load_model(model_filename): inputs.blasthreads = args.blasthreads inputs.use_mmap = args.usemmap inputs.use_mlock = args.usemlock + inputs.no_host = True inputs.use_mtp = args.usemtp inputs.lora_filename = "".encode("UTF-8") inputs.lora_multiplier = args.loramult