From 77413bc900f9a2bfd8a5407f184427bcc0825f6c Mon Sep 17 00:00:00 2001 From: Samuel Oliveira Alves <107287165+SamuelOliveirads@users.noreply.github.com> Date: Tue, 19 May 2026 12:30:41 -0300 Subject: [PATCH] Add Hadamard parameters to draft model loading (#1840) --- examples/server/server-context.cpp | 2 ++ 1 file changed, 2 insertions(+) diff --git a/examples/server/server-context.cpp b/examples/server/server-context.cpp index b2da0f66..c53a3134 100644 --- a/examples/server/server-context.cpp +++ b/examples/server/server-context.cpp @@ -482,6 +482,8 @@ bool server_context::load_model(const gpt_params& params_) { params_dft.cache_type_k = params_base.speculative.cache_type_k.empty() ? params_base.cache_type_k : params_base.speculative.cache_type_k; params_dft.cache_type_v = params_base.speculative.cache_type_v.empty() ? params_base.cache_type_v : params_base.speculative.cache_type_v; params_dft.flash_attn = params_base.flash_attn; + params_dft.k_cache_hadamard = params_base.k_cache_hadamard; + params_dft.v_cache_hadamard = params_base.v_cache_hadamard; if (!params_base.speculative.params.empty()) { auto [argc, argv] = parse_command_line("llama-server " + params_base.speculative.params); if (!gpt_params_parse(argc, argv, params_dft)) {