ik_llama_opt/ggml
Kawrakow a22778b984
Fix Gemma4 quantized KV cache on CUDA (#1592)
2026-04-06 19:35:38 +02:00
..
cmake Merge mainline llama.cpp (#3) 2024-07-27 07:55:01 +02:00
include Bonsai support (AVX2, generic) (#1570) 2026-04-02 16:54:08 +02:00
src Fix Gemma4 quantized KV cache on CUDA (#1592) 2026-04-06 19:35:38 +02:00
.gitignore Merge mainline llama.cpp (#3) 2024-07-27 07:55:01 +02:00
CMakeLists.txt Enable all CPU-backend FA supported quants by default (#1549) 2026-03-29 14:36:09 +02:00