ik_llama_opt/ggml
Kawrakow 7065488135
Slightly better graph parallel for Qwen3-Next (#1307)
* Make sure we pick the reduced tensor from the right GPU

* Minor
2026-02-24 15:22:30 +01:00
..
cmake Merge mainline llama.cpp (#3) 2024-07-27 07:55:01 +02:00
include Slightly better graph parallel for Qwen3-Next (#1307) 2026-02-24 15:22:30 +01:00
src Slightly better graph parallel for Qwen3-Next (#1307) 2026-02-24 15:22:30 +01:00
.gitignore Merge mainline llama.cpp (#3) 2024-07-27 07:55:01 +02:00
CMakeLists.txt Remove llamafile remnants (#1179) 2026-01-22 13:20:23 +02:00