* loader: disable expert deferral on huge-page mappings * loader: add --defer-ple for the per-layer token embedding |
||
|---|---|---|
| .. | ||
| llama.h | ||
* loader: disable expert deferral on huge-page mappings * loader: add --defer-ple for the per-layer token embedding |
||
|---|---|---|
| .. | ||
| llama.h | ||
Powered by TurnKey Linux.