* Quantize: add extra output tensor for MTP * Consistently use --mtp-requantize-output-tensor |
||
|---|---|---|
| .. | ||
| llama.h | ||
* Quantize: add extra output tensor for MTP * Consistently use --mtp-requantize-output-tensor |
||
|---|---|---|
| .. | ||
| llama.h | ||
Powered by TurnKey Linux.