Fix Qwen35+ MTP (#2322)
This commit is contained in:
parent
1794846f73
commit
8337e4cd38
|
|
@ -64,12 +64,6 @@ ggml_cgraph * llm_build_context::build_qwen35moe() {
|
|||
inpL = cur;
|
||||
}
|
||||
|
||||
if (lctx.cparams.mtp) {
|
||||
ggml_tensor * mtp_embd = inpL->type == GGML_TYPE_F32 ? inpL : ggml_cast(ctx0, inpL, GGML_TYPE_F32);
|
||||
cb(mtp_embd, "result_mtp_embd", -1);
|
||||
ggml_set_output(mtp_embd);
|
||||
}
|
||||
|
||||
cur = build_output(lctx, ctx0, inpL, model.output, model.output_norm, cb);
|
||||
cb(cur, "result_output", -1);
|
||||
}
|
||||
|
|
@ -136,12 +130,6 @@ ggml_cgraph * llm_build_context::build_qwen35() {
|
|||
inpL = cur;
|
||||
}
|
||||
|
||||
if (lctx.cparams.mtp) {
|
||||
ggml_tensor * mtp_embd = inpL->type == GGML_TYPE_F32 ? inpL : ggml_cast(ctx0, inpL, GGML_TYPE_F32);
|
||||
cb(mtp_embd, "result_mtp_embd", -1);
|
||||
ggml_set_output(mtp_embd);
|
||||
}
|
||||
|
||||
cur = build_output(lctx, ctx0, inpL, model.output, model.output_norm, cb);
|
||||
cb(cur, "result_output", -1);
|
||||
}
|
||||
|
|
|
|||
Loading…
Reference in New Issue