MoziSmartBit 自研量化格式需要特定 llama.cpp 版本

#1
by rogerhik999 - opened

MoziAI GGUF 与当前 master 不兼容(GGML_ASSERT 张量维度断言失败——MoziSmartBit 自研量化格式需要特定 llama.cpp 版本)。
MTP 无法启用:master 不识别 MoziAI 的 blk.64.nextn 张量(加载时忽略),强行 --spec-type draft-mtp 会 GGML_ASSERT 崩——启动脚本已禁用并注释。等上游支持 Dense Qwen3.8 nextn 后可再启用(官方声称 +30-50%)

不需要特定的 llama.cpp 第三方版本,你直接下载最新版本的llama.cpp官方预编译版本就行了

Sign up or log in to comment