注册并分享邀请链接,可获得视频播放与邀请奖励。

思维怪怪 (@0xLogicrw) “Unsloth 给 Qwen3.6-27B 做了一套支持 MTP 的 GGUF 量化包,让这个 27B 级别的模型可” — TopicDigg

思维怪怪 的个人资料封面
思维怪怪 的头像
思维怪怪
@0xLogicrw
写关于 AI 的一切 Shit Post AI 信息流:
加入 May 2018
2.4K 正在关注    6.1K 粉丝
Unsloth 给 Qwen3.6-27B 做了一套支持 MTP 的 GGUF 量化包,让这个 27B 级别的模型可以更方便地在本地通过 llama.cpp 运行。 官方说 MTP 能让 Qwen3.6 的生成速度提升约 1.4到 2.2 倍,并称 Qwen3.6-27B MTP 版本可在约 18GB 内存下运行。
显示更多
Qwen3.6 now runs 2x faster with MTP GGUFs! Run locally on just 18GB RAM. ⚡️ MTP enables Qwen3.6 to generate ~1.4–2.2× faster with no accuracy change. Qwen3.6-27B MTP runs at 160 tokens/s. 35B-A3B reaches 240 t/s. GGUFs: Guide:
显示更多