Qwen3.6 27B借MTP提速2.5倍 48G显存可跑262K上下文
2026-05-07 01:16:33
97次阅读
3个评论
楼主分享适配llama.cpp MTP功能PR的Qwen3.6 27B量化模型,修正原不稳定的TurboQuant推荐,附各硬件适配配置表;评论区有用户实测提速效果,也反馈部分模型损坏、部署遇问题,还有人感慨开源大模型近期进展神速。
0
0
2026-05-07 01:17:06

回复 |
引用
2026-05-07 01:17:35

回复 |
引用
2026-05-07 01:18:04

回复 |
引用
共3条
1