llama.cpp新分支BeeLlama.cpp性能亮眼 单3090跑大模型提速2-3倍
2026-05-10 06:59:38
100次阅读
3个评论
开发者Anbeeld推出性能向llama.cpp分支BeeLlama.cpp,集成多项优化,单RTX3090可跑200k上下文的Qwen3.6 27B Q5,速度提2-3倍;有用户实测表现佳,也存在TurboQuant质量、AI辅助编码、编译BUG等争议。
0
0
2026-05-10 07:00:12

回复 |
引用
2026-05-10 07:00:44

回复 |
引用
2026-05-10 07:01:14

回复 |
引用
共3条
1