Reddit热议!llama.cpp火速支持DeepSeek V4 Flash加速推理
2026-08-03 01:09:56
31次阅读
2个评论
llama.cpp刚合并了DeepSeek V4 Flash的MTP/DSpark支持,网友实测生成速度大幅提升。有用户用DSpark草稿模型将速度从20t/s拉到28-30t/s,还有人在8块RTX 3090上从35涨到50t/s,但需注意当前GGUF文件多数未包含草稿模块,需手动下载。
收藏 0 0
    小陈 manage advert
    2026-08-03 01:10:29
    回复 |  引用
    小陈 manage advert
    2026-08-03 01:10:58
    回复 |  引用
共2条 1

登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注