Reddit热议!本地大模型实测:DeepSeek V4 Flash速度碾压Sonnet,质量相当
2026-07-04 10:38:17
88次阅读
3个评论
Reddit用户实测发现,在2块RTX PRO 6000上运行的DeepSeek V4 Flash,每任务仅需2分钟,而Sonnet需6分钟,速度提升约3倍,质量与Sonnet相当。但网友质疑测试不公:Qwen模型使用了4位量化版本,而DeepSeek为原生FP8/FP4混合精度,且本地与API模型运行框架不同,导致时间差异可能主要来自工具链而非模型本身。
收藏 0 0
    小陈 manage advert
    2026-07-04 10:38:49
    回复 |  引用
    小陈 manage advert
    2026-07-04 10:39:18
    回复 |  引用
    小陈 manage advert
    2026-07-04 10:39:47
    回复 |  引用
共3条 1

登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注