Reddit热议!老外怎么看Qwen3.8-27B吊打3.5/3.6-35B?
2026-09-12 23:40:38
45次阅读
2个评论
原帖作者称3.8-27B质量高到荒谬,细节把控惊人,虽耗时多3-4倍但token消耗少、内存占用低。网友普遍认同dense模型在复杂任务上远胜MoE,有人已无法回头用MoE,也有人指出其过度推理、简单任务上不如Flash Next实用。
收藏 0 0
    小陈 manage advert
    2026-09-12 23:41:10
    回复 |  引用
    小陈 manage advert
    2026-09-12 23:41:39
    回复 |  引用
共2条 1

登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注