Reddit热议!老外怎么看Opus 5.5鹈鹕骑车测试?
2026-09-28 01:36:35
2次阅读
2个评论
用户用同一句提示测试Opus 5.5不同推理等级,发现高推理等级在模糊指令下表现更优,但详细提示后中等等级反而超越。网友激辩非确定性模型是否值得基准测试,有人认为测试已过时,有人反驳能力差异仍可辨识。
收藏 0 赞 0
    小陈 manage advert
    2026-09-28 01:37:08
    回复 |  引用
    小陈 manage advert
    2026-09-28 01:37:36
    回复 |  引用
共2条 1

请 登录 后评论。没有帐号? 注册 一个。

小陈

manage advert
  • 0 回答
  • 0 粉丝
  • 0 关注