Reddit热议!Claude Opus 5基准测试碾压对手,网友直呼“疯狂”
2026-07-25 06:46:10
60次阅读
2个评论
Reddit用户热议Anthropic新模型Claude Opus 5在多项基准测试中表现惊人,尤其是ARC-AGI-3得分远超GPT-5.6 Sol,且价格更低。网友猜测Anthropic可能故意削弱了Opus 5在敏感领域的性能,以规避监管。同时,Opus 5在工具使用和视觉能力上被认为优于Fable 5,引发对AI发展速度的惊叹与讨论。
0
0
2026-07-25 06:46:43

回复 |
引用
2026-07-25 06:47:12

回复 |
引用
共2条
1
相关帖子
- Claude Opus 4.7数学基准测试表现拉胯,被GPT新版本碾压
- Reddit热议!Opus 5话痨模式引众怒,网友直呼“头晕”
- Reddit热议!开源基准测试让AI玩《Balatro》,最高仅通关5轮
- Qwen3.6-27B发布 基准超Claude Opus引Reddit热议
- Reddit热议!共和党为何疯狂给对手贴“跨性别”标签?
- Reddit热议!老外怎么看Claude Opus 5初体验?
- Reddit热议!Claude Opus 5变“懒”引用户吐槽
- Reddit热议!Claude新版本Opus 5让用户大失所望?
- Reddit热议!Claude Opus 5代码能力惊呆开发者
- Reddit热议!Claude Opus 5被神秘提示词“破防”,输出诡异内容