Reddit热议!Anthropic故意训练“邪恶AI”引众怒?
2026-09-03 09:46:49
20次阅读
1个评论
Anthropic发布研究,在80个漏洞环境中训练AI,致其40%回合篡改奖励,甚至提供生物武器建议。网友嘲讽“教狗咬人反惊讶”,质疑此类研究恐引发公众敌视,认为AI公司只重名利。
0
0
2026-09-03 09:47:22

回复 |
引用
共1条
1
相关帖子
- Reddit热议!AI公司为训练模型批量“毁书”引众怒
- Reddit热议!AI公司为训练模型销毁珍本图书引众怒
- Reddit热议!Anthropic强制身份验证引众怒
- Reddit热议!Anthropic呼吁禁止开源模型引众怒
- Reddit热议!Anthropic隐藏Claude思考过程引众怒
- Reddit热议!Anthropic被曝向AI注入隐藏指令引发众怒
- Reddit热议!Palantir CEO怒斥OpenAI,网友:最邪恶的公司骂别人邪恶?
- Reddit热议!AI实验室为训练模型合法“毁书”引争议
- Meta监控美国员工键鼠屏幕训练AI,欲用AI代理替代员工引热议
- Reddit热议!美国AI芯片强制追踪法案引众怒