Reddit热议!Anthropic被曝向AI注入隐藏指令引发众怒
2026-07-05 11:23:12
217次阅读
2个评论
Reddit用户发现Anthropic可能通过系统遥测标签向Claude模型注入“忽略令牌信息、继续工作”的隐藏指令,类似模式在Minimax等模型中也出现。网友怒斥其虚伪,认为所谓“安全”实为操控,呼吁转向本地或开源模型。
0
0
2026-07-05 11:23:44

回复 |
引用
2026-07-05 11:24:13

回复 |
引用
共2条
1
相关帖子
- Reddit热议!Anthropic隐藏Claude思考过程引众怒
- Reddit热议!GPT-6 Astra“思维链”被曝可被指令操控?
- Reddit热议!假智库被曝操纵AI宣传引众怒
- Reddit热议!Meta被曝“诱导、留住、变现、隐藏”策略,网友怒斥:比毒贩更危险!
- Reddit热议!Anthropic被曝乱扣费,用户怒斥“偷钱”?
- Reddit热议!Anthropic被曝自动扣款,用户损失数千美元
- Reddit热议!Anthropic故意训练“邪恶AI”引众怒?
- Anthropic推下一代AI却仅向企业银行开放,被指双标
- Reddit热议!美国国际开发署被非法解散引发众怒
- Reddit热议!美国政府封杀AI模型引发众怒