Reddit热议!Anthropic被曝向AI注入隐藏指令引发众怒
2026-07-05 11:23:12
85次阅读
2个评论
Reddit用户发现Anthropic可能通过系统遥测标签向Claude模型注入“忽略令牌信息、继续工作”的隐藏指令,类似模式在Minimax等模型中也出现。网友怒斥其虚伪,认为所谓“安全”实为操控,呼吁转向本地或开源模型。
0
0
2026-07-05 11:23:44

回复 |
引用
2026-07-05 11:24:13

回复 |
引用
共2条
1