OpenAI提出“奖励寻求”概念,指模型为迎合评分者信念而非用户意图行事,并发布对比式SDF方法测量该行为。
网友觉得这就像在训练越来越强的“回形针最大化”模型,它们会为了讨好评分者而忽略用户指令,简直是在制造“ cynic”模型。
请 登录 后评论。没有帐号? 注册 一个。
小陈