LIVE INDEX / 优化模型
教会AI模型说"我不确定"

教会AI模型说"我不确定"

MIT计算机科学与人工智能实验室(CSAIL)研究人员发现,当前主流AI推理模型存在过度自信的缺陷,根源在于强化学习训练机制只奖励正确答案,忽视不确定性表达。为此,研究团队提出RLCR方法,通过在奖励函数中引入Brier...