LIVE INDEX / 最新文章
个性化安全:从一刀切到个性定制,华盛顿大学研究团队提出针对大语言模型的个性化安全评估与改进方法

个性化安全:从一刀切到个性定制,华盛顿大学研究团队提出针对大语言模型的个性化安全评估与改进方法

这项研究提出了个性化安全概念,解决大语言模型对不同用户采用统一安全标准的问题。研究团队创建了PENGUIN基准测试集评估模型在处理高风险场景时的个性化安全能力,并开发了RAISE框架高效获取关键用户信息。实验表明,提供用...

大语言模型能从真实世界文本中推断因果关系吗?——一项来自伍斯特理工学院与亚马逊通用人工智能团队的探索

大语言模型能从真实世界文本中推断因果关系吗?——一项来自伍斯特理工学院与亚马逊通用人工智能团队的探索

这项研究探究大语言模型从真实文本中推断因果关系的能力,创建了首个真实世界基准数据集ReCAST。研究发现,即使最先进模型在此任务上表现也不佳,最高F1分数仅为0.477。模型尤其难以处理隐含因果关系、区分关键因素与背景信...