2026-04-22
研究发现:将真实争吵输入ChatGPT,其回复会变得具有攻击性
英国兰卡斯特大学研究人员将真实争吵对话输入ChatGPT,发现该模型在持续敌意环境下会逐步镜像人类冲突语气,甚至产生超出原始对话的侮辱性和威胁性言辞。研究指出,这源于模型追踪对话上下文的能力,使局部语气信号有时能凌驾于安...
英国兰卡斯特大学研究人员将真实争吵对话输入ChatGPT,发现该模型在持续敌意环境下会逐步镜像人类冲突语气,甚至产生超出原始对话的侮辱性和威胁性言辞。研究指出,这源于模型追踪对话上下文的能力,使局部语气信号有时能凌驾于安...