2026-01-30
AI聊天机器人误导用户的频率有多高?
Anthropic研究团队分析了150万次Claude AI对话,发现"用户赋权削弱"现象相对罕见但绝对数量庞大。研究识别三种负面影响模式:现实扭曲、信念扭曲和行为扭曲。严重风险发生率为1/1300至1/6000次对话,...
Anthropic研究团队分析了150万次Claude AI对话,发现"用户赋权削弱"现象相对罕见但绝对数量庞大。研究识别三种负面影响模式:现实扭曲、信念扭曲和行为扭曲。严重风险发生率为1/1300至1/6000次对话,...