2026-08-13
空架子还是丢失的钥匙?召回率才是大语言模型事实准确性的真正瓶颈
研究人员提出"知识画像"框架,系统区分大模型事实错误的两类根源:知识从未编码(空架子)与知识已编码但无法召回(丢钥匙)。基于2150条维基百科事实构建的WikiProfile基准测试显示,Gemini-3-Pro、GPT...
研究人员提出"知识画像"框架,系统区分大模型事实错误的两类根源:知识从未编码(空架子)与知识已编码但无法召回(丢钥匙)。基于2150条维基百科事实构建的WikiProfile基准测试显示,Gemini-3-Pro、GPT...