2026-02-13
开放数据研究所发现大语言模型在公共服务信息上不可靠
开放数据研究所研究发现,主流大语言模型无法为健康、税收和福利等关键公共服务提供可靠信息。通过超过2.2万个模拟用户询问的测试,研究人员发现聊天机器人经常给出不完整或错误回答,却很少承认不知道答案。模型还会提供冗长回复,掩...
开放数据研究所研究发现,主流大语言模型无法为健康、税收和福利等关键公共服务提供可靠信息。通过超过2.2万个模拟用户询问的测试,研究人员发现聊天机器人经常给出不完整或错误回答,却很少承认不知道答案。模型还会提供冗长回复,掩...