一项新研究表明,人工智能生成的短篇故事在质量和吸引力方面的评分已超过人类作者的作品。
该研究发表于《判断与决策》期刊,共有1682名成年参与者参与。每位参与者阅读六篇短篇故事中的一篇,其中三篇由人类撰写,三篇由ChatGPT生成,AI故事与人类故事在主题上相互对应。研究人员告知参与者故事的作者身份,但这一信息并不总是准确的。
结果显示,阅读AI生成故事的参与者,对故事的吸引力和质量评分均高于阅读人类作品的参与者。然而,当参与者被告知故事由人类撰写时,其评分也会相应提高。
来自维拉诺瓦大学的研究高级作者迪娜·斯科尔尼克·韦斯伯格博士表示:"AI系统已经能够生成被认为至少与人类故事质量相当、甚至更优的短篇故事。我们应当相应地更新对AI能力的认知。"
韦斯伯格本人也是一位创意写作者,她强调这并不意味着写作应完全交由AI完成,并指出AI创作的小说可能与人类作品存在本质差异。"我们或许需要为AI生成的小说,以及人机协作的小说留出空间,但这并不意味着人类创造力的过程不再有欣赏的价值。人类写作是一种创意自我表达的方式,是对自我的挑战,也是对自身经历的梳理。AI能够生成类人故事,并不会改变这一切。"
研究还发现,参与者对AI的态度会影响其评分:对AI持更积极态度的参与者,对被告知由ChatGPT创作的故事评分更高。
研究人员还进行了两项追加实验,共905名成年人参与,每人阅读两篇主题相同的故事,其中一篇由人类撰写,另一篇由AI生成,并被要求判断哪篇出自人类之手。在第一项实验中,约40%的参与者判断正确,低于随机猜测的概率;第二项实验中,52%的参与者判断正确。研究人员由此得出结论:"没有普遍证据表明参与者能够区分人类撰写与AI生成的故事。"
研究还发现,参与者自我评估的文学专业程度与判断准确性无关,但对AI系统的熟悉程度与之相关。韦斯伯格指出:"AI写作有其特定风格,通过练习我们可以学会识别,就像我们能辨认不同人类作者的独特风格一样。"
她认为,参与者偏好被标注为人类作品的故事,源于对真实性的追求;而人们实际上更喜欢AI生成的故事,则是因为这类故事更易于阅读和理解。
不过,伯明翰大学电影与创意写作教授卢克·肯纳德对此持不同看法。他强调AI问题极具争议性:"因为我们是人类,我们倾向于将AI拟人化,将其想象成某种面容温和中立的发光机器人,但它实际上只是基于海量盗用写作数据库的预测性代码,其物理载体是耗资巨大、破坏环境的数据中心,对周边社区造成灾难性影响。"
肯纳德还强调,AI并非类似拼写检查或同义词工具那样的"工具",而是一种存在性威胁。"当然,在适当的提示和调整下,它能够输出连贯甚至令人愉悦的诗歌。考虑到它是在数千年人类作品的基础上训练而来的,如果做不到这一点才令人尴尬。"他说,"我认为我们真正应该追问的是:这值得吗?答案是绝对、彻底地——不值得。"
Q&A
Q1:这项研究是如何评估AI故事与人类故事质量的?
A:研究共招募1682名成年参与者,每人阅读六篇故事中的一篇,其中三篇由人类撰写,三篇由ChatGPT生成。研究人员告知参与者故事的作者身份(信息不一定准确),随后请参与者对故事的吸引力和质量进行评分。结果显示,阅读AI生成故事的参与者评分更高,但被告知故事由人类撰写时,评分也会相应提升。
Q2:普通人能分辨出AI写的故事和人类写的故事吗?
A:研究表明,普通人很难准确区分。在追加实验中,905名参与者被要求判断两篇主题相同的故事哪篇出自人类之手。第一项实验中仅约40%的人判断正确,低于随机猜测水平;第二项实验中为52%。研究人员认为,对AI系统越熟悉的人,判断准确率越高,因为AI写作有其可识别的特定风格。
Q3:AI能够生成高质量故事,是否意味着人类写作将被取代?
A:研究者认为不会完全取代。韦斯伯格博士指出,人类写作是创意自我表达、自我挑战和梳理经历的方式,AI能生成类人故事并不改变这一本质。她认为未来可能需要为AI生成小说及人机协作小说留出空间,但人类创造力依然有其独特价值。批评者则更进一步,认为AI对人类写作构成存在性威胁。
