研究发现:AI写的故事更吸引读者

剑桥大学出版社于2026年8月5日在线发表了由维拉诺瓦大学主导的一项研究,参与者对ChatGPT生成的短篇故事在质量和吸引力方面的评价高于人类写的故事。当读者被告知故事是人所写时,AI故事获得的评价最高,而后续实验发现参与者无法可靠地判断故事是来自AI还是人类。

由维拉诺瓦大学研究人员主导的一项研究发现,读者认为ChatGPT生成的短篇故事比人类写的故事质量更高、更吸引人。该研究于2026年8月5日由剑桥大学出版社在线发表在《判断与决策》期刊上。论文还发现,当读者认为AI生成的故事是人所写时,他们给出了最高的评价。

研究设计与发现

第一项实验涉及1682名年龄在18至81岁之间的成年人。参与者阅读一个短篇故事,并被告知关于作者是人类还是AI的正确或不正确信息,然后评价其质量和吸引力。论文报告称,该研究使用了从文学期刊或短篇小说集中选取的三篇人类作者虚构故事,以及由ChatGPT生成的三篇对应故事。

在该实验中,AI生成的故事在写作质量和读者吸引力方面的得分均更高。然而,作者标签也影响了评价:被认为由人类写作的故事无论实际来源如何都获得了更高的评分。这意味着被标记为人类写作的AI故事获得了最高的评价。

随后的两项实验测试了读者在没有作者标签的情况下是否能区分来源。在一项涉及424名参与者的实验中,识别AI生成材料的准确率为39.93%,低于随机水平。在另一项涉及481名参与者的实验中,准确率为51.97%,论文报告称这与随机水平无差异。

《卫报》的报道将这一结果描述为更简单的AI散文可能更易于阅读和处理的证据,同时提醒说读者对这种散文的偏好并不证明人类作者已经过时。

该结果衡量了什么

该研究涉及的是实验条件下少量短篇故事的评分,而非对文学成就、原创性或长篇叙事能力的全面比较。然而,它确实分离出了与生成式AI评估相关的两个问题:感知文本质量和来源感知。

这一发现补充了证据,表明未经辅助的人类检测对于AI作者身份评估来说是一种不可靠的控制手段。

在研究之外,未参与该项研究的伯明翰大学创意写作教授Luke Kennard告诉《卫报》,AI产生连贯且令人愉悦的写作的能力应与系统的训练数据以及更广泛的伦理和环境成本一并考虑。这些问题与该研究报告的质量、吸引力和来源检测指标是分开的。

(素材来自:剑桥大学出版社 智算芯能前沿网综合)

标签:ChatGPT AI 写作

本文由智算芯能前沿网编辑整理,转载请注明出处。