时间:2026年8月8日
地点:美国/英国(匹兹堡大学 / 剑桥大学出版社 Judgment and Decision Making 期刊)
人物:Sydney Sears(匹兹堡大学研究者);Deena Skolnick Weisberg
事件详情:
2026年8月8日,剑桥大学出版社旗下 Judgment and Decision Making 期刊在线发表匹兹堡大学 Sydney Sears 与 Deena Skolnick Weisberg 的最新研究 Bot or not: Can people tell the difference between stories written by a human or by an AI system。研究显示,在不知情条件下,1682 名参与者给 ChatGPT 4.0 生成短篇小说的评分显著高于人类作家的作品。其中质量评分 AI 故事平均 1.54 分,人类故事仅 0.97 分;沉浸度 AI 故事 1.42 分,人类故事 1.00 分(评分区间 -3 到 +3)。
背景:
研究共设计三组实验:第一组让 1682 名参与者阅读 6 个约 1000 字的短篇小说(3 个来自知名文学杂志,3 个由 ChatGPT 4.0 基于原作文风、叙事视角生成),并随机告知来源(真实或虚假);第二、三组共 905 人同时阅读人类与 AI 故事,要求辨认来源。结果显示,即便提供直接对比,参与者正确识别 AI 或人类作者的概率仍与随机猜测无显著差异。值得注意的是,参与者对 AI 的态度也影响评分:AI 友好者给 AI 故事打分更高,AI 怀疑者则倾向于给所谓人类故事更高分。
影响:
- 研究揭示读者评价创意作品时存在显著的作者身份偏见,挑战了纯文本质量的客观评判
- AI 生成文本通常更流畅、更易读、更情绪积极,可能解释了 AI 故事在不知情条件下获得更高评分
- 创意写作领域(小说、剧本、诗歌)将面临 AI 工具替代人类创作的伦理与市场冲击
- 出版机构、文学奖项、写作教学需要建立 AI 标识与检测机制以维护作品真实性
总结:
匹兹堡大学研究表明,在不知情条件下读者显著偏好 AI 生成的短篇小说,但当知道作者是机器时评分明显下降。这意味着 AI 创作已达到可与人类作家比肩的表面水准,但读者一旦掌握来源信息便会产生系统性偏见。该研究为 AI 与人类创作者之间的竞争提供了重要量化证据,也提醒出版界与教育界尽快建立 AI 内容的标识和审查机制,以应对生成式 AI 对创意产业的深层冲击。
参考来源:
- https://the-decoder.com/readers-rate-ai-generated-short-stories-higher-than-human-ones-until-they-learn-a-machine-wrote-them/
- https://www.cambridge.org/core/journals/judgment-and-decision-making/article/bot-or-not-can-people-tell-the-difference-between-stories-written-by-a-human-or-by-an-ai-system/45E6DC0BB90AA648654D5AE243F6C667
- https://osf.io/d8f6m/files/4pfw3
- https://the-decoder.com/people-prefer-ai-poetry-to-shakespeare-when-they-dont-know-its-ai-poetry/









