觉
AI觉醒星球
Awakening is here
Knowledge File / AI小生意项目库
2026-08-08 5 浏览 免费阅读

读者给AI生成的短篇小说评分高于人类作品,但直到他们得知作者是机器

研究发现,读者无法区分AI和人类写的短篇小说,在不知道作者是AI时甚至给出更高评分;一旦知道是机器所写,评价就会降低。

SOURCE / AI小生意项目库 MIN / 9 ACCESS / 免费阅读 POST / 2026-08-08 22:18:55

原贴

查看原文
作者:Matthias Bastian 来源站点:the-decoder.com 原贴时间:

原文

Readers can't tell the difference between short stories generated by ChatGPT and those written by humans. They even rate the AI-generated texts higher, but only as long as they don't know a machine wrote them. In three experiments with more than 2,500 total participants, test subjects did no better than chance at telling human-written and ChatGPT-generated fictional short stories apart. In the first experiment , each of the 1,682 participants read one of six short stories, each about 1,000 words long. Three came from well-known literary magazines and short story collections. The other three were generated using ChatGPT 4.0, with prompts based on the theme, style, and narrative perspective of the human originals. Half the participants were told the story was written by a human. The other half were told it came from ChatGPT. That information was accurate for only half the participants in each group, according to researchers Sydney Sears and Deena Skolnick Weisberg in their study published in the journal Judgment and Decision Making . ChatGPT's stories were rated significantly higher than the human-written texts on both perceived quality and immersion. For quality, the mean score for AI stories was 1.54 compared to 0.97 for human stories on a scale from minus 3 to plus 3. For immersion, the gap was 1.42 versus 1.00. Participants' own attitudes toward AI also shaped their ratings. Regardless of who actually wrote the story, participants gave higher scores when told a human was the author. Participants with a positive attitude toward AI generally gave higher ratings across the board. When they were also told the story came from ChatGPT, their scores rose even further. Among AI-skeptical participants, this effect flipped. An earlier study on AI-generated poems found a similar bias . In two more experiments with 905 total participants, the researchers made the task harder. Each person read both a human-written and an AI-generated story, then had to figure out which was which. Even with a direct comparison, participants performed no better than chance. Self-reported experience with AI systems correlated positively with the ability to correctly identify the stories' origins. Self-reported experience with fiction, on the other hand, didn't help participants tell them apart. AI-generated texts tend to be smoother, easier to read, and more emotionally upbeat than human-written texts. According to the authors, these traits could explain the higher ratings without the AI stories actually being better in a literary sense. People tend to prefer material that's easier to process. High-quality literary fiction, by contrast, is often intentionally hard to access and pushes readers to work for meaning. A story can be high quality but not very engaging, and vice versa, the researchers suggest. The short story format also likely works in AI's favor. Telling a coherent story in 1,000 words is a very different challenge than doing so across hundreds of pages. Still, the researchers' conclusion is clear: AI can generate creative works people perceive as at least on par with human work, yet people don't believe AI is capable of that.

中文翻译

读者无法区分ChatGPT生成的短篇小说和人类写的短篇小说。他们甚至给AI生成的文本更高评分,但前提是他们不知道是机器写的。在三项实验中,总共有超过2500名参与者,测试对象在区分人类写作和ChatGPT生成的虚构短篇小说方面并不比随机猜测更好。在第一个实验中,1682名参与者每人阅读了六个短篇小说之一,每篇约1000字。三篇来自知名文学杂志和短篇小说集。另外三篇使用ChatGPT 4.0生成,提示基于人类原作的风格、主题和叙事视角。一半参与者被告知故事是人类写的,另一半被告知来自ChatGPT。根据研究员悉尼·西尔斯和迪娜·斯科尔尼克·韦斯伯格发表在《判断与决策》杂志上的研究,这一信息对于每组中只有一半参与者是准确的。ChatGPT的故事在感知质量和沉浸感方面的评分显著高于人类写作的文本。在质量方面,AI故事的平均得分是1.54,而人类故事是0.97,在-3到+3的评分量表上。在沉浸感方面,差距是1.42对1.00。参与者自己对AI的态度也影响了他们的评分。无论故事实际作者是谁,当被告知作者是人类时,参与者给出更高分数。对AI持积极态度的参与者普遍给出更高评分。当他们还被告知故事来自ChatGPT时,分数进一步上升。在怀疑AI的参与者中,这种效应反转了。一项早期关于AI生成诗歌的研究发现了类似的偏见。在另外两个实验中,共905名参与者,研究人员加大了任务难度。每个人阅读人类写作和AI生成的故事,然后必须判断哪个是哪个。即使直接比较,参与者的表现也不比随机好。自我报告的AI系统经验与正确识别故事出处的能力正相关。另一方面,自我报告的小说阅读经验并没有帮助参与者区分它们。AI生成的文本往往比人类写作的文本更流畅、更易读、更情感乐观。作者认为,这些特征可以解释更高的评分,而AI故事在文学意义上并不真的更好。人们倾向于喜欢更容易处理的材料。相比之下,高质量的文学小说常常故意难以理解,迫使读者为了意义而努力。研究人员建议,一个故事可以高质量但不吸引人,反之亦然。短篇小说的形式也可能对AI有利。在1000字内讲一个连贯的故事与在数百页中做到这一点是非常不同的挑战。尽管如此,研究人员的结论是明确的:AI可以生成人们认为至少与人类作品相当甚至更好的创意作品,但人们不相信AI有能力做到这一点。

核心信息

研究发现,读者无法区分AI和人类写的短篇小说,在不知道作者是AI时甚至给出更高评分;一旦知道是机器所写,评价就会降低。

  • 研究发现,读者无法区分AI和人类写的短篇小说,在不知道作者是AI时甚至给出更高评分;一旦知道是机器所写,评价就会降低。
  • 原贴提到:Readers can't tell the difference between short stories generated by Cha
  • 来源:the-decoder.com

详细解读

这是一个什么信号?

近期一项发表在《判断与决策》上的研究揭示了一个反直觉的现象:读者无法区分AI和人类写的短篇小说,甚至在不知道作者是AI时,给AI生成的故事打了更高的质量分和沉浸感分。然而,一旦知道是机器所写,评分就会下降。这一结果说明,AI生成内容已经在水准上“过关”,但人类对AI的偏见依然根深蒂固。

为什么重要?

对于内容产业而言,这意味着AI完全可以承担一部分文学创作工作,并且在“盲测”中不落下风。但价值判断的扭曲点在于“作者身份”——同样的文本,被归因于人类时评价更高。这颠覆了“AI内容不如人类”的常见假设,也提示我们:真实的市场反馈可能更多取决于用户预期和标签,而不是文本本身。短期来看,平台的“AI生成”标识可能反而抑制内容传播;长期来看,随着AI内容普及,这种偏见可能逐渐减弱。

对谁有价值?

对内容创作者:可以用AI辅助生成短篇故事、营销文案等,以提升效率和流畅度,但需注意披露策略。对内容平台:若希望推广AI创作,应设计更巧妙的呈现方式,例如不刻意强调AI身份,或通过用户教育来消除偏见。对研究者:本研究的实验设计和方法论值得借鉴,尤其是控制作者身份信息来测量真实偏好。

可以怎么行动?

1. 内容团队可尝试用AI生成初稿,再由人类编辑修改,这样既保留效率,又可能因人类署名获得评价加成。2. 平台在推荐AI内容时,可先以“匿名”方式测试用户反馈,再决定是否标注来源。3. 创作者个人应提升AI协作能力,学会用提示词控制风格和主题,让AI产出更贴近目标受众的文本。

风险或限制

本研究以短篇小说为例,样本限于约1000字的文章,不一定适用于长篇作品或非虚构内容。此外,参与者是普通读者,不是专业文学评论家;对文学性要求更高的场景(如严肃文学)可能结论不同。更重要的一点是,该研究使用ChatGPT 4.0,未来更强模型可能进一步拉大差距。我们不能因为“盲测”得分高就断言AI写的小说“更好”,因为评分还受流畅度、情绪积极度等因素影响,而文学价值往往不只是这些。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 the-decoder.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《读者给AI生成的短篇小说评分高于人类作品,但直到他们得知作者是机器》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

AI SUMMARY

这篇文章回答了什么

读者给AI生成的短篇小说评分高于人类作品,但直到他们得知作者是机器主要讲什么?

研究发现,读者无法区分AI和人类写的短篇小说,在不知道作者是AI时甚至给出更高评分;一旦知道是机器所写,评价就会降低。

这篇文章最值得关注的要点是什么?

研究发现,读者无法区分AI和人类写的短篇小说,在不知道作者是AI时甚至给出更高评分;一旦知道是机器所写,评价就会降低。;原贴提到:Readers can't tell the difference between short stories generated by Cha;来源:the-decoder.com

这篇文章和哪些AI专题相关?

它适合放在AI副业、AI内容增长、AI超级个体专题里阅读。 关联原因:这篇内容命中「项目、小生意、变现」等主题信号。;这篇内容命中「内容」等主题信号。;这篇内容命中「认知」等主题信号。

阅读这篇文章建议先理解哪些关键词?

建议先理解模型、工作流、副业、创业、项目这些关键词,再结合正文判断工具、机会或风险是否值得进入自己的工作流。

上一篇 OpenAI 意外攻击 Hugging Face 事件时间线现已整理出炉 下一篇 Backflip AI将3D扫描转化为可编辑CAD模型,从数小时缩短至几分钟