研究显示读者难以区分 AI 与人类小说,且 ChatGPT 作品评分更高

IT之家 8 月 9 日消息,发表在《判断与决策》期刊上的一项最新研究揭示了人工智能在创意写作领域的惊人表现。研究人员邀请了 1,682 名成年人参与实验,阅读 6 篇主题相似的短篇小说,其中 3 篇由人类作家创作,另 3 篇由 ChatGPT 生成。参与者被告知了作品的作者身份(但信息不一定准确),并被要求评价故事的吸引力与质量。结果显示,阅读 AI 生成故事的参与者普遍认为这些作品更具吸引力和高质量。然而,实验也暴露了明显的认知偏差:当参与者被告知故事由人类创作时,无论实际作者为何,他们给出的评分都会更高。为了测试辨别能力,研究人员进行了后续实验,要求 905 名参与者区分人类与 AI 作品。结果显示,参与者的平均正确率仅为 40% 至 52%,接近随机猜测水平,证明了大众无法有效区分两者。值得注意的是,对 AI 系统越熟悉的参与者,其判断准确率越高,这表明 AI 写作已形成特定风格,但这种风格目前仅对“内行”可见。尽管研究证明了 AI 在叙事能力上的进步,但学界人士也提出了警示,指出 AI 生成内容背后的环境成本及伦理问题依然是巨大的隐患。

事件分析

这项研究标志着大模型在创意领域已实质性突破“图灵测试”的叙事门槛。技术层面,ChatGPT 等模型已掌握了流畅的故事结构与情感调动能力,能够产出在可读性上甚至超越人类平均水平的作品。然而,实验中的“标签效应”揭示了公众心理与实际体验的割裂:即便 AI 内容质量过硬,人类依然对“同类创作”抱有情感溢价。随着 AI 内容泛滥,产业可能会面临“识别与被识别”的攻防战:模型训练者致力于消除“AI 味”,而读者则开始学习识别这种风格。此外,关于训练数据版权及能耗的争议,意味着即便技术可行,AI 取代人类创作的商业和伦理之路依然充满阻力。未来,AI 写作工具将从单纯的生成器向辅助人类表达的“副驾驶”角色过渡,以保留创作的“人性价值”。

💡 核心观点:AI 已具备不输人类的叙事能力,但人类创作的核心价值正从“内容质量”转向“人性真实性”。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册