研究拆解 57 万笔 ChatGPT 对话:2% 用户写出超 8 成小说对话

研究拆解 57 万笔 ChatGPT 对话:2% 用户写出超 8 成小说对话

N
News Editor
2026-07-22 09:14:58
华盛顿大学与科罗拉多大学波德分校研究团队分析 573,453 笔 WildChat 英文对话,发现其中 195,271 笔涉及虚构内容生成,占 34%。但按用户去重后,小说类占比降到 7.1%。研究还显示,小说子集中 2% 的用户贡献了超过 80% 的对话数,且《心跳文学社》是最常见的同人世界观之一。论文据此指出,用使用量描述用户行为,可能会放大少数重度用户的影响。
ChatGPTOpenAIWildChat华盛顿大学AI 创作同人小说学术研究

华盛顿大学与科罗拉多大学波德分校的研究团队分析了 573,453 笔真实 ChatGPT 风格对话,试图弄清用户如何用 AI 写小说。结果显示,在涉及虚构内容生成的账户里,少数重度用户占据了极高比重:小说子集中仅 2% 的用户,就贡献了超过 80% 的对话数。

这项研究来自论文《AI Fiction in the Wild》,于 2026 年 6 月 22 日上传至 arXiv,编号为 2606.22748。作者包括华盛顿大学信息学院的 Neel Gupta、Melanie Walsh,以及科罗拉多大学波德分校计算机科学系的 Maria Antoniak。论文曾于 2025 年 9 月在普渡大学的 MFS Cultural AI 研讨会发表,预计刊登于文学期刊《MFS: Modern Fiction Studies》。

一段被重复上千次的小说场景

论文收录了一段特殊案例:一名匿名用户在数月内多次向模型提交几乎相同的提示词,反复要求续写同一个场景。文本设定在学校社团教室里,角色包括 Natsuki、Sakura 和社长 Monika,情节围绕分娩场景展开,提示词停在一句未写完的话中,把续写位置留给模型。随后,这名用户将几乎相同的内容再次贴入对话框,如此重复上千次。

这段案例在 7 月初被日本媒体 AUTOMATON 和游戏媒体 Dexerto 报道后,很快在 X 上广泛传播,成为当月科技圈的热门话题之一。

报道中常把这名用户称为“极端离群值”,但论文正文并未使用这个说法。研究者实际采用的是“特别多产的离群值”,以及他们自定义的分类“无限故事索求者”,指长期反复索取同一段或高度相似故事内容的用户。

34% 对话涉及虚构内容生成

研究使用的数据集名为 WildChat,包含 573,453 笔英文对话。分类后,其中 195,271 笔与虚构内容生成有关,占总量的 34%。

在这 19 万余笔小说相关对话中,同人创作有 95,450 笔,占 49%;情色小说内容有 52,231 笔,占 27%。论文指出,这两类内容存在较高重叠。

从作品世界观看,最常见的是《Doki Doki Literature Club!》,共有 22,381 笔对话,占小说子集的 11.5%。排在后面的依次是《Freedom Planet》5,204 笔,占 2.6%;《英雄联盟》4,514 笔;《火影忍者》4,342 笔。

论文特别提到,这一榜单与全球最大同人平台 AO3 的热门作品分布并不一致。AO3 上排名靠前的通常是《哈利波特》《星际大战》以及漫威等西方主流 IP,而 WildChat 呈现出完全不同的结构。

2% 用户贡献超 80% 的小说对话数

论文中的核心结论之一是:在小说子集中,2% 的用户要为超过 80% 的对话负责。

研究同时强调,这里的统计单位是“对话数”,不是互动量、消息数,也不是 token 数。原始素材在传播中常被表述为“2% 的账号贡献了超过 8 成互动量”,但论文并不是这样写的。

为了衡量这些重度用户是否反复索取相近内容,研究者计算了“提示词重复率”,即同一用户的提示词有多大比例落入相同语义聚类。

  • 一般用户(至少有两笔对话)的重复率为 42%
  • 前 2% 的重度用户为 69%
  • 最多产的前十名用户为 85%

这组数据表明,重度用户不仅贡献了更多对话,也更频繁地围绕同一类内容反复生成。

数据来自免费 GPT 界面,不是 OpenAI 直接样本

论文也对数据来源做了明确说明。WildChat 由艾伦人工智能研究院(AI2)收集,时间范围为 2023 年 4 月 9 日至 2024 年 5 月 1 日。

这些数据并非来自 OpenAI 提供的后台记录。AI2 当时在 Hugging Face Spaces 上搭建了可免费使用的 GPT-3.5 Turbo 和 GPT-4 聊天界面,用户在两次同意弹窗后,就能获得无需登录、没有速率限制的免费访问权限,但相应代价是聊天记录可能被公开。

论文方法部分写明,WildChat 不是所有 ChatGPT 用户的代表性样本。研究者推测,这批用户可能比一般用户更懂技术、更活跃于网络,也可能来自低收入地区、来自 ChatGPT 被禁用的国家,或者本身就希望测试模型边界、生成平台限制内容。

按用户去重后,小说占比从 34% 降到 7.1%

研究团队随后用经过哈希处理的 IP 地址来估算用户身份。12,947 个 IP 最终收敛为约 10,082 名用户,然后每名用户只保留 1 笔对话。

在这一处理方式下,小说类内容在数据中的占比从 34% 下降到 7.1%。同一批数据、同一个问题,仅仅改变统计方法,结果就出现了接近 5 倍的差距。

论文还在注脚中补充,改为“一人一则”后,《Doki Doki Literature Club!》的排名急剧下滑,取而代之的是《权力的游戏》和《宝可梦》这类更大众化的作品。

换句话说,“ChatGPT 用户最爱写《Doki Doki Literature Club!》同人”这一印象,本身很大程度上是少数用户高频重复行为堆出来的结果。

研究者如何理解这类重复生成

论文没有把那名匿名用户单纯视作笑料。研究者把这种行为放进“重复消费”的心理学语境中理解,例如反复观看同一部电影、反复去同一个城市或美术馆。有些研究甚至认为,这类体验并不像表面看起来那样完全重复。

他们还借用了角色扮演游戏中的“re-rolling”概念,也就是玩家不断重开,直到刷出满意属性。研究者观察到,这名用户常常会在某次生成之后,把模型刚刚给出的回复接回自己的提示词里,再次开始一轮,显示他在某个版本上达到了自己认可的状态。

论文对这种创作方式的描述是:用大型语言模型生成的故事,每一个结局都略有不同,同一个故事被不断重新制作成新的版本。

在论文框架下,这名用户不是一个单纯异常值,而是一种“新型读者”的极端形式。研究者称其为“唯我论的读者兼作者”,也就是同一个人在封闭对话循环中同时生产和消费故事,而另一端没有其他人类参与。

按论文的说法,在 AI 创作场景里,写作与阅读这两个角色可能集中到同一个人身上。

论文指向的问题:使用量不等于用户结构

研究最后把焦点拉回到更大的统计问题。像“AI 正在改变人类创作”“AI 生成内容爆发式增长”“某平台每月生成数亿条内容”这类说法,并不一定错误,但它们往往省略了同一个前提:到底是谁在使用,以及用了多少次。

在这份 57 万余笔对话的数据里,若只看总量,34% 与小说相关,确实像是明显趋势;但把每个用户权重拉平后,占比缩小到 7.1%。

论文并未否认 AI 写作正在发生。研究者也表示,他们认为类似的重度用户“很可能也在 ChatGPT、Claude、Gemini 上强迫性地生成小说”。

不过,这项研究提出的关键问题是:如果用“使用量”去描述“用户”,结论可能会被少数重度使用者显著放大,而当前 AI 产业公开的大量指标,采用的正是这类统计口径。

本文源自 arXiv 论文《AI Fiction in the Wild》,由 BlockTempo 整理报道。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
700

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。