如今,人工智能生成的垃圾内容似乎无处不在,从YouTube视频到Instagram短视频,比比皆是。尽管如此,人们通常也不会指望这类粗制滥造的内容登上畅销书排行榜的榜首。
然而,这恰恰正在迅速成为一种常态。到2026年,AI生成的小说类书籍已占据总销售额高达20%的份额,而畅销书榜单的新入榜作品中,有三分之一包含AI生成的内容。

在这14,419本自出版小说电子书中,约有五分之一被发现含有大量AI生成内容。
“人们很容易将AI撰写的书籍视为无人问津的垃圾。因此,借助@pangram的全文本AI检测工具,我们研究了2023年至2026年3月在亚马逊(Amazon)上销售的自出版类型小说。事实证明,亚马逊已被这类书籍淹没……” —— 图欣·查克拉巴蒂(Tuhin Chakrabarty)(@TuhinChakr),2026年7月28日
一篇有趣的新论文对日益严重的AI生成垃圾内容问题具有深远意义。研究作者随机抽样了14,419本自出版小说电子书,使用Pangram的AI检测工具对样本中每本书的全文进行了检测。
样本随后被划分为三个类别:如果AI生成文本占某本书总文本的至少25%,则被归类为“重度AI”;而“轻度AI”则保留给AI内容占比低于25%的书籍。
与此同时,研究作者“将每本书与五大出版商之一的专有每日销售数据流进行匹配”,以获取其三年期间的每日销售数据。
凭借这些数据,研究作者发现了以下有趣的见解:
样本中约20%的书籍(涵盖所有小说类型——爱情、科幻、惊悚等)被归类为“重度AI”。
目前畅销书榜单中约33%的新入榜作品包含AI生成的内容。
三年间,小说类书籍的数量累计增长了惊人的38倍,而收入仅按季度环比增长了9倍。
“进入某一类型的AI书籍越多,非AI书籍失去的地盘就越多。”
“一位作者在发布后12个月内通过8部作品赚取了170万美元,而单本最畅销的重度AI书籍在8万多册销量下创收64.3万美元。”
有趣的是,成功的AI书籍比成功的非AI同类书籍包含更多罕见短语——尽管这些短语已出现在已出版作品中。
AI书籍之间似乎也更频繁地相互抄袭,充斥着逐字重叠的内容。
该研究的核心在于,AI生成的书籍似乎贬低了真正作者的努力,“削减了大多数类型中人类创作书籍的平均收入,并将人类作品推下了畅销书排行榜。”
这一范式真正令人痛心之处在于,据报道,AI实验室为了满足其数据饥渴的模型,批量购买珍稀书籍,撕开书脊进行扫描,然后将原稿粉碎。这是不可替代的损失,而这一切只是为了向模型投喂它们从未见过的数据。



