想象一下,你正在浏览 亚马逊的灵性书籍专区,想找一本关于威卡仪式或印度哲学的书,却发现虚拟书架上绝大多数书籍可能从未被人类作者真正写过。这正是最新一项关于AI 撰写宗教书籍研究所描绘的令人不安的图景:研究发现,机器生成文本已经悄然占据了该平台宗教与灵性出版物的巨大份额。
这项由 AI 检测公司 Originality.ai 本周发布的研究,抽样分析了亚马逊上 14 个宗教与信仰类别中 2,000 多本近期出版的书籍。结论是:几乎每三本书中就有两本很可能是由人工智能而非人类撰写。
Summary
要点概述
- Originality.ai 在亚马逊上分析的宗教书籍中,将 1,272 本(共 2,034 本)——即63%——标记为很可能由 AI 撰写。
- 巫术类别记录到的比例最高,为 78%,印度教为 76%,道教为 74%。
- 研究人员将巫术类书籍中53%可核查的论断标记为可能是错误的。
- 亚马逊依赖一种“荣誉制度”,要求作者自行披露 AI 撰写的作品,但没有公开数据表明实际有多少人这样做。
- 亚马逊已确认会通过商业渠道购买纸质书籍,并扫描其页面用于 AI 训练数据。
亚马逊上的宗教书籍多数可能由 AI 撰写
单从数字来看,这项研究就足够惊人:被抽样的宗教书籍中有 63%在 Originality.ai 的检测模型中得分足够高,被归类为很可能由机器撰写。这并不是隐藏在某个小众角落的边缘现象——它代表了一个涵盖多种世界宗教的完整商业类别中的主流结果。
Originality.ai 的研究与方法论
报告作者 Michael Fraiman 表示,他的团队分析了每本书的简介、作者简介以及文本样本,并将这些内容输入评分模型。任何得分达到 50 分或以上的书籍都被归类为“很可能由 AI 撰写”。在审查的 2,034 本书中,有 1,272 本跨过了这一门槛。
Fraiman 谨慎地将研究结果表述为“概率”而非“证据”。他对 Decrypt 表示:“我们不会对某本书是否绝对由 AI 撰写做出确定性主张。我们的模型是判断某些内容由 AI 撰写的可能性,并给出一定程度的确定性。”他补充说,研究人员还对被标记的书目进行了人工抽查,称团队在目前的工作阶段已经能够“分辨出很可能由 AI 撰写的内容与人类撰写内容之间的差异”。
各宗教类别中的 AI 作者比例
并非所有信仰传统都受到同等影响。巫术类别——取自亚马逊的威卡、巫术与异教(Paganism)书单——以 78% 的比例位居榜首,涵盖了关于疗愈水晶、草药疗法以及净化负能量的书籍。Fraiman 指出,这类书籍对出版商的吸引力显而易见:它们可以承诺在心理健康或“排毒”方面提供解决方案,而无需满足任何科学标准。
印度教紧随其后,比例为 76%,道教为 74%。锡克教、佛教、伊斯兰教、天主教、新教、东正教和犹太教则介于其间。摩门教为 42%,无神论为 40%,撒旦教为 22%——是所有研究类别中比例最低的。研究人员提醒,各类别的样本量差异很大,这限制了这些百分比之间可以直接比较的程度。
AI 检测中的验证难题与误报风险
高 AI 检测得分并不自动意味着一本书具有误导性——但在巫术类别中,研究发现两者之间存在令人担忧的重叠。研究人员将巫术类书籍中53% 的可核查论断标记为可能是错误的,这引发了担忧:读者可能会转向 AI 生成的灵性指导来获取健康或养生建议,而这些内容从未经过任何人的审查。
AI 写作检测工具的局限性
像 Originality.ai 这样的检测工具,其设计目标是估算“可能性”,而不是给出“裁决”。这一点非常重要,因为作为一个类别,AI 检测技术的稳定性记录并不理想。Fraiman 自己的表述——模型提供的是“一定程度的确定性”,而非确凿证据——反映了整个行业更广泛的共识:目前没有任何检测器能够保证准确无误。
AI 检测结果相互矛盾的案例
AI 检测器的不可靠性并非假设。2024 年 10 月,对美国《独立宣言》进行的一次测试中,四款不同工具给出了截然不同的结论:ZeroGPT 认为其 97.93% 为 AI 生成,QuillBot 认定其完全由人类撰写,而 GPTZero 则给出了 89% 的人类作者概率——三款工具,对同一份 18 世纪文献给出了三种相互矛盾的答案。
到了 3 月,事态变得更加严肃:哥伦比亚最高法院在一份法律文件被检测器标记为 AI 生成后,拒绝受理该文件。具有讽刺意味的是,当一名律师随后将法院自己的裁决文本输入同一检测器时,结果显示其 93% 为 AI 生成。这一事件凸显了为何将检测得分视为可直接用于法庭的证据在法律上仍然站不住脚。
亚马逊在 AI 内容与训练中的角色与伦理问题
亚马逊处在两个既独立又相关的争议中心:一是它如何监管在其平台上销售的 AI 撰写书籍,二是它如何获取原始文本来训练自家的 AI 模型。这两种做法目前都缺乏足够的公众透明度。
亚马逊对 AI 内容披露的“荣誉制度”
据 Fraiman 称,“亚马逊很清楚其平台上 AI 撰写内容的普遍程度,并采用荣誉制度,让作者自行标明其作品是否由 AI 撰写。”Originality.ai 在发布研究前并未将其发现告知亚马逊,Fraiman 也直言不讳地表示:“我们没有任何数据表明究竟有多少作者真正进行了披露。”亚马逊并未立即回应 Decrypt 的置评请求。
这一点之所以重要,是因为缺乏核查的自我披露,会在“技术上要求的内容”与“实际发生的情况”之间留下巨大鸿沟。如果宗教书籍中 AI 撰写的比例真的接近三分之二,那么单纯依赖荣誉制度可能只捕捉到了其中的一小部分。
将纸质书用于 AI 训练及其伦理担忧
另一方面,亚马逊对训练数据的渴求也引发了其如何处理纸质书籍的质疑。有调查追踪到一批珍本书被运往拉斯维加斯的一处亚马逊设施——在那里,工人会将书脊切除,把书页扫描进 AI 训练数据集。
亚马逊确认称,公司“通过商业渠道购买书籍,以帮助开发和改进客户使用的产品和服务”,但其声明并未明确提及专门用于 AI 训练。
综合来看,这两条线索指向同一潜在张力。一方面,AI 生成文本正涌入诸如宗教出版等类别,充斥着未经事实核查、甚至在某些情况下包含错误论断的内容。另一方面,用于构建这些 AI 系统的原始材料,则来自在缺乏充分公众问责的情况下被毁掉的纸质书籍。无论是亚马逊针对卖家的自我披露制度,还是其为训练数据获取书籍的流程,目前都未能在规模层面提供足够透明度——读者、作者与书商只能在很大程度上依赖外部调查,来了解这家线上书店背后究竟发生了什么。
常见问题
在亚马逊上检测 AI 撰写宗教书籍的可靠性如何?
Originality.ai 使用的是一种评分系统,用来指示“可能性”而非“确定性”。研究人员提醒,这些结果指向的是很可能由 AI 撰写,而不是确凿无疑的证据。
哪个宗教书籍类别中“很可能由 AI 撰写”的比例最高?
巫术类别的比例最高,在抽样书目中有 78% 被标记为很可能由 AI 撰写。
亚马逊将纸质书用于 AI 训练引发了哪些伦理担忧?
亚马逊会购买并扫描纸质书籍,有时包括珍本书,用于 AI 训练,然后将其丢弃,这引发了关于毁坏原始资料以及缺乏作者明确同意的伦理担忧。
亚马逊是否要求作者披露其书籍是否由 AI 撰写?
亚马逊采用荣誉制度,由作者自行标明 AI 撰写内容,但目前没有公开数据表明究竟有多少人真正进行了披露。
{“@context”:”https://schema.org”,”@type”:”FAQPage”,”mainEntity”:[{“@type”:”Question”,”name”:”在亚马逊上检测 AI 撰写宗教书籍的可靠性如何?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”Originality.ai 使用的是一种评分系统,用来指示“可能性”而非“确定性”。研究人员提醒,这些结果指向的是很可能由 AI 撰写,而不是确凿无疑的证据。”}},{“@type”:”Question”,”name”:”哪个宗教书籍类别中“很可能由 AI 撰写”的比例最高?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”巫术类别的比例最高,在抽样书目中有 78% 被标记为很可能由 AI 撰写。”}},{“@type”:”Question”,”name”:”亚马逊将纸质书用于 AI 训练引发了哪些伦理担忧?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”亚马逊会购买并扫描纸质书籍,有时包括珍本书,用于 AI 训练,然后将其丢弃,这引发了关于毁坏原始资料以及缺乏作者明确同意的伦理担忧。”}},{“@type”:”Question”,”name”:”亚马逊是否要求作者披露其书籍是否由 AI 撰写?”,”acceptedAnswer”:{“@type”:”Answer”,”text”:”亚马逊采用荣誉制度,由作者自行标明 AI 撰写内容,但目前没有公开数据表明究竟有多少人真正进行了披露。”}}]}
本文在人工智能协助下完成,由编辑团队进行审阅。

