《匕首口》是人工智能写的吗?H.M.沃尔夫的争议解释

Avatar
丽莎·恩斯特 · 28.07.2026 · 人工智能 · 11分钟

没有确凿的公开证据表明H.M.沃尔夫使用生成式人工智能撰写了《匕首口》。 然而,这场争议并非基于一句奇怪的句子或一个社交媒体传闻。分析了超过14,000部自助出版小说的研究人员报告称,该书的AI检测得分为60%,他们还发现了在其他被标记为AI撰写书籍中反复出现的不寻常的多词短语。

沃尔夫坚决否认使用生成式人工智能,西蒙与舒斯特出版社表示支持该书。因此,最准确的答案比“证明是由AI写作的书”或“毫无根据的指控”更为 nuanced:现有证据在技术上具有重要意义,但并不能确定作者身份。

关键要点

《匕首口》是人工智能写的吗?

老实说:尚未有定论。关于AI介入的最有力的公开论据结合了两个发现:高Pangram检测器结果以及在研究人员分类为包含大量AI文本的其他近期出版书籍中反复出现的罕见表达。

这些发现比仅仅声称散文“听起来像ChatGPT”的说法更能证明指控。它们仍然是间接证据。AI检测器估算文本中的模式;它无法观察谁输入了一个句子,哪个软件是打开的,一个人是否大量编辑了生成的草稿,或者类似的措辞是否独立出现。

问题 当前答案 置信度
研究人员是否标记了这本小说? 是的。据说基础数据在该研究的方法下给了它60%的AI检测得分。 已报告且方法论上已记录
H.M.沃尔夫是否承认使用生成式人工智能? 没有。沃尔夫明确否认了这一点,并表示她自己写了这本书。 确认的公开立场
检测器分数是否证明了文本的作者? 不。这是概率性证据,而不是写作过程的直接记录。 清晰的方法论限制
是否有独立的法证审计解决了争端? 截至2026年7月28日,尚未公开此类审计或完整的手稿历史。 未解决

H.M.沃尔夫的争议如何发展

《匕首口》最初是一本成功的自助出版Kindle图书,并通过BookTok等读者社区传播。它的流行使其超越了通常关于低劣“AI垃圾”的争论:这是一本拥有热情的读者、强大的销量和主要出版协议的小说。

日期 发展
2025年末 Kindle自助出版版成为一部病毒式科幻言情热门。
2026年2月 《大西洋月刊》报道称,西蒙与舒斯特公司以七位数的价格获得了该小说及其续集的出版权。
2026年7月22日 研究人员在arXiv上发布了工作论文“生成式AI充斥并稀释图书市场”。
2026年7月26日 论文的修订版本提交,但仍处于审阅中。
2026年7月27日 《大西洋月刊》将《匕首口》确定为研究报告中“substantial-AI”类别中商业上最成功的作品,并发布了沃尔夫的否认。
2026年7月28日 Scarlett Press发行了西蒙与舒斯特列出的544页精装版。
一个人在桌子上打开的笔记本电脑旁边笔记本里写笔记

来源: pexels.com

这张图说明了草稿、笔记、版本历史和编辑往来的类型,这些都可以为手稿的创作方式提供更强的证据。

60%的Pangram结果究竟意味着什么

该研究并未计算出聊天机器人写了《匕首口》确切60%的词。其研究人员将书籍分成章节,并使用Pangram 3.3分析了符合条件的散文。他们排除了目录、致谢、献词、版权页、作者简介和预览等内容。

对于该研究的主要衡量标准,一本书的AI得分是Pangram未标记为“人类写作”的已分析窗口的百分比。研究人员将归类为AI生成的窗口与归类为中度AI辅助的窗口组合在一起。第二类可以包括混合工作流程,例如AI润色人类散文或一个人大量修改生成文本。

这个区别很重要。头条数字证明了许多段落显示了在一种检测器和一种方法论下与AI辅助写作相关的模式。它不是一个字面上的作者身份百分比,也无法揭示一个段落背后的确切工具、提示、人或修订顺序。

为什么这个数字仍然引起高度关注

Pangram 2026年5月的模型卡报告显示,在其长篇英语创意写作测试集中,误报率为0.01%,在AI创意写作中,漏报率为0.23%。这些基准数字使得高分比随意在线检测器分数更难被忽略。研究论文报告了其评估中类似的低加权错误率。

《大西洋月刊》还报道了一个惊人的章节级结果。研究团队将第18章分成12个片段,Pangram将所有12个都归类为AI生成。马里兰大学计算机科学教授Mohit Iyyer(未参与该研究)据称认为,一本完全由人类写作的书的60%得分在统计学上非常不可能。这是对证据的专家解释,而不是对写作过程的直接证明。

然而,即使是Pangram也警告说,它的模型存在非零的错误率,并且错误的指控会造成声誉和情感上的伤害。基准测试描述了在选定数据集上的性能;它不能保证每本新小说都能被正确分类。这就是为什么检测器结果应该被情境化,而不是被当作判决。Zerlo关于 解读AI写作检测器 的指南在学术环境中解释了相同的核心原则。

书桌上打开的笔记本电脑旁边是一本打开的书

来源: pexels.com

AI检测比较文本中的统计模式。它可以加强或削弱一个假设,但它不能直接观察作者身份的过程。

第二种证据:罕见表达的重叠

研究人员不仅依赖Pangram。他们还搜索了“罕见表达”:至少五个词的序列,这些词在谷歌图书的卷数很少,在大型互联网快照中不存在,但却在疑似AI组的书籍中反复出现。

《大西洋月刊》报道称,《匕首口》包含多个这样的表达,这些表达也出现在无关作者的书籍中,并且逐字相同。这一点很重要,因为一个检测器可能会错误地分类一种独特的风格,而一个独立的、不寻常的特定短语重用模式则指向一个共享的生成过程或其他共同来源。

H.M.沃尔夫的回复和出版商的立场

沃尔夫的回应毫不含糊。她通过律师发表声明说,暗示使用生成式人工智能写作《匕首口》的说法是不真实的,她自己写了这本小说,并且她反对生成式人工智能对作家、艺术家和更广泛的创意界产生影响。

她还认为,不应该基于已知有缺陷的技术提出指控,因为这种说法会对作者造成严重后果。西蒙与舒斯特的发言人Susannah Lawrence告诉《大西洋月刊》,该公司支持这本书,并且它经过了与公司其他图书相同的编辑和制作过程。

这些声明确立了作者和出版商的立场,但它们并没有独立解决技术发现。根据报告,他们都没有直接回答记者关于与其他近期电子书共享的罕见表达的问题。

为什么AI检测器本身无法证明作者身份

AI写作检测经常被误解为剽窃匹配的数字等价物。它不是。剽窃软件可以指向包含相同词语的特定来源。AI检测器通常会估计语言模式是否与其人类或机器生成文本的示例相似。

因此,负责任的表述不是“Pangram证明沃尔夫使用了AI”。而是“Pangram和短语重叠分析产生了研究人员认为难以与完全由人类写作的手稿相调和的证据”。沃尔夫对此推断提出异议。

什么证据可以更有说服力地解决这个问题?

更具决定性的评估将检查创作历史,而不仅仅是最终文本。有用的证据可能包括:

这些项目中的任何一项都不能单独决定胜负。草稿可以导入,记录可能不完整,作者有合理的隐私和合同顾虑。但是,一个连贯的文档历史将比仅仅基于风格推断更直接地回答作者身份问题。

为什么《匕首口》的争议比一本书更重要

基础研究认为,AI参与的虚构作品不再局限于明显的垃圾邮件。在其数据集中,AI检测文本超过25%的书籍占目录的20%,销售额的12.1%,收入的11.3%。作者更广泛的说法是,即使个别书籍的平均收入较低,生成式AI也可以通过数量重塑出版业。

《匕首口》提出了一个更尖锐的问题,因为读者在指控出现之前就接受了它。如果一本畅销小说可以包含大量AI辅助文本而不被读者注意到,那么出版业的争论将从“AI能否创作可读的虚构作品?”转变为“作者和出版商应该披露什么程度的AI参与?”

披露影响的不仅仅是品味。它会影响合同、原创性保证、版权分析、应给予编辑和合作者的贡献、读者的期望以及指控带来的声誉风险。音乐领域已经出现了类似的紧张关系,正如Zerlo关于 HAVEN.AI歌曲移除争议.

书架上摆放着书籍和公共电脑工作站

来源: pexels.com

这场争论超出了一个畅销书的范畴:出版商、平台和读者越来越需要关于AI协助、披露和证据审查的明确标准。

读者应该如何理解这场争议

读者不必假装证据毫无意义,也不必将未解决的指控视为供词。公平的阅读将证据分为三个层面:

  1. 已确认: 研究存在,其方法是公开的,并且据说基础数据根据该方法给了《匕首口》60%的得分。
  2. 争议: 研究人员认为,AI检测器和短语证据的组合表明AI介入;沃尔夫表示她没有使用生成式人工智能。
  3. 未解决: 没有公开的手稿审计或完整的创作历史可以确切说明该书是如何制作的。

这个框架保护了合理的审视和基本的公平。它允许读者要求出版商提供更好的披露标准,而不声称一个概率性工具已经给出了最终判决。

常见问题解答

《匕首口》被证实是AI写的吗?

没有。研究人员报告了AI生成或中度AI辅助文本的强烈迹象,但没有直接的公开证据证明H.M.沃尔夫使用了生成模型。沃尔夫否认这样做。

报告的60% AI得分意味着什么?

这意味着在研究的Pangram为基础的方法下,60%的已分析文本窗口据称被标记为“非人类写作”。这并不意味着调查人员证明了聊天机器人写了确切60%的词或页。

H.M.沃尔夫是否承认使用AI来写《匕首口》?

没有。沃尔夫表示她自己写了这本书,拒绝了指控,并表示她反对在写作过程中使用生成式人工智能。

调查中提到的罕见表达是什么?

它们是至少五个词的序列,研究人员认为这些词在已建立的书籍和网络上并不常见,但却出现在多个被标记为AI文本的近期标题中。它们的重复作为除了检测器分数之外的附加信号。

Pangram是否足够可靠以识别AI写成的书?

Pangram报告在其长篇创意写作基准测试中错误率非常低,这使得它的发现具有相关性。其模型卡仍然说明错误仍然发生,并警告错误的指控会造成伤害。因此,结果应该支持调查,而不是取代调查。

该研究是否经过同行评审?

没有。该论文在2026年7月争议出现时仍被列为待审的工作论文。同行评审可能会识别出方法论和解释中的优点、缺点或必要的修改。

出版商是否撤回了《匕首口》?

没有。西蒙与舒斯特的官方列表显示,Scarlett Press于2026年7月28日发行了544页的精装版,并且出版商公开表示支持这本书。

底线

H.M.沃尔夫的《匕首口》AI书籍争议仍未解决。60%的Pangram结果,研究人员报告的章节级发现以及罕见表达的重叠构成了严重的间接证据。它们证明了审视的合理性,使得简单的驳回变得困难。

然而,它们并不能证明手稿的创作历史。沃尔夫否认使用生成式AI,出版商支持她,并且没有公开的法证审计证实了这一点。在出现更强的过程证据或研究经受进一步独立的审查之前,最可以辩护的结论是,《匕首口》已被强烈标记为可能涉及AI——而不是被确凿证明是由AI写成的。

分享我们的文章!
来源