Skip to main content
ai-detectionguide

AI概率分数实际上代表什么?

· 9 min read· NotGPT Team

AI概率分数是检测工具扫描文本后显示的数字——通常是一个百分比,声称代表文本来自语言模型而非人类的可能性。这个数字在课堂、新闻编辑室和招聘流程中具有实际影响力,但大多数看到这个数字的人从未学过是什么数学原理产生了它,也不知道为什么同一段落在一个工具上可能显示12%,而在另一个工具上显示68%。本文深入分析了AI概率实际上衡量的是什么,为什么检测工具经常意见不一致,以及如何读取标题数字下方的句子级信号,而不是把百分比当作证据。

AI概率分数实际上代表什么?

AI概率分数不是像指纹匹配那样对作者身份的测量。它是一个统计分类器的输出,该分类器将您的文本模式与它在训练期间从标记的人类和AI生成文本示例中学到的模式进行比较。分类器不知道谁写了您的句子;它估计句子的统计指纹与它所看到的AI生成示例相比与人类编写的示例的相似程度。当检测工具报告73% AI概率时,它表达的是一个置信水平,而不是文档中字面上由机器编写的部分。73%的分数不意味着73%的词来自AI,27%来自人类——它意味着模型对完整段落匹配AI生成模式的整体置信度达到了该水平。理解这一区别改变了这个数字应如何使用:作为判断决定的一个输入,而不是结束对话的判决。

AI概率分数回答的是'这个文本有多像我们的模型在训练中学到的AI生成文本'这个问题——而不是'是否由人类编写的'这个问题。这些是不同的问题,将它们混淆是大多数误读的起点。

为什么AI概率分数在不同的检测工具之间不同?

将同一段落通过三个检测工具运行,通常会看到三个有意义不同的数字,有时相差40或50个百分点。这种差异不是某一个工具坏了、其他工具正确的迹象——它反映了每个系统构建方式的真实差异。检测工具在不同的AI和人类写作数据集上进行训练,所以每个工具学到的典型AI生成文本的定义略有不同。在ChatGPT输出上训练较多的模型可能对由Claude或Gemini生成的文本响应不同,而混合模型输出和人类编辑的文本所处的领域是任何训练集都未清晰覆盖的。分类阈值也有所不同——一个平台可能将50%置信度以上的任何内容标记为'可能是AI',而另一个平台将该标记保留给80%及以上,因此相同的基础置信值会在页面上转化为不同的标题百分比。

  1. 不同的训练数据:每个检测工具从自己的人类和AI写作样本组合中学习,因此分数背后的参考模式在不同工具之间不相同
  2. 不同的分类阈值:即使底层模型产生相似的原始置信值,平台对'可能是人类'结束和'可能是AI'开始的地方也有分歧
  3. 不同的聚合方法:一些工具均匀平均句子级分数,其他工具加权较长的句子或如果任何部分超过阈值则将文档标记为高风险
  4. 不同的更新频率:当新的AI模型发布新的写作风格时,更频繁地重新训练的检测工具比很少更新的工具更快地改变其评分行为
跨平台分歧是最清楚的证据,表明AI概率分数衡量的是与训练分布的相似性,而不是文本本身的固定属性。

检测工具如何计算句子级AI概率?

大多数现代检测工具不是在一步中为整个文档分配单个概率。它们首先逐句工作,然后将这些本地结果组合成您在报告顶部看到的总体分数。每个句子通过一个分类模型,该模型评分其结构和词汇选择与AI生成模式的接近程度,为该句子单独产生本地概率。这些单个分数被聚合——通常作为加权平均,有时作为超过阈值的句子的比例——成为显示为文档总体AI概率的单一百分比。这就是为什么好的检测工具显示突出显示的文本而不是裸露数字的原因:突出显示揭示了哪些特定句子推高了分数,让您检查被标记的段落是模板化过渡、引用的来源,还是真正典型的AI文本。

  1. 句子分割:文档被分割成单个句子或短跨度以进行独立评分
  2. 本地评分:每个跨度根据分类器的训练接收自己的AI概率
  3. 加权和聚合:本地分数被组合,通常针对句子长度或位置进行调整,成为文档级百分比
  4. 阈值标记:聚合分数映射到类别标签,如'可能是人类'、'混合'或'可能是AI'

哪些因素会将AI概率评分推高或推低?

许多常见的写作习惯会提高AI概率评分,即使每个词都是人类输入的。正式的学术风格、高度模板化的结构、对源文档的接近释义,以及用第二语言小心地写作都倾向于产生被认为更可预测和变化更少的散文——这正是检测工具被训练来与AI生成联系在一起的品质。大量编辑有类似的效果:经过多轮抛光以消除尴尬表述的草稿通常比更混乱的原稿更光滑和更统一,这可能会推高其评分,即使人类做了所有的写作和所有的编辑。另一方面,具体的例子、出人意料的词语选择、多样的句子长度和个人或特殊的声音倾向于降低AI概率,因为这些特征对于在可预测模式上训练的模型来说更难持续地重现。这些波动背后的完整统计力学——许多检测工具依赖的困惑度和突发性测量——在一篇关于这两个信号含义的配套文章中有更深入的讨论。

  1. 通用词汇和公式化的过渡倾向于提高AI概率评分
  2. 统一的句子长度和段落结构倾向于提高AI概率评分
  3. 具体的、特定的例子和特殊的声音倾向于降低AI概率评分
  4. 大约200字以下的短文档会产生不太稳定的评分,可能会因小编辑而大幅波动

高AI概率评分能否证明某人使用了AI?

无论多高,单个AI概率评分都不能构成具体的人使用AI来写具体段落的证明。检测工具通过比较统计模式来估计概率,在大量编辑的人类散文和AI生成的散文在相同的测量中如何评分之间存在真实的、有文档记录的重叠。高分意味着文本位于模型与AI输出相关的领域;它不排除谨慎、精确的人类写手碰巧产生具有相似统计特征的散文的可能性。这种重叠正是假阳性发生的原因,也是为什么依赖单一评分来做出指控或评分决定会有真实风险。显示句子级别突出显示的检测工具之所以存在,正是因为原始百分比本身没有提供足够的信息来区分真正的AI生成段落和碰巧读起来可预测的人类段落。

高AI概率评分告诉你一个段落相对于训练分布的位置。它不会告诉你谁输入的。将两者视为等价是对检测结果最常见的误用。

你在实践中应该如何理解AI概率评分?

理解AI概率评分的最有用方式是将其作为更仔细审查的起点,而不是做决定的终点。从突出显示的句子而不是标题数字开始——由两个被标记的句子驱动的65%总体评分,在一个其他方面都很平凡的文档中,讲述的故事与一个65%的评分不同,其中每个句子都被平均标记。检查被标记的文本是否与某个可解释的东西一致,如直接引用、术语有限的短语选项的技术术语,或从源文件接近释义的部分。如果你在评估他人的写作,寻找证实上下文——草稿、修订历史或关于工作的讨论——而不是将评分单独作为充分证据。NotGPT等工具既显示总体AI概率,也显示背后的具体句子,这使这种背景审查成为可能,而不是留下你只有页面上的一个数字。

  1. 在对总体百分比做出反应之前阅读句子级别的突出显示
  2. 注意被标记的文本是否有可解释的原因,例如引用或技术短语
  3. 在将评分视为结论性之前寻找证实证据——草稿、时间戳或对话
  4. 通过第二个工具重新运行边界文档,并比较每个工具标记的具体句子,而不仅仅是标题数字

当AI概率评分让你惊讶时你应该做什么?

你知道是你自己的真实写作的出人意料的高分很常见,不应该立即引起警惕。首先确定检测器标记了哪些句子,并询问它们是否共享一个特征——异常正式的措辞、接近的释义、简短和通用的过渡——这将解释不涉及任何AI的结果。重写被标记的段落以包括更具体的例子、略微不太可预测的词语选择或句子长度的转换是合理的下一步,它通常会降低评分,因为它真正使写作更具特色,而不是因为它欺骗了分类器。如果评分对学术或职业后果很重要,保持你的草稿、笔记和修订历史可用,因为这种类型的过程证据比任何工具的单一百分比有更多的分量。

  1. 识别检测器标记的具体句子,而不仅仅是总体评分
  2. 检查这些句子是否共享一个特征——正式的寄存器、接近的释义、通用短语——这解释了结果
  3. 如果评分需要改变,将被标记的段落修改为更具体、更少可预测的语言
  4. 当评分有真实后果时,保留草稿和修订历史作为证实证据

使用NotGPT检测AI内容

87%

AI Detected

“The implementation of artificial intelligence in modern educational environments presents numerous compelling advantages that merit careful consideration…”

Humanize
12%

Looks Human

“AI in schools has real upsides worth thinking about — but the trade-offs are just as real and shouldn't be glossed over…”

即时检测AI生成的文本和图像。一键将内容人性化。