← 返回 AIGC 检测

AIGC 检测是怎么做的,为什么可能不准

一、怎么检测

检测模型读过大量人写的文本和 AI 生成的文本,学会了两者在用词、句式、节奏上的统计差异。检测时,它把论文按段落切开(较长的段落再切成约 270 字的片段),逐段给出一个概率:这段文字更像人写的,还是更像 AI 生成的。

我们按段落汇总结果,标成「人类」「疑似 AI」「AI」三类。AIGC 疑似率 =(判为 AI 的字数 + 判为疑似 AI 的字数)÷ 参与检测的字数。章节标题、目录行和少于 15 字的短段落信息太少,不参与检测,在报告里列为「不予检测」。

二、为什么可能不准

  • 它判断的是「像不像」,不是「是不是」。用词规范、句式整齐的文字,比如摘要、文献综述、研究方法、常见套话,天然更接近模型的输出,人写的也可能被判为 AI。
  • 改写会改变结果。经过多轮润色、语法工具修改、机器翻译的文字更容易被判为 AI;反过来,被人工大幅改写过的 AI 文本也可能检测不出来。
  • 非母语写作容易误判。用中文思维写的英文,句式往往比较规整,常被误判为 AI。
  • 段落越短越不稳。一两句话的信息量不够,结果波动大;同一段文字多次检测,结果也可能有小幅差异。
  • 不同平台不可比。各家检测模型的训练数据、切分方式和判定阈值都不同,同一篇论文在不同平台上的疑似率可能相差很大。

三、怎么用这个结果

  • 重点看报告里标红(AI)和标黄(疑似 AI)的段落,结合自己的写作过程判断要不要改。
  • 学校的认定以学校指定的检测系统和学位评定委员会的决议为准,本检测结果仅供参考。
  • 保留写作过程的材料,比如草稿、修改记录、文献笔记、实验记录。遇到误判时,这些是最有力的说明。

法律依据:《中华人民共和国学位法》(2024 年 4 月 26 日通过,2025 年 1 月 1 日起施行)第三十七条:学位申请人、学位获得者在攻读该学位过程中,学位论文或者实践成果被认定为存在代写、剽窃、伪造等学术不端行为的,经学位评定委员会决议,学位授予单位不授予学位或者撤销学位。