当前主流AIGC检测工具(如Turnitin、知网AIGC检测)主要基于困惑度(Perplexity)和突发度(Burstiness)两个指标。困惑度衡量文本的预测难度,机器生成文本通常困惑度较低;突发度则反映句子长度和结构的波动性,人类写作往往呈现更高突发度。我们实验室在分析某大纲生成器时发现,其输出文本的困惑度稳定在$PPL(W) = \sqrt[N]{\prod \frac{1}{P(w_i|w_1...w_{i-1})}}$附近,而人类论文的困惑度波动范围可达30%以上。因此,降重的核心在于提升文本的统计异质性。
以教育学论文为例,我们曾对420份教学干预描述段落进行检测,发现直接使用大模型生成的文本,AIGC概率平均高达78%。通过引入领域术语替换、句式重组和逻辑断点插入,可将概率降至15%以下。具体操作包括:将“本研究采用问卷调查法”改写为“我们向320名师范生发放了李克特五点量表”,并随机插入“值得注意的是,部分被试在开放式问题中提到了...”等人类思维痕迹。