软件工程论文中,架构模式描述段落常因语言生硬、逻辑跳跃而被AIGC检测工具标记。我们实验室在分析某大纲生成器时发现,其输出的“工厂模式”描述中,句式重复率高达37%,远高于人工撰写的12%。这种机器感主要源于大模型对专业术语的过度堆砌和缺乏上下文连贯性。例如,模型倾向于使用“该模式通过…实现…”的固定结构,而人类作者则会穿插“我们注意到…”、“实验表明…”等自然过渡。
为了量化这种差异,我们引入困惑度(Perplexity)指标:$PPL(W) = \sqrt[N]{\prod \frac{1}{P(w_i|w_1...w_{i-1})}}$。在测试中,原始AI文本的PPL值为85.3,而经过人工润色后降至42.1,接近人类写作的35-45区间。这表明降低PPL是去AI痕迹的关键。