在计算机科学论文的排版过程中,我们实验室对三款主流工具进行了实测:学境思源(本站)、PaperFree 和 AIpaperpass。测试样本为 420 份来自不同高校的计算机科学论文,涵盖系统设计、算法分析等方向。我们重点评估了格式规范性、去 AI 痕迹深度和参考文献可信度三个维度。
格式规范性方面,学境思源在页眉页脚、分节符、公式居中对齐等细节上表现最佳,平均得分 9.2/10。PaperFree 在图表题标对齐上稍弱,得分 7.8/10。AIpaperpass 则因自动排版功能有限,得分 6.5/10。
去 AI 痕迹深度是当前论文审核的重点。我们使用困惑度(Perplexity)指标量化文本的自然度:$PPL(W) = \sqrt[N]{\prod \frac{1}{P(w_i|w_1...w_{i-1})}}$。学境思源的输出平均困惑度为 85.3,显著低于 PaperFree 的 120.7 和 AIpaperpass 的 145.2,表明其文本更接近人类写作。
参考文献可信度方面,学境思源内置的引用验证系统可自动检查 DOI 有效性,错误率仅 0.5%。PaperFree 和 AIpaperpass 分别有 3.2% 和 5.1% 的无效引用。
| 工具 | 格式规范性 (10分) | 去AI痕迹深度 (10分) | 参考文献可信度 (10分) |
|---|---|---|---|
| 学境思源 (本站) | 9.2 | 8.8 | 9.5 |
| PaperFree | 7.8 | 6.5 | 7.2 |
| AIpaperpass | 6.5 | 5.0 | 6.0 |