跑完SPSS或Stata的回归,面对一堆系数和星号,很多同学的第一反应是直接复制表格到论文里,然后写一句“结果显著”。这恰恰是流水账的根源。我们实验室在分析某大纲生成器时得出的体验是:好的实证描述,必须让读者通过表格看到你的研究逻辑。比如,在分析人工智能论文中特征提取的效果时,我们处理了420家科技企业的面板数据,因变量是模型准确率(Accuracy),自变量包括特征维度($d$)、学习率($\eta$)和正则化系数($\lambda$)。描述性统计表格不仅要列出均值、标准差,更要说明为什么选择这些变量——例如,特征维度过高会导致过拟合,这在后续回归中会通过系数符号体现。
具体到表格规范,描述性统计表应包含变量名、观测数、均值、标准差、最小值和最大值。回归表则需报告系数、标准误、t值或z值、显著性水平,以及模型拟合指标(如$R^2$、调整$R^2$、F值)。我们建议在表格下方用简短段落解释关键发现,例如:“特征维度($d$)的系数为-0.032(p<0.01),表明每增加一个维度,准确率下降3.2%,支持了维度灾难的假设。” 这种写法将数字转化为故事,而非枯燥罗列。