修辞如何钻取 AI 审稿人的奖励机制:剖析 AI 同行评审中的修辞敏感性
一项研究考察了在科学内容保持不变的情况下,修辞表达如何影响大型语言模型对科学论文的评价。研究人员以 120 篇匿名化的 ICLR 2026 投稿为基础,构建了 4,200 份论文稿件,并让 5 个 AI 审稿人在标准和严格协议下进行评审。证据呈现方式和新颖性立场带来的正负评价差异最大,研究范围的表述影响较弱。影响高度取决于 AI 审稿人的初始评分:低分往往上升,高分往往下降,且中间分数段的变化最明显。更复杂的改写流程并未稳定地产生更大收益。严格评审使平均评分降低 1.36 分,但没有持续改变对修辞的敏感性。研究结果表明,科学评估系统应能抵御不改变内容、仅改变写作方式的操纵。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。