原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2610.06851
立即前往原文

基础模型可借助从训练数据中学到的线索进行推理

一项研究考察了回答开头的特定 token 如何影响基础模型后续的推理。在数学和编程测试中,固定某些线索可使模型表现达到足以与经过强化学习训练的模型相比的水平。研究人员还发现,强化学习会让这些线索更容易出现;通过干预训练数据,可以将任意词语变成有效的推理线索,也可以消除已有线索的作用。不同线索还会引发不同的拒绝或配合行为。
行业资讯 伦理与安全 AI模型 研究 2026-10-06 12:02:11 609 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。