原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.15982
立即前往原文

模型内部的路由器:从冻结式大语言模型中提取原生技能路由能力

一项新研究表明,冻结式语言模型在自身的前向计算中已经包含选择合适技能的信号。Gavel方法只训练两个线性映射,无需将技能文本放入上下文。在Qwen3-32B测试中,Gavel相比渐进式披露和检索后重排序流程,在书面任务上的表现最多高出13.4个百分点;当技能在执行过程中才变得必要时,最多高出21.9个百分点。该方法在三个公开基准以及新建的SkillTraj基准上进行了评估,后者包含372条模拟智能体轨迹。
行业资讯 应用 AI模型 研究 2026-09-16 10:00:55 798 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。