模型内部的路由器:从冻结式大语言模型中提取原生技能路由能力
一项新研究表明,冻结式语言模型在自身的前向计算中已经包含选择合适技能的信号。Gavel方法只训练两个线性映射,无需将技能文本放入上下文。在Qwen3-32B测试中,Gavel相比渐进式披露和检索后重排序流程,在书面任务上的表现最多高出13.4个百分点;当技能在执行过程中才变得必要时,最多高出21.9个百分点。该方法在三个公开基准以及新建的SkillTraj基准上进行了评估,后者包含372条模拟智能体轨迹。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。