原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.26637
立即前往原文

能力强却更精简:提取并分析前沿模型隐藏的思维链

一项研究探讨如何通过标准 API 注册的简单工具,将前沿语言模型隐藏的思维链过程外显。由于这些轨迹可能只是事后合理化,研究人员先将其与开源模型的原生 CoT 进行比较,随后测试了包括 GPT-6 Astra 在内的闭源前沿模型。提取出的推理在数学、科学和代码生成任务中的表现与原生推理相当,并显著超过不使用推理的基线。研究还发现,不同模型在 token 效率、推理步骤类型和推理树结构方面存在系统性差异。Astra 展现出更具方向性且高效的推理方式,能够更早选择正确路径,同时将简单步骤保留在内部处理,仅外显关键推理。
行业资讯 AI模型 研究 2026-09-25 04:02:01 549 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。