ScienceBuddy:面向交互式科学智能体的递归式自我改进
ScienceBuddy 是一个交互式科学研究工作空间,旨在帮助科学智能体持续改进。系统将研究人员的请求、反馈和执行证据转化为持续学习任务与评估标准。其核心的“递归中的递归”方法,将智能体运行框架的演进与模型强化学习结合起来:内层递归在固定模型的情况下改进运行框架,外层递归则利用改进后的框架训练模型。项目通过涵盖四类科学任务的案例,展示了研究者互动、框架优化和模型学习,并以研究产品形式发布。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。