Prime Agent:可自我改进的 RLM Harness
Prime Agent 是一个开源 harness,用于评估长时程 AI 智能体并支持编程智能体工作流。它将基于递归语言模型概念的持久化 IPython REPL,与可在多次运行轨迹之间保留历史、记忆、技能、提示词和子智能体规范的持续型 harness 结合起来。递归子智能体可以直接通信,Agents View 则允许人工检查和管理由后台服务支持的会话。该系统统一执行、恢复、验证和资源核算,同时将策略构建交给模型。项目方称,Prime Agent 将 ARC-AGI-3 RHAE Best@1 的成绩从 30% 提升至 95.5%,并在长上下文编程、GPU 内核生成、模拟器构建和自主 nanoGPT 测试中达到或超过原生及常用 harness。代码已在 GitHub 发布。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。