原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.23552
立即前往原文

Prime Agent:可自我改进的 RLM Harness

Prime Agent 是一个开源 harness,用于评估长时程 AI 智能体并支持编程智能体工作流。它将基于递归语言模型概念的持久化 IPython REPL,与可在多次运行轨迹之间保留历史、记忆、技能、提示词和子智能体规范的持续型 harness 结合起来。递归子智能体可以直接通信,Agents View 则允许人工检查和管理由后台服务支持的会话。该系统统一执行、恢复、验证和资源核算,同时将策略构建交给模型。项目方称,Prime Agent 将 ARC-AGI-3 RHAE Best@1 的成绩从 30% 提升至 95.5%,并在长上下文编程、GPU 内核生成、模拟器构建和自主 nanoGPT 测试中达到或超过原生及常用 harness。代码已在 GitHub 发布。
行业资讯 应用 行业新闻 研究 开源 2026-08-25 11:31:22 217 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。