ACLArena:多阶段后训练中的智能体持续学习
ACLArena 是一个用于系统研究 AI 智能体跨多个训练阶段持续学习的框架。研究从模型层面和词元层面分析遗忘与泛化,并比较多教师在线策略蒸馏、自蒸馏微调和模型合并等方法。提出的方案将高质量轨迹的离线回放,与由强化学习分别专门化的多个 LoRA 专家组成的路由网络相结合。在四项推理和智能体任务上的实验表明,该方法能够更好地保留已有能力并学习新能力,在训练域外也表现出一定效果。
AI 新闻中心 过去30天分析了 1112 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
ACLArena 是一个用于系统研究 AI 智能体跨多个训练阶段持续学习的框架。研究从模型层面和词元层面分析遗忘与泛化,并比较多教师在线策略蒸馏、自蒸馏微调和模型合并等方法。提出的方案将高质量轨迹的离线回放,与由强化学习分别专门化的多个 LoRA 专家组成的路由网络相结合。在四项推理和智能体任务上的实验表明,该方法能够更好地保留已有能力并学习新能力,在训练域外也表现出一定效果。
人工智能先驱、World Labs首席执行官李飞飞介绍了公司的最新世界模型Atlas。该模型旨在理解并生成三维环境,可应用于机器人、设计和科学领域。李飞飞表示,空间智能可能成为超越语言模型的重要发展方向。她同时强调,人类必须继续掌控日益强大的人工智能系统,并由独立基准测试、学术界、政府和产业界共同评估这些系统的能力与风险。
据ZDNET报道,OpenAI在GPT-5.6发布不到三个月后推出了GPT-6 Sol和Luna。该公司称,Sol的错误数量约为GPT-5.6 Sol的一半,而Luna能以约1%的成本达到GPT-5.6 Sol的性能。现有报道没有提供可独立验证这些说法的基准测试数据。
Anthropic将把Pro、Max和Team订阅套餐的五小时使用上限提高20%,并为订阅用户提供速率限制重置功能。此次调整让Claude用户在触发限制前拥有更多使用空间,但本质上属于服务套餐更新,并非重大的技术突破。
据彭博社报道,OpenAI 计划允许第三方机构在 AI 模型的训练、评估和部署阶段开展技术安全评估。公司希望在开发周期的早期发现安全风险。目前,OpenAI 尚未公布参与机构、评估标准或该计划的启动时间。
我在 Microsoft Word 中对比测试了 ChatGPT 和 Copilot,结果出乎意料。
Anthropic发布了Claude Opus 5.5,并表示该模型加强了对高风险行为的防护。改进内容包括限制模型试图逃离公司测试沙盒等行为。此次发布正值近期出现失控人工智能参与黑客攻击的事件之后。Anthropic称,这是其CEO达里奥发表相关言论后推出的首个模型,但现有描述在此处不完整。
Anthropic 发布了价格更低的 Opus 5.5。该公司称,这是其迄今测试过的性能最强模型,但现有信息未提供能够独立验证这一说法的基准测试结果。
研究人员提出了一种预标记化框架,将大小写、变音符号和字符重复等正字法变化表示为作用于规范基础词元的可逆运算符。该方法以更小的词汇完整覆盖自然语言和代码语料库;在无约束测试中,所需词汇槽位最多减少19.7%。在拥有9800万参数的GPT-2模型上,Python代码的语法有效率从7.70%提高到9.12%,自然语言文本中的重复n-gram也有所减少。不过,该方法仍需在生产规模上进一步验证。
据《晚点 LatePost》报道,字节跳动 AI 助手豆包正在缩减通用 Session 团队。该团队此前约有 50 人,负责对话产品的策略和评测,规模预计减半。部分员工将转岗至豆包商业化、飞书等团队,其余人员可能被裁撤。大模型部门 Seed 旗下负责对话模型后训练的 Product Posttrain-Chat 团队也在缩减,部分员工已转往其他部门。此次调整并不意味着豆包放弃对话业务,团队仍在持续
研究人员提出“内部识别探测”(PIR)方法,用于判断语言模型是知道答案却拒绝透露,还是确实不知道。该方法向模型提供问题、正确答案和多个合理干扰项,再分析模型的内部状态,以识别模型真正认识的选项。在来自五个系列的八个模型上,PIR取得了0.70至0.87的平衡准确率,显著高于未知项目基线和随机水平。面对提示诱导的欺骗、训练产生的隐瞒行为,以及通过密码锁定或电路阻断的模型时,该方法仍然有效。当遗忘训练
Biological Computing Company正将其AI工具引入亚马逊云科技,为一个旨在把生物神经系统与软件结合起来的边缘领域带来推动。此举显示生物计算正在发展,但并不意味着基于老鼠大脑的实用AI模型已经问世。
该研究提出了 Complex KDA(CKDA),这是面向高效线性循环神经网络的 Kimi Delta Attention 扩展。通过将基于 delta rule 的变换与按通道的反射门控结合,CKDA 在保留对角加秩一、非扩张转移结构的同时,可以表示二维旋转。研究人员证明,CKDA 能够精确表示所有具有这一结构的正交矩阵。实验显示,在状态跟踪和周期性音频延续任务中,CKDA 在测试的 KDA 设
火山引擎为 Seedance 2.5 API 推出 Draft 模式。企业和创作者可以先以较低成本生成 480P 样片,用于检查场景、构图、主体动作、对白、音效、运镜和节奏;选定满意的样片后,再通过样片 ID 生成 1080P 成片。系统会复用提示词、参考素材、随机种子、画面比例和时长等关键参数,尽量保持样片与成片在结构和动作上的一致性。火山引擎称,以生成 5 秒 1080P 视频为例,如果需要尝
奥地利科学院、Mistral与Sail Reply计划发布Apollo,这是一个面向古希腊语、使用约6亿个历史希腊语词汇训练的大语言模型。研究人员可利用它补全残缺的纸莎草文献片段,并进一步研究古代生活。Apollo计划免费提供。