AI 新闻中心

AI 新闻中心 过去30天分析了 4731 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Periscope扩展冻结语言模型,突破上下文窗口限制

Periscope是一种无需训练的推理方法,可让冻结的语言模型处理超长文档,而无需一次性将全文载入上下文缓存。该方法将文档切分为多个区块,同时评估局部片段和覆盖全文的跨步片段,并据此生成证据图,找出最可能支持答案的区块。在LongBench v2中,仅阅读排名最高的9,000个token,就达到了同一模型在3.2万至100万个token上下文中采用窗口读取时的最佳表现。在InfiniteBench

RobotUse 为机器人智能体分配计算、上下文与决策

RobotUse 是一个面向机器人智能体的框架,用于组织物理动作的指定、执行与修正。智能体通过视觉选择目标和姿态,后端负责几何计算、运动规划与控制。子智能体会保留每个子目标中的详细交互信息,持久化操作手册则支持系统从执行结果中学习。在 RoboLab 测试中,RobotUse 的任务成功率达到 45%,比 CaP-X 高 6.7 个百分点,同时保持较小的决策上下文,并减少对预定义动作抽象的依赖。研

PerturBot:通过扰动训练打破视觉-语言-动作模型的捷径先验

视觉-语言-动作(VLA)策略可能依赖训练数据中的捷径完成任务,而没有充分利用决策所需的证据。这些捷径可能来自视觉线索、熟悉的词语或动作模式。PerturBot旨在降低这种依赖:在保持任务不变的前提下扰动腕部摄像头视角,在指令中加入与决策相关的描述,并纳入随机及失败的轨迹片段,再根据其中实际包含的行为重新标注。研究还提出GroundingFscore,用于离线诊断策略对模态捷径的依赖程度。该框架改

面向扩散语言模型的表征空间 MMD

这项研究提出一种扩散语言模型的后训练方法,在冻结的预训练模型特征空间中,最小化生成分布与参考分布之间的最大均值差异(MMD)。保留各个 token 位置的上下文特征后,只需运行一次特征提取器,每个序列便可提供多个观测值。离散模型通过策略梯度优化目标,连续模型则通过生成的潜变量进行直接微分,因此无需完整采样轨迹,也无需联合训练辅助模型。实验显示,在 OpenWebText 上熵相近时生成困惑度更低,

TextReg:通过正则化文本空间优化缓解提示词分布过拟合

该研究探讨了迭代优化提示词如何导致提示词变长,并累积只适用于训练样本的狭窄规则,从而削弱模型在训练分布之外的泛化能力。TextReg采用正则化文本梯度来应对这一问题,包含双重证据梯度净化、语义编辑正则化和正则化引导的提示词更新三个部分。作者称,在多个推理基准测试中,TextReg的分布外准确率相比TextGrad最高提升11.8个百分点,相比REVOLVE最高提升16.5个百分点。

AMD CEO苏姿丰访台会见客户与供应链伙伴

AMD CEO苏姿丰10月5日抵达台湾,行程包括会见客户和供应链伙伴。她表示,10月6日上午已与鸿海董事长刘扬伟会面,下午计划拜访台积电。苏姿丰称,2026年计算市场需求强劲,仍远高于供给;AMD正扩大产能,预计2027年将大幅增产。AMD对台湾供应链的新台币100亿元投资计划进展符合预期,公司也可能因需求增长而追加投资。为补充台积电CoWoS先进封装产能,AMD还在评估其他先进封装技术。

Code2Games:让编程智能体生成游戏世界

Code2Games是一种智能体框架,可将自然语言描述的游戏构想转化为结构化游戏世界。它协调场景分析、玩法规划与世界生成,随后将结果适配到Unreal Engine 5。执行引导式重建流程利用编译诊断、运行时反馈和游戏测试,解决引擎适配过程中出现的不一致。研究人员还推出了GameCode4D基准,包含十个游戏提示。在实验中,与所评估的基线方法相比,Code2Games提升了生成世界的视觉质量和交互

MemAdapter:通过反事实适应减少记忆诱发的迎合行为

MemAdapter 是一个旨在减少 LLM 智能体利用存储记忆时过度认同用户既往观点的框架。它通过反事实推理评估检索记忆的潜在风险,根据当前任务调整各条记忆的影响,并以适当证据为回答提供依据。研究人员称,在三个基准测试中的实验显示,该方法能够提升记忆可靠性。代码已公开。

碰撞前约10米驾驶辅助突然退出,高速追尾事故引发讨论

据报道,一辆汽车在沪昆高速安顺段以每小时120公里行驶时,导航辅助驾驶(NOA)在距离前方大货车约10米处突然退出并要求驾驶员接管,随后发生追尾。驾驶员称,当时已没有足够距离制动。近年来已有多起类似事件。报道提醒,目前市售车辆搭载的相关功能属于L2级及以下辅助驾驶,驾驶员仍须持续关注路况并承担责任。若因分心导致事故,驾驶员可能面临民事、行政及刑事责任。

通过自动诊断与技能发现训练数值智能

AI智能体生成科学代码的能力不断增强,但仅仅生成代码并不能改进底层算法。研究提出自动诊断与技能发现(ADSD)框架,先分析数值求解器表现不佳的原因,再依据诊断结果寻找合适的数值方法,并将所得知识整理为可复用的求解器技能。在电力潮流计算、刚性常微分方程和扩散偏微分方程等四个领域,ADSD提升了求解器的准确性、稳健性和效率。研究人员称,在GOC-500电力潮流测试中,求解器平均误差降低了近71倍;这一

双臂视觉-语言-动作模型中的逐臂组合泛化

这项研究推出 ACG-Bench,用于评估双臂策略能否以新方式重新组合已掌握的基础技能。基准包含八个任务族中的 23 组任务与条件,涵盖未见过的顺序安排、同步要求及跨任务组合。研究人员使用相同的 π_{0.5} 主干模型,比较数据增强和架构策略。结合 SkillLoRA 与逐臂注意力的方法,在模拟中的泛化成功率为 21.53%,而单一 π_{0.5} 策略为 2.94%。在 SO101 机器人上的

为防范 AI 深度伪造,意大利总理梅洛尼申请将自己的声音注册为商标

意大利总理焦尔吉娅·梅洛尼已向欧盟知识产权局(EUIPO)申请将自己的声音注册为商标,以应对 AI 生成的深度伪造内容。申请目前仍在审核中,材料附有一段她说出自己姓名的 4 秒录音。声音商标无法彻底阻止伪造音频,但可能为模仿她嗓音的人增加法律障碍。梅洛尼还对一名被指利用她的形象制作并发布虚假色情图片的男子提起了民事诉讼。