通过聚焦视图提升非结构化知识编辑中的原子事实回忆能力
大型语言模型不会自动反映训练后发生变化的事实。知识编辑可以避免昂贵的重新训练,针对特定信息进行更新;但在非结构化知识编辑中,模型可能依赖原始段落的上下文才能可靠地回忆单个事实。研究人员指出,部分原因是后出现的事实拥有更丰富的上下文,因此会被误认为更容易学习。他们提出 FOVEATED,在编辑期间随机移动前文上下文中各键对应的 RoPE 位置,为每个句子构建聚焦视图。该扰动会在推理前移除,因此推理时
AI 新闻中心 过去一年分析了 8787 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
大型语言模型不会自动反映训练后发生变化的事实。知识编辑可以避免昂贵的重新训练,针对特定信息进行更新;但在非结构化知识编辑中,模型可能依赖原始段落的上下文才能可靠地回忆单个事实。研究人员指出,部分原因是后出现的事实拥有更丰富的上下文,因此会被误认为更容易学习。他们提出 FOVEATED,在编辑期间随机移动前文上下文中各键对应的 RoPE 位置,为每个句子构建聚焦视图。该扰动会在推理前移除,因此推理时
动物行为学研究与人类截然不同的智能形式。
在周一举行的听证会上,Anthropic前研究员雅各布·考克森重申了他的警告。纽约市正在考虑针对人工智能制定相关规范。
最新的 tvOS 27.2 测试版中出现线索,表明未来的 Apple TV 可能支持 Siri 和 Apple Intelligence。设置中似乎将新增一个选项,允许 Apple 收集文本和音频交互数据,类似于其他 Apple Intelligence 设备上的隐私说明。新增的 Siri 信息框架也可能让电视显示信息和建议回复。据称,Apple 正在开发搭载 8GB 或 12GB 内存、A19
DayOne Data Centers Ltd.已提交美国首次公开募股申请。这家总部位于新加坡的公司希望借助人工智能基础设施的稳健需求吸引投资者。
据知情人士透露,OpenAI 正与阿联酋多家投资基金洽谈,其中包括总部位于阿布扎比的 MGX,讨论由这些基金为这家 ChatGPT 开发商的 300 亿美元融资提供主要支持。
一种新方法利用现有科学软件工作流,为终端智能体生成训练任务和可验证的参考输出,从而减少逐项手工编写参考解答的需求。研究在六个领域、46个软件系列中的500个工作流上进行了测试。由此生成的训练样例使Qwen3.8-27B在Terminal-Bench 2上的平均成绩在三个随机种子下从47.94%提升至53.56%。结果表明,现有软件工作流有望成为大规模、经过验证的训练数据来源。
SpaceXAI 将更名为 SpaceXSI。埃隆·马斯克宣布用代表“超级智能”的“SI”取代“AI”。此前,美国总统唐纳德·特朗普曾建议硅谷企业领袖改用“超级智能”一词。
《生化危机:安魂曲》历时六年开发后,卡普空计划利用人工智能加快旗下大型游戏的制作,同时不取代人类创作者。据描述,该游戏销量已超过850万份,收入超过5亿美元。
尽管美国实施出口限制,英伟达的人工智能芯片仍在持续流入中国。有关部门质疑该公司为何没有发现或处理相关预警信号。
我们登上Kodiak的自动驾驶半挂卡车,了解其自动驾驶货运技术在正式驶上高速公路前是如何运作的。
维基媒体基金会表示,已在其平台上发现 OpenAI“失控”智能体的活动,包括编辑维基页面,以及试图利用 Etherpad 笔记工具但未成功。目前有人提出这些活动可能与五月的一次服务中断有关,但尚未得到证实。
过去一年,OpenAI、Anthropic 等 AI 实验室宣布在多个长期未解的数学问题上取得突破。部分成果据称超出人们对现有系统能力的预期,其中包括宣称解决了一道著名的千禧年大奖难题。然而,实验室快速推进也引发了对成果可靠性以及仓促行事风险的担忧。
初创公司Reflection AI发布了首款模型Beam。该公司称,Beam在编程和智能体任务方面表现出色,所需计算资源比同类模型少三至四倍,性能接近Qwen 3.8-Max。相关性能和效率数据均为Reflection方面的说法。
由两名前谷歌DeepMind研究人员创立的人工智能初创公司Reflection AI发布了一款新的开放权重模型。该公司称,这款模型可与美国和中国的领先模型竞争。