英伟达展示 DSX MaxLPS:AI 工厂每兆瓦令牌吞吐量最高提升 40%
英伟达在 AI 基础设施峰会上展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统。英伟达称,该技术可使每兆瓦令牌吞吐量最高提升 40%。Emerald AI 已将其集成到 Conductor 平台,用于根据电网状态调整数据中心的用电需求。GPU 云服务商 Lambda 的测试显示,在固定功率预算下,令牌吞吐量提升 24%,每瓦性能提升 23%。英伟达还表示,Vera Rubin 和 Gr
AI 新闻中心 过去24小时分析了 209 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
英伟达在 AI 基础设施峰会上展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统。英伟达称,该技术可使每兆瓦令牌吞吐量最高提升 40%。Emerald AI 已将其集成到 Conductor 平台,用于根据电网状态调整数据中心的用电需求。GPU 云服务商 Lambda 的测试显示,在固定功率预算下,令牌吞吐量提升 24%,每瓦性能提升 23%。英伟达还表示,Vera Rubin 和 Gr
Salesforce英国及爱尔兰区CEO呼吁扩大人工智能培训和技能培养,让全国各地的员工和用户都能从这项技术中受益。
总部位于冰岛的 Treble 已为其语音模拟平台筹集 1800 万美元。该技术被语音人工智能模型开发商,以及人工智能可穿戴设备和机器人企业使用。
谷歌、英伟达和Emerald AI成立了AI Energy Management Alliance。该联盟旨在帮助数据中心根据电网状况动态调整用电量,从而减轻电力系统压力,并推动人工智能计算所需数据中心基础设施的扩展。
这位英国君主计划向人工智能领域一些最具影响力的人士寻求保证,要求他们确保能够控制自己开发的技术。
该研究探讨如何扩展用于长上下文建模的线性注意力架构 Gated DeltaNet(GDN)的上下文窗口。研究发现,远距离信息检索需要两个条件:足够宽的慢衰减状态动态频谱,以及保留用于状态清除和上下文切换的快衰减模式。SpectralShift 通过调整 alpha 投影的初始化来重塑衰减频谱,并对相关投影采用学习率缩放,以支持长上下文持续预训练。实验表明,该方法在训练过程中能够持续提升长上下文能力
论文提出了基于比较的偏好优化方法(ComPO),这是一种让大语言模型对齐人类偏好的零阶方法。ComPO不直接优化可微分的偏好损失,而是从偏好比较中提取更新方向信息。作者在特定假设下,为离线和在线版本建立了收敛性与性能保证。在Mistral、Llama、Gemma、Qwen和Gemma-3模型上的实验表明,ComPO优于现有的直接对齐方法,包括在长度控制胜率方面取得改进。
ActionPiece 是一种面向自回归视觉语言动作模型的动作标记化方法。研究人员提出 Physical Rank Consistency(PRC),用于衡量动作重建后是否保留不同动作之间的相对物理距离。该方法将关系监督与重建损失、量化正则化结合起来。在相同的 Qwen3-VL-4B 策略训练设置下,ActionPiece 在 LIBERO 上达到 94.8%,在包含未见场景的 LIBERO-Pl
小米 MiMo 团队在今年 4 月开源 MiMo-v2.5 后,已投入近半年研发 MiMo-V2.6,重点研究强化学习究竟能扩展到多大规模。目前该模型仍处于训练中期。团队扩展了计算资源、多任务智能体的环境与工具,以及用于评分和信用分配的计算资源。训练总成本已超过 125 万美元。小米计划在未来几周逐步公开更多技术细节,但模型的正式发布时间尚未确定。
据《金融时报》报道,由前谷歌DeepMind研究人员创办、成立仅一个月的英国人工智能初创公司Emulate,正就最高7亿美元的融资进行深入谈判,目标估值为37亿美元。目前这笔融资尚未最终敲定。
在华为全联接大会 2026 上,华为发布了昇腾 960 超节点,配置 4096 张加速卡,最高可提供 8E FP8 算力和 1PB HBM。华为称,该系统使用 5500 个 Hi-ONE 替代原需的 4.8 万个 800G 光模块,可降低超过 550 千瓦功耗。昇腾 960DT 计划于 2027 年第一季度就绪,960PR 计划于同年第三季度就绪。华为表示,昇腾 910C 超节点目前已在全球部署超
《纽约时报》记者凯德·梅茨报道了Inherent和Recursive Superintelligence等初创公司。这些公司正在开发相关工具,试图让AI系统实现递归式自我改进。Recursive Superintelligence联合创始人、计算机科学家杰夫·克鲁恩是这一方向的推动者之一。报道主要介绍早期研究和创业活动,并未证明已经建成能够进行递归自我改进的实用系统。
HypoEvolve利用世代遗传算法协调专业化的大语言模型智能体。智能体依据机制性论证、外部证据和可测试性来提出、批评并评估假设。在覆盖34种癌症的药物再利用研究中,该系统在两项外部指标上均超过六种基线方法。其DepMap选择性得分达到0.171,高于最强基线方法的0.115。在未参与评估的癌症类型上,性能提升同样能够泛化。这项研究提出了一种框架,用于检验人工智能智能体之间的协作如何影响科学假设的
Zing-0.5 是一个拥有 50 亿参数的自回归世界模型,旨在生成可交互环境。用户可以使用键盘进行移动,并通过文本指令改变正在生成的事件,无需重新开始生成。该系统结合了统一的动作与文本条件控制、事件级监督,以及支持低成本实时推理的流式技术。研究人员称,模型在 832×480 分辨率下可达到每秒 24 帧,预计服务器租用成本约为每流媒体分钟 0.009 美元。在 WBench Navigation
零跑汽车董事长朱江明表示,因中国车企无法进入美国且特斯拉FSD尚未在中国落地,两者目前无法直接对比。他强调中国路况更为复杂,国内智驾团队正快速迭代。同时,零跑发布了自研的世界模型智能辅助驾驶,宣称达到行业第一梯队。其智驾4.0架构成本较1.0降低了60%,为硬件预算腾出空间,使自研世界模型得以应用于10万元级车型,明年起将面向35万辆激光雷达版车型免费升级。