AI 新闻中心

AI 新闻中心 过去一年分析了 7916 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

我们能否防御针对现实危机事件的人工智能生成视频攻击?

这项研究提出了 RA-Bench,这是一个用于检测描绘现实危机事件的人工智能生成视频的基准数据集。数据集共包含17,886段视频:来自10类社会风险的1,830段真实参考视频,以及由4个开源和5个闭源生成器制作的16,056段生成视频。研究评估了7种传统检测器、10个零样本多模态模型,以及2个专门针对人工智能生成视频检测进行微调的模型。结果显示,三类检测器都无法在整个基准上实现稳定泛化。生成质量、

鸿蒙智行尊界 V800、V680 获合肥市 L3 级自动驾驶测试牌照

鸿蒙智行尊界 V800 和 V680 已获准在合肥市开展 L3 级自动驾驶测试,后续将针对多种驾驶场景进行深度测试。两款车型搭载华为 ADS 5.0 全栈软硬件方案,并对传感器、计算系统、连接系统和电源进行冗余设计。车辆预计于 9 月开始交付。此次牌照仅允许开展测试,并不等同于获得在公共道路上不受限制运行 L3 自动驾驶系统的许可。

不再仅限 API 密钥:Codex 的 GPT-5.6 Sol 百万 Token 上下文现可通过 ChatGPT 账号使用

OpenAI 已将 Codex 中 GPT-5.6 Sol 约 100 万 Token 上下文窗口的使用范围扩展至 ChatGPT 账号。该功能此前仅支持 API 密钥,现在 ChatGPT Plus、Pro 等订阅用户也可以手动启用。更大的上下文窗口可让 Codex 在压缩早期信息前保留更多代码、工具输出和对话记录,适用于大型代码库重构、复杂调试和长时间会话。OpenAI 表示,默认上下文长度是

千问办公首发上线GLM-5.3与DeepSeek V4Pro,聚合三款国产旗舰模型

阿里巴巴旗下AI Agent产品“千问办公”于8月14日宣布接入智谱GLM-5.3和DeepSeek V4Pro,用户可在首页“前沿模型”栏目直接选择。加上此前已接入的Qwen3.8-Max,平台现已覆盖阿里巴巴、智谱和DeepSeek三家的旗舰模型。DeepSeek V4Pro据称支持100万Token上下文和最高38.4万Token输出,重点面向长程任务与Agent任务串联。GLM-5.3则据

Dion3:实现全栈正交更新优化

Dion3是Muon优化器的改进版本,旨在降低Newton-Schulz正交化步骤带来的计算和通信开销。其Gram Newton-Schulz算法减少了FLOP成本,优化后的CuteDSL内核利用对称性提升速度,批量合并策略则降低分布式训练中的通信开销。此外,新的更新规则每一步只对动量矩阵的一部分行进行正交化。作者称,Dion3在损失表现上可达到或优于Muon,同时将优化器单步耗时最多缩短6倍。该

超越最终得分:长期人工智能研发代理的系统性评估

一项研究通过36项长期人工智能研发任务,评估了7个前沿模型。该框架不仅考察最终得分,还分析解决方案构思、执行、反馈控制,以及代理在任务内和任务间复用经验的能力。结果表明,当前代理更像工程优化器,而不是完全自主的研究人员。它们能够制定并实施实用方案,但不同运行结果之间的性能差异较大。表现最好的方案通常是对已有技术进行调整或组合,真正的方法论创新仍然少见。研究还发现,流程瓶颈、经验复用方式以及运行环境

Marionette预测世界状态、渲染几何并生成外观

Marionette是一种面向交互式游戏的世界模型。它不直接生成像素或潜在表示,而是预测一个包含多实体关节骨架、根部轨迹和旋转的276维显式三维世界状态。无参数渲染器根据该状态计算几何结构和遮挡,带控制条件的视频扩散模型则生成逼真的RGB画面。这种分离式设计提升了可控性和长时一致性。向预测状态加入地形碰撞器和距离上限后,角色陷入地面的情况减少了66%,角色彼此漂移过远的问题也得到抑制。研究人员表示

Intern-S2-Mobius:解耦知识与推理的基础模型

研究人员推出 Mobius-v0,这是一种将存储知识向量的全局共享记忆模块,与负责迭代执行组合推理的多个推理器分离的架构。研究团队称,从头训练的 7B 模型仅使用 7B Transformer 基线模型 62.6% 的训练数据,就达到了相近的下游任务成绩。基于 Qwen3.5-35B 持续预训练的 Intern-S2-Mobius,据称在保持相近性能的同时,实现了接近 4 倍的端到端推理速度。

SPARGen:通过原生多模态生成统一空间感知与推理

SPARGen 是一个多模态框架,将 3D 重建、密集对应和空间推理统一为指令条件生成任务。该方法把紧凑的结构化输出和语言输出序列化为标记序列,同时生成与图像对齐的密集几何场,使空间监督能够共同塑造原生多模态生成模型中的共享表示。在 3D 重建、对应关系和空间推理基准测试中,SPARGen 通过单一框架在多种空间任务上取得了具有竞争力的性能。

鸿蒙智行尚界 Z7/Z7T 推送夏季 OTA,新增城市漫游巡航等功能

鸿蒙智行已开始为尚界 Z7 和 Z7T 推送夏季 OTA 更新。此次更新扩展了导航辅助功能,新增城市漫游巡航,即使未设置导航,也能识别红绿灯和路口、连续通过路口并自主变道。系统还支持一键前往附近停车位或充电车位,并新增主动防追尾辅助、守位泊车、优化后的 3D 界面以及调光天幕自动调节功能。高德车道级导航可在复杂路口提供更精准的指引。更新还包括新的音效功能,以及清理应用缓存和系统缓存的工具。两款车型

Anthropic被曝营收大增并实现盈利

据称向潜在投资者披露的未经证实财务数据显示,Anthropic最近一个完整季度的初步营收超过115亿美元,较上年同期的7.87亿美元大幅增长。公司还被指在2026年第二季度实现调整后营业利润转正,并预计2028年营收达到1900亿至2000亿美元。不过,这些数据和预测目前尚未得到独立确认。报道将其视为大型AI模型企业商业化进展加快的迹象,并指出AI智能体正成为行业关注重点。

小红书开源模型获突破:华为昇腾完成发布即全量适配与性能优化

小红书发布了新开源模型 dots3-note 的预览版。据介绍,该模型总参数量为2800亿,激活参数量为160亿,支持文本、视觉和语音等多模态能力。华为表示,Atlas 800A3 与 Atlas 900A3 SuperPoD 平台已在模型发布当日完成全量适配,并通过开源推理引擎 vLLM Ascend 支持部署和运行。优化内容包括多模态处理、通信与计算融合、MoE 推理吞吐量,以及利用 MTP