AI 新闻中心

AI 新闻中心 过去30天分析了 2439 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

阿里千问办公上架麒麟软件商店,已支持主流操作系统

阿里巴巴已将企业级 AI 办公智能体千问办公上架麒麟软件商店。官方称,该产品目前支持 Windows、macOS、HarmonyOS、银河麒麟和统信 UOS 等主流操作系统。阿里与麒麟软件围绕系统登录联动、设备互联和智能体技能调用等功能进行了适配优化。用户可以通过千问办公发送钉钉消息、总结群聊和会议内容、生成周报、预订会议、创建会议纪要,以及制作钉钉文档和 AI 表格。阿里巴巴表示,千问办公上线一

荣耀推出 DigaCite AI 相册管家:配备 11 英寸屏幕,首发价 999 元

荣耀已在中国推出 DigaCite AI 相册管家。这款类似平板电脑的设备定价 1199 元,首发价为 999 元,配备 11 英寸 1920×1200 分辨率屏幕,支持最多 4TB 存储扩展和照片远程访问。其 AI 功能可按人物、场景和时间轴自动分类照片,并支持创建宝宝专属相册。自然语义语音搜索可处理“去年暑假在海边的全家福”等描述,以查找相符或相似照片。设备还提供废片拯救、老照片修复和自动生成

ActReview:基于反驳引导的训练数据与评分类别奖励,生成可执行的同行评审

该研究探讨如何让大语言模型生成不仅能发现问题,还能指导作者进行具体修改的同行评审。ActReview将任务拆分为问题诊断和修改建议生成。研究人员利用OpenReview上的真实评审与反驳讨论,构建ActReview-40K数据集,将评审者提出的问题与作者回应及论文中的证据对应起来。Qwen3-8B-Base先经过监督微调,再使用GRPO和针对具体问题的评分类别奖励进行后训练。研究还推出了由人工整理

链接前先思考:多语言实体链接中的稀有性、推理与检索

一项研究分析了多模态实体链接系统在稀有实体上表现下降的原因。研究不只依赖页面浏览量等流行度指标,还采用知识图谱结构指标,识别文档记录不足或连接较弱的实体。根据稀有性的不同定义,当前最先进系统的准确率下降了15.4%至39.9%。研究人员提出了一种无需训练的框架,让具备推理能力的视觉语言模型反复搜索维基百科并动态收集证据。单独使用推理对稀有实体的提升并不明显;单独使用检索虽然能提高稀有实体准确率,却

MetroLLM-Bench 评估语言模型作为交通服务终端运行时

MetroLLM-Bench 是一个包含955个案例的基准测试,用于评估语言模型作为交通服务终端的决策层,覆盖六个真实地铁系统。测试内容包括路线规划、票价计算、运营中断、无障碍服务和对抗性输入等。经过参数高效微调的40亿参数 Qwen 3.5 模型在确定性的 Tier 1 评估中获得91.3分,超过受测的 GPT-5.6 系统,并追平更大型的 GPT-5.4 配置;其 Q4_K_M 模型占用空间为

超越求解器判定:用于自动形式化的生成式奖励模型

神经符号系统依赖数学求解器来验证推理,但求解器无法判断形式翻译是否与指定的参考形式化保持严格等价。该研究将一种失效模式定义为“保留判定的不忠实性”(VPU):错误编码仍能成功执行,并产生预期判定。理论分析表明,仅依赖结构和判定结果的验证方法,检测这类案例的能力最多接近随机水平。研究人员提出 Generative Verification(GenV),将离线的 Z3 等价性预言器蒸馏为连续且无需参考

用于视觉文档检索的生成式晚交互嵌入

一项研究分析了晚交互方法用于视觉文档搜索时的存储成本。现有压缩方法通常保留每页约1,000个向量中的一部分,或使用局部平均值,但在严格的存储限制下性能会明显下降;其他方案则需要重新训练编码器。研究人员对三种编码器进行分析后发现,这些向量位于单位球面上,并集中在内在维度仅为5到6的流形附近。将k-means质心归一化到球面表面,可以修正MaxSim分数被系统性低估的问题;与未处理的质心相比,nDCG

DRG-MAPPO:面向协同空战的分层动态角色图多智能体强化学习

该研究提出 DRG-MAPPO,一种用于协同空战决策的多智能体强化学习框架。该方法通过图结构和图注意力机制,建模友军、敌军与威胁之间随时间变化的关系。分层策略动态分配“领导者”和“支援者”等战术角色,低层策略则根据角色信息和关系特征选择离散机动动作。此外,研究设计了目标优先级辅助任务,以促进集中火力等协同行为。在实验中,作者报告了 87% 的胜率。不过,这些结果仅限于所测试的仿真环境,尚不能证明该

UniH³:统一层次化同质性与异质性的全能医学图像复原方法

UniH³是一种使用单一模型处理多种医学影像模态和退化类型的复原框架。该方法通过层次化同质性记忆模块和同质性引导注意力机制,利用不同模态之间共享的解剖结构。同时,层次化异质性平衡器可减少多任务优化过程中的任务冲突。在MedIR-2D-500K和MedIR-3D-3K基准测试中,研究人员报告称,该方法在全能复原和单任务复原方面均取得了当前最佳水平的结果。代码已公开。

纽约特斯拉致命车祸引发 Autopilot 责任争议

一辆特斯拉 Model Y 在曼哈顿撞上人行道防护棚、公交站牌和脚手架,导致一名 27 岁女乘客死亡。警方称,司机血液酒精浓度为 0.229%,远高于纽约州法定上限;车内两人均未系安全带。司机已被控车辆过失杀人、酒后驾驶和肇事逃逸等罪名。特斯拉 CEO 埃隆·马斯克否认车辆或 Autopilot 与事故有关,并批评 ABC News 的报道。纽约市警察局目前没有将事故归因于 Autopilot 或

DLSS 5 混合精度 Mod 测试:RTX 50 系列显卡性能仅提升 1% 至 2%

英伟达 DLSS 5 神经渲染 DLL 流出后,社区开发者开始尝试降低模型推理成本。一款 Mod 在 RTX 50 系列显卡上混合使用 FP8 与英伟达 NVFP4 格式。4K 分辨率下,该方案仅将神经渲染阶段的处理时间缩短约 1% 至 2%,并不代表整款游戏的帧率也有同等幅度提升。在《博德之门 3》的 120 秒测试中,混合精度模式达到 55.16 FPS,FP8 模式为 54.57 FPS,提

华境 S 新增 4 款配置,全系标配华为乾崑智驾 ADS Pro 增强版

华境汽车宣布为六座大型 SUV 华境 S 新增 4 款配置。全系标配华为乾崑智驾 ADS Pro 增强版和鸿蒙座舱,超级置换价为 14.98 万至 19.68 万元。新配置主要升级鸿蒙座舱,搭载 MoLA 2.0 混合大模型架构,支持方言识别,并更新车机界面。同时,车辆支持外接扩展屏,相比原版本加价 3000 元。华境 S 是上汽通用五菱与华为合作推出的首款搭载华为乾崑科技的车型。