AI 新闻中心

AI 新闻中心 过去一年分析了 9043 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Random Attention:重新思考高效推理中的 KV 缓存淘汰

Random Attention 对根据缓存 Token 未来重要性进行评分和保留的 KV 缓存压缩方法提出质疑。该方法保留提示内容,并在每个注意力头内均匀随机淘汰 Token,完全省去评分计算。在四个模型和六项推理任务上的测试显示,其效果可与此前最强的淘汰方法相当,同时在 vLLM 部署中的吞吐量提升 32% 至 43%。受控实验表明,提示是缓存中最脆弱的部分;推理轨迹则依靠文本中的重复表述以及

人人影视负责人回应 App 上线:力争激活 3000 万存量用户

曾以字幕分享闻名的人人影视已推出“人人影视分享精彩”App。公司称,正在开发结合翻译和声音克隆的 AI 影视本地化技术,让国产影视作品能够以当地语言呈现。安卓端已经上线,iOS 版本正在准备中。平台计划覆盖 50 多个国家和地区,初期优先向东南亚输出国产影视内容。公司表示,相关技术依托超过 7 万集影视素材,并与华数传媒合作采购正版片源。目前 App 仍处于前期公测阶段,预计月底正式发布。

摩尔线程宣布“庐山”GPU,首次支持自研硬件光线追踪

中国GPU厂商摩尔线程表示,基于“花港”架构的“庐山”图形芯片预计于2026年底推出。公司预计,该芯片可将3A游戏渲染性能提升15倍、AI性能提升64倍、光线追踪性能提升50倍。庐山将支持DirectX Raytracing硬件加速,并采用面向AI生成式渲染的自研MTAGR 1.0技术。上述性能数据属于公司预测,目前尚未经过独立验证。

摩托罗拉发布内置 Qira AI 的 moto watch ultra

在 IFA 2026 期间举行的 Lenovo Innovation World 大会上,摩托罗拉发布了首款内置个人 AI 助理 Motorola Qira 的可穿戴设备 moto watch ultra。用户抬起手腕或说“Hey Qira”即可提问,并调用保存在受支持的摩托罗拉与联想设备之间的信息。这款 LTE 智能手表无需携带手机即可通话和收发消息,也能在 LTE 连接下直接向 Qira 提问

磐镭预告 YO2 迷你主机进阶版:内存更大,推理更快

磐镭预告了 YO2 迷你主机的全新进阶版,宣传升级内容包括更新 CPU、更大内存、更高 TOPS 性能以及更快的 AI 推理速度。由于原版 YO2 搭载 AMD 锐龙 AI Max+ 395 处理器,新款产品很可能升级至近日解禁的锐龙 AI Max+ 495,并支持最高 192GB LPDDR5X 内存。从公开图片来看,YO2 标志性的竖向 RGB 氛围灯带将在进阶版上保留。目前这些信息仍属于产品

阿里巴巴千问上线首月用户突破3000万,开源企业级上下文平台

阿里巴巴旗下AI办公产品QwenWork上线一个月后,用户数突破3000万,其中企业用户占比超过一半。团队在30天内完成120次更新,并同步推出国际版。开源项目MyContext可将分散在即时通信、文档、审批和邮件系统中的异构数据,转化为AI Agent可调用的上下文。与钉钉集成后,Agent可通过自然语言指令查询CRM和ERP系统。办公专用模型Qwen3.8-Flash针对多步规划和上下文压缩进

Terminal-Universe:将智能体轨迹转化为可扩展的终端环境

Terminal-Universe 从编程智能体的工具执行历史中重建可执行工作区。这些恢复的环境可用于生成可验证任务、模拟多轮交互,并创建跨多个代码库的查询。应用于公开的智能体轨迹后,该框架生成了3.73万个可用于任务的环境。使用这一语料库对 Qwen3.5-27B 进行监督微调后,模型在 Terminal-Bench 2.1 的单轮性能提升了11.9分,在 EvoCode-Bench v2 MT

重新思考大语言模型的在线策略蒸馏 II:一个训练样本

一项研究在数据极简条件下分析在线策略蒸馏(OPD),仅用一个查询训练模型。单查询 OPD 在数百个训练步骤中仍持续改进,并在多个任务领域和模型系列中恢复了完整数据训练的大部分收益。一个查询即可覆盖完整数据 OPD 所访问状态的 71.5%;加入 16 个语义多样的查询后,覆盖率达到 98.9%,性能与完整数据训练相当。研究人员认为,OPD 的主要瓶颈不是数据不足,而是学生模型吸收教师监督信号的速度

飞腾 D3000M 搭载 160 TOPS NPU:国科亿道与后摩智能发布 FN008 AI 笔记本

后摩智能(HOUMO.AI)宣布与国科亿道联合开发 FN008 AI 笔记本。该机采用飞腾 D3000M 处理器、后摩智能 M50 dNPU,以及基于 Linux 的 KylinOS 系统,并配备符合中国密码标准的 TPM 芯片和 24GB 内存。据官方介绍,M50 可提供 160 TOPS 的 INT8 算力和 100 TFLOPS 的 bFP16 算力,典型功耗为 10W。设备支持在本地运行参

CORE通过重排序器蒸馏提升MLLM嵌入的组合推理能力

CORE将交叉注意力重排序器的细粒度组合判断蒸馏到基于MLLM的嵌入模型中。该方法构建覆盖五个组合匹配等级的候选列表,并使用Rank-KL目标函数训练嵌入模型复现重排序器的排序结果。在三个组合推理基准测试中,CORE-RERANKER-8B取得82.7%的平均分,比Jina-Reranker高10.7个百分点。CORE-EMBED-8B以0.666的总平均分,在所有评估的嵌入模型中表现最佳。这些改

DLSS 5 首发仅支持 RTX 50,英伟达确认后续将扩展至 RTX 40

英伟达已发布 DLSS 5,首发仅支持 RTX 50 系列显卡,目前也只有《NBA 2K27》支持。该技术正式名称为“3D 引导神经渲染”,通过生成式 AI 模型逐帧重构画面的光照和材质细节,不同于传统超分辨率或帧生成。英伟达表示,在完成 RTX 50 系列优化后,将把官方支持扩展至 RTX 40 系列;RTX 30 和 RTX 20 系列目前没有具体计划。玩家只能使用简单的开关选项,更细致的模型