AI 新闻中心

AI 新闻中心 过去30天分析了 2005 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

阿里巴巴5纳米RISC-V芯片据称无需独立GPU即可运行270亿参数模型

阿里巴巴表示,64位服务器处理器玄铁C950能够在不使用模拟层或独立显卡的情况下,原生运行通义千问3.8-27B模型。该芯片采用5纳米工艺,配备64个计算核心,并集成面向AI推理的矩阵和向量加速引擎。据报道,运行该模型时,其生成速度约为每秒30个Token,首Token延迟低于1.9秒。阿里巴巴还宣称其单核性能达到RISC-V处理器中的纪录水平。上述数据来自所提供的报道,仍需通过独立基准测试和可复

GS-Voxel:用于大规模 3DGS 生成的免拟合结构化潜变量

GS-Voxel 是一个用于大规模 3D Gaussian Splatting(3DGS)场景生成的结构化潜变量框架。它能将无序、空间不规则且经过预优化的 3DGS 重建确定性地转换为稀疏活动体素,无需针对每个场景进行额外优化,同时保留所选图元的位置和渲染属性。分解式 VAE 分别编码体素几何结构与局部高斯属性。随后,图像条件流模型根据卫星视角图像生成航空 3DGS 场景。通过考虑重叠区域的分块推

从语料库到协同演化能力:面向通用图像生成的能力中心化数据设计

该研究提出了一套以能力为导向的数据基础设施,用于训练通用图像生成模型。系统将文本—图像对齐、图像变换和图像—知识关联等专门监督数据结合起来,并按照能力之间的依赖关系,逐步调整任务组合、视觉概念分布、数据质量和图像分辨率。该基础设施包含4.4亿张文生图图像、1.2亿组编辑数据对,以及超过2,700万组图像—实体数据对。研究人员基于这些数据从头训练了30亿和60亿参数的扩散模型,并通过CPI-Benc

A.I.G. 评估 DeepSeek Harness 抵御间接提示注入的能力

一项研究使用 AI-Infra-Guard 评估 DeepSeek Harness(DSH)抵御间接提示注入攻击的能力。研究覆盖 16 个间接内容渠道、文本和文件载体、35 个攻击目标及 12 种攻击方法,共进行了 14,560 次受控执行。研究保留了 DSH 的智能体循环、工具注册、模型适配器和会话事件路径,并通过本地测试工具避免外部副作用。观察到的最高攻击成功率分别为:文本模式下的虚假完成攻击

腾讯吐司上线AI应用上架与分发能力

腾讯应用宝旗下AI应用生成平台吐司推出应用上架功能和开发者权益包。用户通过自然语言生成安卓应用后,可直接在平台内完成软件著作权申请、App备案、合规文件生成及上架申请。应用通过审核后,可在应用宝上架分发。吐司会自动抓取应用信息和截图,减少重复填写及信息不一致。权益包早鸟价为Plus版899元、Pro版7999元,有效期分别为180天和365天。目前,该服务仅支持使用吐司安卓端开发的应用。

Perplexity印度免费订阅实验后,应用收入增长60%

Perplexity与印度电信运营商Airtel合作推出的12个月免费Pro订阅活动开始显现成效。自2025年7月起,约3.6亿名Airtel用户可以使用这项优惠。Sensor Tower数据显示,促销期间下载量大幅增长,月活跃用户数在10月达到约2200万的峰值。活动结束后,下载量下降超过90%,但月活跃用户仍显著高于此前水平。2026年2月至8月中旬,Perplexity在印度通过应用内购买和

从序列到结构:面向大语言模型智能体的关系不确定性传播

研究人员提出 RUPA,用于量化大语言模型智能体在完整执行轨迹中的不确定性。该方法不再仅依赖词元概率、预测熵或单步置信度等局部信号,而是将推理状态、工具交互和环境反馈之间的依赖关系表示为有向轨迹图,并在图中传播不确定性,以捕捉执行风险的累积和转移,从而更早发现失败。研究团队使用 6 个开源大语言模型,在 τ-2、Terminal-Bench-2 和 GAIA 基准上进行评估。结果显示,RUPA 的

aDSL:通过代理与程序协同设计实现代理式三维创作

该论文提出了 aDSL,一种面向程序化三维创作的代理中心型领域专用语言,并配套开发了按角色分工的多代理系统。代理不再依赖容易出错的绝对坐标,而是使用表达空间关系的关系运算符来操作几何结构。无需额外训练的“规划—执行—批评”流程会拆解用户请求、生成代码,并根据执行反馈修复错误和约束违规。实验表明,与既有基于大语言模型的方法相比,该方法在文本生成形状和图像生成形状任务中提升了鲁棒性、可控性以及对用户意

StartupBench:基于市场验证的端到端工作流评测通用智能体

StartupBench是一项评估AI智能体执行完整真实工作流程能力的基准测试。它不主要依赖研究人员挑选的任务,而是以已证明拥有用户采用率和实际需求的AI产品为基础,覆盖多个专业领域。研究人员将这些工作流转化为面向交付成果的任务,并通过细致的评分标准进行评估。即使是测试中表现最强的模型,也只能完整完成约30%的任务,尽管在许多任务上取得了明显的部分进展。复杂指令遵循和领域专业知识不足是主要失败原因

Abra:扩展图像扩散模型训练规模

一项系统性研究利用 Abra(一系列受控的流匹配 Transformer),分析文本生成图像扩散模型的扩展规律。研究使用 10^19 至 10^22 FLOPs 的计算量训练模型,覆盖三个数量级。结果显示,扩散模型与语言模型一样,能够以可预测的方式扩展,但要实现最优训练,需要更多数据:每个参数约需 200 个图像 token,约为语言模型 Chinchilla 计算最优建议的十倍。与语言模型不同,

ASI-Bench:人工超级智能的黎明

ASI-Bench是一项用于评估AI系统能否在有限人类指导下开展科学研究并创造新知识的新基准。该基准涵盖11个科学领域的60项项目级研究任务,并逐步减少人类提供的方法指导。在对18种先进代理与模型配置的测试中,系统在获得完整方法指导时的平均得分为50.91;当必须自行选择研究方法时,得分降至26.62。结果表明,当前AI系统仍高度依赖人类指导,距离自主完成端到端的科学研究还有明显差距。ASI-Be

中国人形机器人第一股宇树科技上市,开盘大涨629.44%

宇树科技在中国A股市场上市,开盘报每股1100元,较150.80元的发行价上涨629.44%。每一中签单位的收益达到约47.46万元,公司市值升至约4449亿元。宇树科技开发四足机器人和人形机器人,并称自己是高性能通用机器人领域的全球领先企业。公司上半年实现营业收入11.52亿元,同比增长48.54%;但扣除非经常性损益后的归母净利润为2.44亿元,同比下降19.34%。

因隐私担忧,美国移民与海关执法局禁止员工佩戴 Meta 智能眼镜

美国移民与海关执法局(ICE)禁止员工在联邦工作场所佩戴 Meta 智能眼镜。该机构在政策备忘录中表示,这类设备能够隐蔽录制视频和音频,可能无意中捕捉或传输敏感信息。禁令适用于所有 ICE 员工,而不仅是执法人员。Meta 智能眼镜配备摄像头和麦克风,较新版本还加入了 AI 助手,以及只有佩戴者能够看到的微型显示屏。法院、商店和餐厅也开始限制这类设备的使用。隐私组织同时反对未来在智能眼镜中加入人脸

Perplexity靠Airtel免费赠送在印度吸引数千万用户,接下来迎来商业化考验

Perplexity通过印度电信运营商Airtel免费提供12个月的Pro订阅,推动下载量和月活跃用户快速增长。报道援引Sensor Tower数据称,其月活跃用户一度达到约2200万。免费兑换期结束后,下载量下降超过90%,但活跃用户规模仍显著高于促销前水平。应用内购买和订阅收入也出现增长。分析人士提醒,部分收入可能来自未及时取消的自动续费,或来自受活动曝光吸引的新付费用户,并不一定代表原免费用