AI 新闻中心

AI 新闻中心 过去30天分析了 2417 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

阿里千问办公推出支持最多百人协作的 AI 多人工作台

阿里云宣布,千问办公推出“多人工作台”。用户用自然语言描述需求后,系统可以生成并发布一个最多支持百人同时协作的网页应用。该功能包含角色与权限管理、云端数据库、管理后台和在线发布,面向活动组织、家校协同及企业业务流程等场景,可用于资料收集、申请审批和任务进度跟踪。生成网页后,用户可以先验收成果,并在业务流程变化时继续通过自然语言进行修改。阿里云将其定位为 ERP、OA 或垂直行业 SaaS 的一种替

华为正式发布 HarmonyOS 7,搭载系统级智能体小艺

华为正式发布 HarmonyOS 7,并开启公测。新系统采用全新的空间美学设计语言,搭载 Harmony Intelligence 架构,整合云端与端侧大语言模型、应用功能以及多层记忆架构。系统级智能体小艺将支持浏览器助手、通知聚合、智能录音、智能短信和游戏伙伴等场景,并可通过自然语言指令调用系统功能。安全方面,HarmonyOS 7 新增基于 AI 的境外诈骗电话、变声和风险网页检测功能,还支持

OpenAI 同日发布两份文件:AI 加速 AI 研发,但安全措施正在掉队

OpenAI 发布两份文件,分别介绍 AI 辅助研究的进展,以及前沿 AI 发展带来的安全挑战。公司称,“自动化研究实习生”可在人类指导下完成原本需要熟练研究人员数天才能完成的明确研究任务。使用编程智能体的研究人员,每日推理费用中位数已超过 600 美元,使用量最高的 10% 用户每天花费超过 7000 美元。不过,OpenAI 承认,许多持续时间较长、更加复杂的任务仍需要人工介入。首席科学家雅库

微信小范围测试可跨账号沟通的AI智能体功能

据报道,微信正在小范围测试“ 小微AI社交”功能。用户可向自身账号下的小微下达指令,由其寻找目标好友的小微并代为沟通。获得对方授权后,两个AI智能体可以交换信息、协同处理需求;涉及重要决策时,仍需用户进行人工确认。腾讯目前尚未正式回应这一消息。小微此前已支持通过自然语言操作部分微信功能,包括发消息、打电话、搜索内容、使用小程序,以及提供聊天总结和回复建议。

OpenAI宣布“自动化研究实习生”里程碑:内部智能体运行时长达人工的3.1倍

OpenAI表示,其内部系统已达到“自动化研究实习生”里程碑。在人类监督和指导下,该系统能够完成资深研究人员通常需要数天处理的、定义明确的复杂任务。截至8月中旬,OpenAI核心研究组织中,每投入一个人类工作日,智能体的运行时间相当于3.1个智能体工作日。不过,这一比例衡量的是运行时间和工作量,并不等同于相同的生产力或实际产出。OpenAI员工Kevin Liu认为,递归式自我改进可能成为未来几年

火山引擎内测AI版权平台,Seedance转向IP商业化

据《娱乐资本论》报道,字节跳动旗下火山引擎近日邀请多家版权方参与AI版权管理平台内测。品牌方和短剧制作方可调用Seedance、Seedream等模型,使用已获授权的正版IP进行创作;版权方则可在后台完成监修、审核和交易管理。平台预计于今年下半年正式上线,提供面向消费者的模板创作和面向企业客户的自由创作两种授权方式。目前据称已有数十个头部IP签约,包括周星驰旗下比高集团相关影视作品。部分企业项目报

ShallowStream:浅层建索引,深层作回答,实现流式视频理解

ShallowStream 是一个用于提升多模态大语言模型连续视频处理效率的框架。它利用模型的浅层同时进行视频帧编码和轻量级检索索引构建,并持续维护该索引。在查询阶段,系统根据浅层生成的注意力分数评估上下文帧,再通过考虑多样性的策略选择准确且全面的证据。论文作者称,该方法在性能上可媲美现有领先的流式处理方法,同时将每帧预填充延迟最多降低52.1倍,将10秒视频的端到端延迟最多降低11.9倍。相关源

AdaptVPR:面向鲁棒视觉地点识别的路径感知困难正样本生成

AdaptVPR是一种生成式数据增强框架,旨在提升视觉地点识别对光照、天气、季节变化和动态遮挡的鲁棒性。视觉语言模型负责解析场景属性,基于规则的调度器则根据可编辑性和风险约束选择生成路径。系统可生成天气、光照和时间等全局外观变化,加入局部动态遮挡物,或结合两类扰动。基于几何一致性和外观多样性的验证机制会筛除不可靠样本,降低结构偏移风险。由此构建的AdaptCities数据集包含16万条经过验证的合

微信视觉团队开源多模态嵌入模型 WeMM-Embedding

腾讯微信视觉团队开源了通用多模态嵌入模型 WeMM-Embedding,支持文本、图像等输入。该模型提供 2B、4B 和 9B 三种规模,面向不同部署需求。其采用统一架构,并结合两阶段训练与知识蒸馏,在多模态理解能力和部署效率之间进行平衡。据腾讯介绍,WeMM-Embedding 已大规模部署于微信推荐与搜索系统,日调用量达到十亿级。此次开源使开发者能够使用一款已在大型商业服务中部署的模型,但公告

千问开放平台新增10余款金融服务智能体

9月7日,千问开放平台上线10余款金融服务智能体,覆盖证券投资、基金、期货和保险。用户可在千问对话中直接调用相关服务,也可从首页进入。由不同金融机构提供的智能体支持市场与企业基本面分析、投资参考,以及保险产品核保要求对比等功能。千问生态目前已延伸至物流运输、房产、本地生活、汽车出行等十多个领域。此次扩容反映出AI应用正从通用对话转向面向具体行业任务的专业服务。相关功能属于分析和产品筛选辅助,不应替

优化前先提问:面向交互式优化的动态前置建模澄清

大型语言模型正越来越多地用于将自然语言问题描述转化为优化模型。但现实中的运筹学需求通常缺少目标、约束条件或业务规则,而这些信息可能改变最终的数学规划模型。研究人员提出了 OR-Clarify,这是一个用于评估智能体能否在建模前识别必要澄清事项的基准。同时,他们提出两阶段框架 InterOPT,用于找出对建模至关重要的未解决信息,并决定继续提问还是停止。在选择题实验中,InterOPT 在准确恢复缺

iRobot 发布双机协作清洁机器人 Roomba Duo

iRobot 在 IFA 2026 发布了 Roomba Duo,这是一套由扫拖一体主机和紧凑型副机构成的清洁系统。两台设备可实时通信,并利用 AI 协调清洁任务。主机负责清洁开放式地面,配备 PowerSpin Max 滚筒拖把,可提供 46 牛顿下压力。高度仅 83.5 毫米的 Roomba Plus 575 Combo Robot 主要清洁角落和边缘,可跨越 35 毫米高的门槛,并配备可向外