通义千问开放平台上线对话式生活服务接入能力
阿里巴巴通义千问开放平台正式上线,支持开发者将服务接入手机、PC和AI眼镜。用户无需切换应用,即可通过对话完成查件寄件、租房搜索、家政预约和理财分析等操作。平台已接入顺丰速运、自如、天鹅到家、彩云天气等服务。开发者可通过标准化协议接入已有Agent,并使用授权、调试、AI支付、订单管理等基础能力,以及多模态交互组件。AI眼镜还支持通过自然语言创建自定义Skill,例如为视障人士提供障碍物提醒。
AI 新闻中心 过去一年分析了 1954 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
阿里巴巴通义千问开放平台正式上线,支持开发者将服务接入手机、PC和AI眼镜。用户无需切换应用,即可通过对话完成查件寄件、租房搜索、家政预约和理财分析等操作。平台已接入顺丰速运、自如、天鹅到家、彩云天气等服务。开发者可通过标准化协议接入已有Agent,并使用授权、调试、AI支付、订单管理等基础能力,以及多模态交互组件。AI眼镜还支持通过自然语言创建自定义Skill,例如为视障人士提供障碍物提醒。
Artificial Analysis 的文生视频模型排名显示,前十名中有九个来自中国人工智能实验室。这些模型正逐步获得全球用户采用,可能使中国在构建所谓“世界模型”方面取得优势。不过,围绕中国人工智能雄心的讨论仍主要集中在 Moonshot 的 Kimi K3 等新型大语言模型上。
Figure AI、Sunday Robotics、Weave Robotics 和 1X 等机器人创业公司,正将叠衣服视为家用机器人进入真实家庭的潜在突破口。衣物属于可变形物体,机器人需要识别其状态,并完成抓取、展开和折叠,因此对感知与精细操控能力要求较高。但这项任务的失败成本相对较低,机器人即使出错通常也只会掉落衣物。家庭环境比工厂和仓库更复杂,不过让人把衣物放到机器人面前,可以限制作业范围。
AudioRubrics 是一个用于提升音频推理能力的强化学习框架。它从每个原始波形中生成基于音频证据的评估规则,并根据模型自身的输出持续重新生成和调整规则权重。与只监督最终答案或依赖固定人工标准的方法相比,这种设计能够针对模型当前的弱点提供自适应的训练信号。该方法旨在处理从感知到多步推理等不同类型的问题。研究人员在三个音频推理基准上进行评估,报告称其显著优于多种开源和基于训练的基线方法。分析还显
一项研究考察了人格条件化的大型语言模型智能体在经历11种重大生活事件后,性格特征如何变化。研究以“大五人格”作为心理测量基准,将智能体的变化轨迹与人类人格纵向研究证据进行比较,并通过新基准BFI-Adapt评估了14个模型。结果显示,智能体会产生可测量、稳定且受事件影响的特征变化,但变化幅度通常小于人类研究中的效应量。性别和文化区域提示的调节作用较小,而不同人格设定之间的差异比人类样本低三到四倍。
基于 LLM 的智能体越来越多地调用外部工具,自主完成多步骤任务,但它们经常获取超出任务所需范围的敏感信息。PrivacyPeek 是一个评估“获取阶段”隐私泄露的基准,关注数据首次进入智能体上下文、尚未出现在回复或外部操作中的阶段。该基准包含 1,182 个案例,覆盖 7 种获取行为和 16 个应用领域。它分析智能体的工具调用轨迹及接收的数据,并测试攻击者能否轻易诱导智能体泄露其已获取但未公开的
长安启源宣布,启源 Q07 激光版、启源 A06 激光版和全新 Q05 激光版用户将全部免费 OTA 升级至天枢领航 Pro。升级将于 2026 年 10 月 15 日至 12 月 30 日分批推送。该驾驶辅助系统配备激光雷达,官方称其可在夜间、隧道等弱光环境下更早识别障碍物。长安还将招募用户体验端到端城市领航 NOA 功能,并与工程师交流。天枢领航分为 Pro、Max 和 Ultra 三个版本。
宇树科技已启动首次公开募股申购,有望成为中国第一家上市的人形机器人企业。公司发行价确定为每股150.80元,上市后市值约609.93亿元。大疆曾于2018年以约1012.86万元取得宇树约17%的股份,一度成为其最大外部股东,但在2019年减资后退出。若大疆一直持有这笔股份,其当前市值可能达到数十亿元。宇树计划将募资重点投入智能机器人模型、机器人本体、新产品及制造基地建设。公司2025年营收为16
科技公司似乎没有在自身工作环境中践行人工智能将为人们带来更多闲暇时间的说法。高管宣称人工智能能够减轻工作负担,但一些员工表示自己每周工作时间长达90小时。
根据最新行业数据,2026年上半年,中国人形机器人厂商占全球出货量的97%以上。这一数据表明,在仍处于发展初期的人形机器人市场,中国已取得领先美国竞争对手的先发优势。
研究人员提出了 C4,这是一套受认知科学启发的评估框架,用于测试多模态大语言模型(MLLM)能否从不明显但有意义的概念关系中还原被编码的含义。该框架利用中文成语构建跨概念创造力任务,提供明确的连接路径、可调节的难度和精确答案。C4-Eval 包含 184 个合成题目和 37 个由人类创作的案例,在五种任务设置下形成 884 个主要答案恢复案例。对十个 MLLM 的评估显示,表现最好的闭源模型准确率
据韩国媒体《首尔经济日报》援引业内消息人士报道,三星电子 HBM4 内存的良率已接近 80%,提前达到原定于 2026 年底实现的目标。消息称,三星今年 2 月初步量产 HBM4 时,良率约为 60%,限制了投片量。随着良率提升,三星可能将更多 DRAM 晶圆产能分配给 HBM4。据报道,公司计划将本季度 HBM4 销售额提升至上季度的 3 倍以上,并将 HBM 在下半年整体内存业务营收中的占比扩
Linux 7.2-rc7 已正式发布,内核开发进入最终测试阶段。Linux 创始人 Linus Torvalds 表示,该候选版本体积异常庞大,主要是因为开发者使用 AI 工具生成了大量小型修复,导致整体代码差异规模显著增加。Torvalds 直言对此“并不兴奋”,但认为目前尚可接受,代码中也没有发现令人担忧的问题。本次版本包含 S/390 和 zCrypt 修复、BTRFS 修复工作线程基础设
伦敦国王十字区曾是一个治安不佳、环境杂乱的区域,如今已转型为重要的人工智能中心。DeepMind于2016年迁入后,进一步推动了这一变化。目前,OpenAI、Meta、Wayve等公司也在此设立办公地点。对许多英国AI初创企业而言,如今最关心的问题是如何在需求不断增长的国王十字区获得办公空间。
台湾积体电路制造公司报告称,其月度销售额增长45%。这一结果表明,尽管市场波动持续,人工智能硬件的需求仍然强劲。