2026CSDI:AGI前夜,长期深耕且同时理解Agent与模型的企业更受关注
文章分析了2026年人工智能产业的发展趋势,认为行业竞争正从单一模型转向整合模型、Agent、算力、数据、工程和组织能力的系统竞争。文章称,WAIC 2026上,以AI Agent和智能应用为主要标签的参展主体多于基础大模型企业。其核心观点是,Agent的能力上限最终取决于基础模型在预训练阶段形成的推理能力和世界知识,编排框架只能组织流程,无法从根本上弥补模型能力不足。文章还讨论了软件开发从Cop
AI 新闻中心 过去一年分析了 504 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
文章分析了2026年人工智能产业的发展趋势,认为行业竞争正从单一模型转向整合模型、Agent、算力、数据、工程和组织能力的系统竞争。文章称,WAIC 2026上,以AI Agent和智能应用为主要标签的参展主体多于基础大模型企业。其核心观点是,Agent的能力上限最终取决于基础模型在预训练阶段形成的推理能力和世界知识,编排框架只能组织流程,无法从根本上弥补模型能力不足。文章还讨论了软件开发从Cop
月之暗面宣布,其多模态模型 Kimi K2.5 将于本月底停止服务。该模型于今年 1 月发布并开源,支持文本和图像输入,以及对话、推理、编程和 Agent 任务。月之暗面当时称,Kimi K2.5 是其最智能、最全能的模型,并宣称在编程、视觉处理等领域取得开源模型中的领先表现。今年 7 月,该公司又开源了 Kimi K3。这是一款拥有 2.8 万亿参数、原生支持视觉理解并具备 100 万 Toke
OpenBMB开源了MathForm,这是一套用于将自然语言数学表述自动形式化为Lean4的框架、数据集和模型。系统结合检索机制与编译器、语义一致性引导的验证流程,并根据Lean的诊断结果最多进行三轮修正。FormalVerse数据集包含超过36.7万个经过验证的Lean4示例。根据公开测试,使用FormalVerse训练的模型一致性检查率达到60.32%,高于FineLeanCorpus的46.
大语言模型智能体正从语言生成器发展为能够执行复杂长期任务的自主系统。文章指出,当任务需要异质专业知识、并行子任务、独立验证和持久状态时,单个智能体的能力或上下文扩展会面临架构限制。作者提出“系统智能”概念,强调将多个专业智能体组织并协调到共同目标之下。“图工程”通过显式、动态且不断演化的图结构表示任务、智能体和系统状态,从而支持复杂目标的组织、异质智能体的协作以及系统演进。文章系统总结了这一范式的
谷歌表示,其开源模型家族Gemma的累计下载量已超过10亿次,开发者还基于该系列创建了超过10万个定制变体。Gemma目前被用于太空图像分析、医疗报告结构化和生物医学研究。谷歌DeepMind、谷歌研究院与耶鲁大学合作开发的Cell2Sentence-Scale 27B,可将单细胞基因表达数据转换为语言模型能够分析的类文本序列。该模型对4000多种药物进行了虚拟筛选,提出将CK2激酶抑制剂silm
由智元机器人控股的上纬新材已开启消费级机器人启元Q1和T1的预订,首批产品预计于9月发货,售价尚未公布。T1身高约100厘米、重约16公斤,可在人形轮足和四足机器狗形态之间自主切换,主要面向家庭陪伴、户外伴行和自动影像拍摄。公司称,T1采用Transformer跨形态一体架构,让两种形态使用同一套硬件和系统,而非简单拼接两台机器人。其功能包括柔性力控、语音交互、长期记忆、声纹识别,以及联动运动相机
OpenAI首席执行官萨姆·奥尔特曼表示,他担心人工智能未来会被少数公司、模型或个人控制,使大多数人无法参与决定技术如何塑造社会。他同时警告,AI也可能挣脱人类控制。奥尔特曼认为,对后一种风险的恐惧可能导致社会为了安全牺牲过多自由,反而促成少数主体掌控AI的局面。谈话还涉及开放权重模型的行业争议。英伟达、Meta和微软等公司支持更广泛地采用开放权重模型,而Anthropic未签署相关联名信。Ope
据《商业内幕》记者Katie Roof报道,Hugging Face正在探索出售事宜,潜在估值可能超过130亿美元。该公司2023年的估值为45亿美元。消息人士称,Hugging Face正与一家银行合作,以了解潜在竞标者的兴趣。该平台帮助开发者发现和使用人工智能模型及数据集。目前尚未宣布任何交易,相关讨论也不一定会最终促成出售。
诺亦腾机器人在 2026 世界机器人大会期间发布 HiPHI,这是一套面向人形机器人学习、数字人和计算机图形学研究的高精度光学动作捕捉数据集。数据集总长 617.5 小时,包括 371.8 小时的全身人体运动数据和 245.7 小时的人与物体交互数据,并提供左右镜像版本。数据来自 132 名动捕演员,以 90 Hz 频率和亚毫米级光学精度采集,再依据 FrameNet 的人类动作语义框架,按动作单
法律科技公司 Harvey 发布了内部模型 Harvey Tenet。该模型基于中国 AI 实验室月之暗面的开放权重模型 Kimi K3 进行后训练。Harvey 的投资方包括 OpenAI、红杉资本和 Andreessen Horowitz。公司称,Tenet 在复杂法律任务中表现突出,并能降低推理成本;训练历时两个月,使用了约 150 块英伟达 B300 GPU。此举意味着 Harvey 的技
英伟达已与人工智能初创公司Poolside达成一项全面协议,计划在美国建立开放的人工智能生态系统。该项目旨在与中国人工智能巨头及美国主要人工智能企业展开竞争。
上纬新材启元 Q1 研发负责人彭文正于 2026 世界机器人大会展示了团队开发的个人机器人。他表示,机器人本体已不再是行业最大的瓶颈,更大的问题在于智能能力不足,以及内容和生态系统匮乏。彭文正认为,消费级机器人将先经历技术试验与新鲜感阶段,随后拓展至内容创作、企业接待和商业演出,最终探索真正具备实用价值的应用场景。启元 Q1 采用小型化设计和全身柔顺力控,以提升消费使用的安全性。公司表示,超过 9
SemiAnalysis称,在每个 successive AI时代中,开放模型追赶该时代首个领先闭源模型所需的时间都缩短了一半。该付费分析比较了早期扩展、推理和智能体式AI等前沿模型阶段的开放与闭源模型,并探讨两者之间的性能差距是否正在缩小。
一项研究对阿里巴巴、OpenAI和英伟达的三款混合专家模型进行微调,使其能够用希腊语推理;每个模型有36亿至40亿个活跃参数。准确率基准几乎没有变化,而且在这一规模下噪声很大:仅改变随机种子,得分就会波动7.7分。真正的变化体现在行为层面。基础模型在1000条推理轨迹中没有一条使用希腊语思考,即使问题本身是希腊语。经过监督微调(SFT)后,模型在约98%的题目中使用问题所用语言进行推理,语法性得到
一项研究提出了一种方法,用于衡量自动语音识别模型是否针对公开基准进行了优化,却没有相应提升通用转录能力。研究关注音频本身无法唯一确定参考文本,或音频与基准参考文本相矛盾的情况。通过参考文本不一致、遮蔽数字恢复和正字法切换三类行为探测,研究发现,表现最好的开源模型即使面对矛盾、被遮蔽或含糊的音频,也会逐字输出基准参考文本片段。机制分析表明,模型会依赖狭窄的声学线索,选择有利于基准成绩的策略,而不是忠