面壁智能 MiniCPM 系列开源模型全球累计下载量突破 5000 万次
面壁智能宣布,在成立四周年之际,MiniCPM 系列开源模型全球累计下载量已突破 5000 万次。该公司于 2022 年在北京成立,孵化自清华大学自然语言处理实验室。面壁智能还表示,旗下 MiniCPM 系列端侧大模型已深度赋能三星 Galaxy AI,并称这是国产端侧大模型首次进入国际头部手机厂商的全球旗舰产品线。今年 7 月,面壁智能与 OpenBMB 发布端侧模型 MiniCPM5-2B,并
AI 新闻中心 过去30天分析了 1112 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
面壁智能宣布,在成立四周年之际,MiniCPM 系列开源模型全球累计下载量已突破 5000 万次。该公司于 2022 年在北京成立,孵化自清华大学自然语言处理实验室。面壁智能还表示,旗下 MiniCPM 系列端侧大模型已深度赋能三星 Galaxy AI,并称这是国产端侧大模型首次进入国际头部手机厂商的全球旗舰产品线。今年 7 月,面壁智能与 OpenBMB 发布端侧模型 MiniCPM5-2B,并
总部位于上海的人工智能公司MiniMax表示,2026年上半年营收同比增长283%,达到约1.166亿美元,高于2025年159%的增速。不过,在发布顶尖大型语言模型方面,MiniMax落后于Z.AI等竞争对手,其M3模型据报道不及Z.AI的GLM-5.2。
智谱确认,此前以匿名模型身份上线的 Ox Alpha 正是其 GLM 系列的新版本,并表示将于 8 月 26 日晚间正式发布模型权重。Ox Alpha 于 8 月 20 日在 OpenRouter 上线,预览期间使用量迅速攀升至平台首位,并刷新单日模型使用量纪录。终端编程智能体 OpenCode 也在免费套餐中提供该模型,并声称每日最多可处理 100 万亿个 token。研究人员对 25 个提示词
中国人工智能公司MiniMax Group在2026年上半年的营收增长283%。不过,在发布顶级大型语言模型方面,该公司仍落后于Z.AI等竞争对手。
京东发布“超脑”大模型3.0,用于协调从仓储到配送的全流程物流运营。据公司介绍,该系统将数亿包裹端到端最优路径的计算时间从分钟级缩短至秒级,并通过人工智能协同优化仓储、运输和配送,以提升运营效率、系统韧性并降低成本。京东称,这是供应链全链路应用人工智能大模型的工业级案例之一。有关性能提升和应用规模的数据均来自公司披露,尚未得到独立验证。
Z.ai(又称智谱)确认,Ox Alpha是其GLM模型系列的新一代版本。该模型登上OpenRouter排行榜首位,凭借免费使用和较高性能迅速获得大量在线用户。Z.ai表示,将于今晚发布Ox Alpha的模型权重。
据报道,近期一系列利用 Anthropic、OpenAI 和 Meta Platforms 人工智能模型实施的网络攻击引发了广泛担忧。这些事件凸显了日益强大的人工智能系统带来的安全风险,也表明在网络攻击造成损害之前及时发现并阻止攻击正变得更加困难。
CyberFactory 是一个开源框架,可将包括 CVE 在内的公开漏洞资料转化为用于概念验证生成、漏洞修复和网络安全问答的可执行、可验证任务。该框架通过工具交互、源代码检查、领域知识引导的问题解决以及基于执行结果的验证,生成智能体式训练数据。研究人员利用这些轨迹训练了防御导向模型 Aegis,使其在推理时无需额外技能即可掌握相关流程。在 CyberGym 上,Aegis 在一小时限制下取得 5
LAWA是一种世界动作模型架构,通过紧凑的潜在动作表示未来意图,而不是在推理时生成未来观测或视频。该方法在保留未来规划优势的同时降低了延迟。在RoboCasa上,LAWA在少样本设置下取得65.6%的平均成功率,在完整数据设置下达到80.8%,分别比匹配的Fast-WAM基线高9.6和4.5个百分点。与匹配的Joint-WAM变体相比,LAWA保持了相当的性能,同时将推理延迟降低42.9%。此外,
据报道,新的 AI 模型 Ox Alpha 凭借高性能和免费使用,迅速登上在线使用量排行榜前列。该模型由中国 Z.AI(又名智谱)开发。报道强调了它的受欢迎程度和能力,但没有提供独立的基准测试结果。
据路透社报道,中国人工智能初创公司月之暗面正与微软、亚马逊和谷歌洽谈营收分成协议,计划将旗舰模型 Kimi K3 托管在 Azure、AWS 和 Google Cloud 上。知情人士称,月之暗面希望从 K3 相关服务营收中获得 30%的分成,比例与其向使用开放权重模型的主要客户提出的条款相近。相关谈判仍处于早期阶段,营收分配机制、数据访问权限以及 Token 消耗量审计是主要分歧。交易能否达成尚
一项对大语言模型训练过程的分析指出,婴儿学习语言的速度远远超过当前的 AI 聊天机器人,所需数据也少得多。幼儿接触约 1000 万至 3000 万个词后,就能开始说出清晰、可理解的句子;如果用同等规模的文本训练 GPT-2,得到的可能只是一个胡言乱语生成器。研究人员认为,这种效率差距是 AI 行业必须面对的根本难题,尤其会挑战那些试图仅通过不断扩大模型规模和训练数据来实现人类水平 AI 的路线。
Artificial Analysis 与 Liquid AI 发布了面向手机端的 AI 跑分基准,重点评估模型在 iPhone 17 Pro 上的表现。测试对象为 4 bit 量化后容量不超过 8GB 的模型,采用 BFCL、IFBench、AA-Omniscience、GPQA Diamond 和 MATH-500 五项基准。Artificial Analysis 负责模型能力评测,Liqui
OpenRouter推出统一的异步API,用于接入Seedance、Veo、Wan等视频生成模型。开发者提交请求后会获得任务ID,再独立查询处理状态,无需在整个生成过程中保持HTTP连接。流程包括身份验证、模型查询、任务提交、状态轮询,以及通过分块流式传输下载生成完成的MP4文件。该方案可简化模型切换,并支持在进程重启后恢复任务追踪。不过,不同模型在视频时长、分辨率、宽高比、功能和价格方面存在差异
据两名知悉财务数据的人士透露,中国AI实验室DeepSeek正积极推进第二轮融资。公司2026年前7个月营收约4.75亿元人民币,接近2025年全年营收的10倍;净亏损则由去年的9.35亿元收窄至7.15亿元。据称,DeepSeek计划募资500亿元,目标估值为5000亿元,并已聘请投行筹备明年可能进行的上市。业务增长主要来自开源模型应用规模扩大,尤其是低成本的V4-Flash。前7个月整体毛利率