AI 新闻中心

AI 新闻中心 过去一年分析了 1723 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

小米第七届黑客马拉松收官:规模创历届新高,首次设立最佳 MiMo 应用奖

小米在北京举行第七届黑客马拉松颁奖典礼,赛事规模创历届新高。共有284支队伍、近千名选手报名,最终149支队伍、505名选手参与48小时极限开发。今年首次设立高校赛区,吸引来自94所高校的145支队伍参赛。新设的最佳 MiMo 应用奖涵盖小米门店智能家居方案助手、在本地完成风险判断的独居人群主动关怀系统,以及结合专用硬件的 AI 陪伴设备。其他获奖项目还探索了 AI 眼镜、智能座舱、家庭物品管理、

Jev 以快速 AI 判断引发全球开发者关注

Jev(又称“System One”)被介绍为一种不生成文字、只输出判断所需概率值的模型。文章称,开发者已将它用于 Home Assistant 提醒、上下文筛选、手机自动化、数据清洗、数据库处理和游戏。其标称成本远低于大型生成式模型,发布数日内据称便出现近五百个开源项目。这种方法可能将简单的分类与判断任务,从高成本的文本生成中分离出来。不过,文章中关于性能、采用规模和成本的数据尚未得到独立验证。

Apollo 古希腊语大模型问世,助力修复受损莎草纸文献

奥地利科学院联合 Mistral 和 Sail Reply 开发了 Apollo,这是一款专门面向古希腊语的大型语言模型。模型使用来自手稿、莎草纸和石刻铭文的约 6 亿个历史词汇训练,可帮助研究人员筛选相关文献残片,并为破损文本的缺失部分提出可能的词句。Apollo 还能根据语境识别荷马时代希腊语和多利亚方言等不同语言形式。不过,模型提供的只是基于统计概率的候选方案,最终复原仍需由专家判断。研发团

阿里据报正以约150人团队试做QwenBook AI设备

据报道,阿里云无影团队正在研发名为QwenBook的AI设备。该产品定位为以智能体为核心的电脑,但目前形态更接近平板。项目仍处于早期试水阶段,主要面向办公场景,据称将接入Qwen3.8-Max和Qwen3.8-Flash等模型。约150人的团队负责产品定义和硬件开发,并整合无影及阿里云操作系统团队积累的系统与端云协同技术。QwenBook试图将阿里的模型、操作系统和端云能力结合到新型终端中,但最终

OpenAI称内部AI可自主训练模型,并呼吁建立全球安全标准

OpenAI表示,其内部AI系统已能协调部分实验性模型的训练流程,并编写用于优化GPU内核的代码。公司认为这可能是递归式自我提升(RSI)的早期形态,但强调完全自主的RSI尚未发生。OpenAI呼吁制定全球技术标准,设置强制性人工监督触发机制,并统一AI事故的分类和报告规则。据称,公司还正与Anthropic协商对商用模型进行交叉测试。不过,关于自主自我提升的说法尚未得到独立证实。

Mira-Scene 为生成式 3D 场景实现像素对齐布局

Mira-Scene 是一个用于从单张图像重建 3D 场景的框架,目标是准确放置生成的 3D 物体。该方法不再使用难以学习且泛化能力较弱的稀疏、无界姿态参数,而是建立可见物体像素与其有界规范表面坐标之间的密集像素级对应关系。结合通过单目几何估计获得的场景空间点云图,这些对应关系可用于恢复物体变换。多模态扩散 Transformer 还会联合生成物体几何和坐标图,以提升形状与布局的一致性。在室内、室

CARE:通过经验引导的校正执行提升机器人 VLA 策略的鲁棒性

研究人员提出了 CARE(Corrective Atomic Robotic Execution)框架,旨在提升机器人“视觉-语言-动作”(VLA)策略的可靠性。现有的 VLA 策略在偏离标准轨迹时容易失效。CARE 通过学习执行过程中的失败经验,建模失败后的偏差分布,并合成具有代表性的失败状态与校正示范。在推理阶段,CARE 结合阶段式规划与物理 3D 监控,在保留任务进度的同时触发动态微调或重

中国扩大“妈祖”AI气象预警系统在中亚落地,尼泊尔定制版已交付

中国气象局将根据2026至2027年行动计划,推动AI气象早期预警方案“妈祖”在中亚国家落地。计划包括开发本地化气象模型、卫星监测、多语种灾害预警产品、数据共享机制和联合科研项目。面向尼泊尔定制的版本已交付该国气象局,并在造成重大伤亡的泥石流灾害后,通过云端支持救援工作。该系统融合风云气象卫星数据与国产AI气象预报模型,可提供高分辨率、快速更新的监测、预报和预警产品。中国气象局表示,“妈祖”目前已

OmniEdu:面向学习与教学的开放基础模型

OmniEdu 是一系列面向 K-12 学习与教学的开放基础模型。其指令微调语料包含 69,999 个样本,围绕四项能力构建:学科能力、课程结构理解、学习困难诊断推理,以及教学支持与脚手架。研究团队微调了 4B、9B 和 27B 模型,并评估其课程理解、K-12 解题、教学辅导和通用能力。OmniEdu-27B 在 K12-Bench 上取得 63.12% 的 Exact Match 和 76.6

阿里巴巴发布激进AI路线图:规划5万亿至10万亿参数模型与真武V900芯片

在2026云栖大会上,阿里巴巴宣布计划训练一款参数规模达5万亿至10万亿的模型,作为通义千问Qwen系列的后续产品。该模型将面向更复杂、持续时间更长的任务,并探索递归式自我提升能力。阿里还发布了由平头哥半导体团队研发的真武V900 AI芯片,称其算力是上一代M890的三倍。基于该芯片的单一集群最多可支持50万张加速卡,预计于2027年第一季度量产并商业化。阿里同时计划到2032年将全球数据中心容量

1%的令牌可能就足够:论策略内蒸馏中的梯度估计

该研究分析了稀疏策略内蒸馏,即只对学生模型生成轨迹中的少量令牌提供教师模型监督。作者提出信息效率比(IER),同时衡量令牌的有用性和梯度估计的可靠性。通过候选集近似,可以在保留采样反向 KL 训练目标的同时选择令牌。在数学和医学推理任务中,加入 IER 后,现有令牌选择方法在多种设置下得到改进。当令牌预算为 0.1% 至 1% 时,稀疏训练在部分情况下达到了或超过未进行令牌选择的完整策略内蒸馏。代

曝阿里巴巴试做 QwenBook,定位原生智能体电脑并主打办公

据《晚点 LatePost》报道,阿里云正在研发一款名为 QwenBook、仍处于早期阶段的 AI 设备。产品定位为原生智能体电脑,但目前形态更接近“千问平板”,主要面向办公场景。据称设备将接入 Qwen3.8-Max 和 Qwen3.8-Flash,并提供系统级听记、Wiki、智能文件夹、自研邮箱、知识库和记忆管理等功能。阿里巴巴还在与金山合作,计划打通 WPS。云栖大会展示的版本预计只会呈现部

行业首个系统级 Agent Harness 架构:荣耀 Magic9 系列首发搭载阿里巴巴 Qwen Intelligence

阿里巴巴发布了面向 AI 手机的全栈解决方案 Qwen Intelligence。预计于 9 月 28 日发布的荣耀 Magic9 系列将成为首批正式支持该方案的机型,荣耀 Robot Phone 也将提供支持。该平台基于 Qwen 大模型,旨在更可靠地执行跨应用的复杂任务。阿里巴巴与荣耀还将基于 Qwen Intelligence 和 MagicOS,共同开发面向下一代 AI 手机的垂直领域模型

Harness-Zero:通过“代理即Harness”实现代理Harness蒸馏

Harness-Zero旨在将专用代理Harness带来的性能提升迁移到模型权重中。引导代理会在固定目标Harness的动作空间内纠正学生模型的回答,并据此生成微调数据。部署时可以移除专用Harness。在知识工作、工具使用和科学任务实验中,该方法将任务成功率宏平均从23.3%提升至44.3%,甚至超过保留专用Harness时的41.7%。此外,在三个领域的28种Harness诱导行为模式中,平均