AI 新闻中心

AI 新闻中心 过去一年分析了 504 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Iris:迈向搜索前沿

研究团队推出 Iris-mini 和 Iris-pro 两个搜索代理,分别以 35B-A3B 和 397B-A17B 规模训练。其训练任务根据网页语料中的多跳超链接结构生成,并专门设计为无法通过简单的字符串匹配解决。研究采用监督微调与强化学习相结合的方法,优化代理的实时搜索和上下文管理能力。启用上下文管理后,作者称两款模型在 BrowseComp、BrowseComp-ZH、DeepSearchQ

科技巨头密集更新 AI 模型,“模型疲劳”问题凸显

据报道,Anthropic、Meta、谷歌和 OpenAI 在同一周内接连发布新模型或升级版本,进一步加剧了企业 AI 市场的竞争。快速的发布节奏让企业更难比较不同模型的能力、价格和安全风险。业内人士认为,“模型疲劳”已经成为现实问题;分析人士则指出,多数更新属于渐进式改进,而非基础技术的重大突破。文章还提到开源 AI 的发展、英伟达拟收购 Hugging Face,以及 AI 基础设施支出的增长

阿里巴巴开源 Qwen-Drive-1.0-4B:面向自动驾驶的视觉语言基础模型

阿里巴巴开源了基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型 Qwen-Drive-1.0-4B。该模型在保留原有视觉语言模型架构的同时,统一整合了 3D 感知、视觉问答和运动规划。其分阶段训练方案结合驾驶监督数据与通用视觉语言数据,旨在兼顾驾驶专属能力、通用视觉理解和指令遵循能力。模型提供 SFT 和强化学习两种规划专家,评测覆盖 3D 感知、驾驶场景理解、通用视觉语言能力,以及开环、伪

开源安卓应用商店 F-Droid 考虑采用 Debian 式 AI 政策

F-Droid 正在考虑采用一套大体仿照 Debian 最新政策的 AI 使用规范。Debian 允许在软件开发、文档编写、维护、打包等工作中负责任地使用生成式 AI。AI 辅助生成的代码和文档必须符合质量及法律要求,最终责任由人类开发者承担。Debian 鼓励披露 AI 使用情况,但不强制要求标注。F-Droid 当前的政策草案几乎完整复制了 Debian 的相关文本,仅将 Debian 的名称

专访李开复:中国的开源模型优势、人工智能对就业的影响及更多议题

彭博社记者米沙尔·侯赛因就中国在开放式人工智能模型方面的优势、人工智能对就业的影响、美国对芯片的出口限制,以及中国人工智能在发展中国家所扮演的角色等问题采访了李开复。李开复表示,尽管多年来获取先进芯片受到限制,中国人工智能企业仍在迅速缩小与美国竞争对手之间的差距。

小米开源表格数据模型 TabLDM:四大基准评测进入第一梯队,OpenML-CTR23 回归排名第一

小米已开源通用表格数据基础模型 Xiaomi-TabLDM。该模型完全基于结构因果模型生成的大规模合成数据进行预训练,旨在无需针对每个数据集重新训练或调参,即可完成分类和回归任务。其架构采用双流特征分组、轻量级 Attention Residual、稀疏混合专家和 Test-Time Scaling。根据小米公布的评测结果,TabLDM 在 OpenML-CTR23 回归任务中排名第一,并在 TA

DRACO:利用动态评分标准实现长程智能体训练中的细粒度信用分配

DRACO是一种用于训练长程任务AI智能体的强化学习方法,适用于缺乏可直接验证成功信号的场景。该方法在训练过程中动态生成多标准评分表,在完整轨迹结束后进行评估,再将评估结果重新分配给对相关标注标准负责的各个步骤。这样,DRACO能够为GRPO生成具有差异性的逐步优势值,而无需额外训练归因模块。在AppWorld上,DRACO比基础模型高15.9分,比使用稀疏真实奖励训练的GRPO高5.3分。在域外

微信开源多模态嵌入模型 WeMM-Embedding

微信 AI 开源了通用多模态嵌入模型 WeMM-Embedding,提供 2B、4B 和 9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。腾讯表示,该模型采用基于 Qwen3.5 多模态架构的统一骨干。在 MMEB-v2 多模态嵌入基准中,9B 版本以 80.6 分排名第一,2B 版本获得 77.9 分,超过此前领先的 8B 开源模型。微信称,WeMM-Embedding

工信部支持国家级人工智能开源社区 AtomGit 发展

中国工业和信息化部发布《人工智能中小企业创业支持计划(2026—2028年)》,计划在三年内培育科技和创新型中小企业1万家以上,以及专精特新“小巨人”企业2000家以上。政策将扩大低成本普惠算力供给,建设高质量行业数据集,并发展数据咨询、治理和标注服务。计划还支持人工智能原生企业、个人公司和智能体开发者探索商业化路径。工信部将推动国家级人工智能开源社区 AtomGit 壮大,鼓励人工智能创业企业向

Puffin-World:利用原生3D世界状态扩展统一多模态模型

Puffin-World是一种统一的多模态架构,将物理理解、空间模拟以及3D世界生成与重建整合到单一系统中。它共同建模重力场和纬度等物理状态、由深度表示的几何结构,以及图像形式的外观。统一的Omni-Camera表示支持多种任务和灵活的相机运动。系统在生成未来视角的同时重建其底层几何结构,旨在生成物理一致且视觉稳定的世界。为扩展复杂场景的训练,研究团队构建了Puffin-16M数据集,其中包含15

Random Attention:重新思考高效推理中的 KV 缓存淘汰

Random Attention 对根据缓存 Token 未来重要性进行评分和保留的 KV 缓存压缩方法提出质疑。该方法保留提示内容,并在每个注意力头内均匀随机淘汰 Token,完全省去评分计算。在四个模型和六项推理任务上的测试显示,其效果可与此前最强的淘汰方法相当,同时在 vLLM 部署中的吞吐量提升 32% 至 43%。受控实验表明,提示是缓存中最脆弱的部分;推理轨迹则依靠文本中的重复表述以及

阿里巴巴千问上线首月用户突破3000万,开源企业级上下文平台

阿里巴巴旗下AI办公产品QwenWork上线一个月后,用户数突破3000万,其中企业用户占比超过一半。团队在30天内完成120次更新,并同步推出国际版。开源项目MyContext可将分散在即时通信、文档、审批和邮件系统中的异构数据,转化为AI Agent可调用的上下文。与钉钉集成后,Agent可通过自然语言指令查询CRM和ERP系统。办公专用模型Qwen3.8-Flash针对多步规划和上下文压缩进