AI 新闻中心

AI 新闻中心 过去24小时分析了 254 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

SMAT:简单高效的合并感知训练方法

模型合并可以在无需联合重新训练的情况下整合多个专家模型的能力,但标准训练并不能保证模型合并后的表现。SMAT同时优化任务损失,以及在模拟合并参数上的预期损失。通过多项效率优化,其训练时间相比标准微调增加不到2%。在四种语言和视觉语言模型骨干上,SMAT在五种合并方法中的平均分数较各骨干最强的基线提升了1.07至2.16分。

吉利智充 C12 在中国五城落地,单枪峰值功率达 2.25 兆瓦

吉利智充 C12 已在杭州、上海、宁波、嘉兴和西安五座城市投入使用。吉利称,单枪峰值功率可达 2.25 兆瓦,车辆电量从 10% 充至 97% 平均用时 8 分 40 秒。系统利用 AI 温升预测算法提前最多 30 秒判断电池温度变化,并动态调整充电功率。吉利表示,该技术可将电池最高温度控制在 65℃以下,并使电池循环寿命提升超过 20%。系统还采用了与阶跃星辰联合开发的能源大模型“星睿 Powe

KernelZero通过提议器与编码器协同进化持续改进GPU内核生成

KernelZero是一种用于自动生成正确且高效GPU内核的协同进化框架。提议器根据API集合生成Torch模块,编码器则将其转换为CUDA或Triton内核。系统会根据编码器当前的不足生成有针对性的训练模块,并采用正确性感知优化方法,只有在可靠性达到足够水平后才优先提升性能。根据报告的实验结果,KernelZero-7B在CUDA上超过Claude 4.5 Sonnet,在Triton上超过De

从强化学习视角看 OPD:面向高样本效率 LLM 推理的最小二乘策略蒸馏

该研究从强化学习角度分析语言模型的在策略蒸馏(OPD)。研究建立了 OPD 反向 KL 目标与 KL 正则化策略优化之间的联系,并提出最小二乘策略蒸馏(LSPD)。该方法通过乐观探索保持策略多样性,同时重复利用已收集的离策略轨迹,以提高 rollout 效率。理论分析将 LSPD 与乐观价值学习联系起来,并在理想化的在线探索设置下给出 O(log K) 的遗憾上界。在六个数学推理基准和多种教师—学

OpenAI提出前沿AI训练安全指导原则:高级管理人员应有否决权

OpenAI提议,企业在开展前沿AI强化学习训练前,应提交结构化的安全论证文件,并由多名高级管理人员审查;研究和安全负责人等应有权叫停训练。负责训练的高管还应对安全论证和事故响应承担责任。若高优先级安全警报未在规定时限内得到确认,相关训练应自动暂停。建议还要求识别未对齐模型的下游用途。OpenAI表示,这些建议已开始落实,未来可能继续调整。此前,因有报告称AI智能体获得敏感领域访问权限并出现意外行

SEMIFIVE 接获支持 LPDDR6 的 AI 推理 ASIC 芯片设计订单

韩国芯片设计服务企业 SEMIFIVE 宣布,将为一家美国无晶圆厂 AI 芯片企业开发支持 LPDDR6 和 PCIe Gen5 的数据中心级推理加速器。这将成为 LPDDR6 作为 ASIC 片外缓存的早期应用案例之一。该芯片预计于 2027 年上半年流片,2028 年量产出货。订单采用“规格交接”模式:客户提供核心性能目标和规格,SEMIFIVE 负责从详细设计、封装、测试到量产及软件开发的完

2026年世界互联网大会乌镇峰会将于11月2日至5日举行,聚焦人工智能开源开放

2026年世界互联网大会乌镇峰会将于11月2日至5日在浙江乌镇举行,主题聚焦人工智能开源开放发展,以及创新、安全治理和国际合作。大会将设置27个分论坛,讨论全球网络空间治理、数智时代的理论与政策、机器人和具身智能等议题。主论坛将举行“人工智能乌镇对话”,邀请科技企业、开源大模型企业负责人和人工智能科学家,探讨全球人工智能开源生态建设。“互联网之光”博览会预计有400多家企业参展,并将举办涉及智能医

xAI 推出 Team Bots:供团队共享的 Grok 智能体

xAI 已面向 Teams 和 Enterprise 计划推出 Team Bots 公开测试版。共享的 Grok 智能体可以访问团队文件、指令和已连接的应用,并积累团队共用的工作知识,同时保持每位用户对话的私密性。它们可在 Slack 中使用,也能配置用于销售、产品开发、营销或数据分析等任务。xAI 称,一家保险公司在 24 小时内搭建了 Team Bot 并自动化一项工作流程,帮助客户挽回超过

央视起底AI批量拨号网贷诈骗:两个月逾千人受骗,涉案流水超千万元

浙江乐清警方破获一起利用AI语音系统自动拨打电话的诈骗案。据警方介绍,该团伙两个月内骗取上千人,涉案流水超过千万元。系统向非法获取的电话号码批量外呼,根据对话关键词判断用户意向,再将有兴趣的人转接给人工话务员。话务员以虚假贷款额度和代办会员费退款为诱饵,诱使受害者转账。警方已抓获30名嫌疑人,案件仍在进一步侦办中。

OpenAI 明日重新开放 200 美元 Pro 订阅新用户申请,API 等值接近翻倍

OpenAI 将于明日重新开放月费 200 美元的 ChatGPT Pro 订阅新用户申请。调整用量计算方式后,该订阅的 API 等值将接近原来的两倍。OpenAI 不会恢复此前的 5 小时使用限制,而是仅保留每周用量管理,让用户可在需要时集中使用额度。由于 GPT-6 Astra 带来算力需求激增,OpenAI 曾于 9 月暂停新用户注册。公司还预告将新增更多不计入用量的功能,但暂未公布具体内容

TrendForce:AI智能体需求推动全球服务器CPU交付周期延长至25至30周

TrendForce称,受AI智能体相关需求增长影响,全球服务器CPU交付周期已延长至25至30周,通常为16至20周。该机构以Meta的Muse为例:这项服务可执行多步骤任务,通过云端浏览器访问网站,并在用户关闭应用后继续于后台运行。Muse部署在独立虚拟机中,每台虚拟机配有专属浏览器并保存用户数据。Meta曾提出为每位用户配置一台虚拟机,包含2个vCPU、8GB内存和100GB固态硬盘;这一方

QwenGyre:用于训练超长时域智能体的弹性强化学习框架

QwenGyre是一套面向在线强化学习的框架,适用于执行时间长达数小时、包含数百次模型与环境交互,并在每次rollout中生成数十万令牌的智能体任务。该框架可在rollout与训练之间动态调配GPU,重建分支轨迹,评估阶段性进展,并去除冗余路径。根据文中评测,QwenGyre将NL2RepoBench成绩从52.5%提升至58.5%,相较Colocate最高加速1.85倍,相较Async最高加速1