OpenAI提出前沿AI训练安全指导原则:高级管理人员应有否决权
OpenAI提议,企业在开展前沿AI强化学习训练前,应提交结构化的安全论证文件,并由多名高级管理人员审查;研究和安全负责人等应有权叫停训练。负责训练的高管还应对安全论证和事故响应承担责任。若高优先级安全警报未在规定时限内得到确认,相关训练应自动暂停。建议还要求识别未对齐模型的下游用途。OpenAI表示,这些建议已开始落实,未来可能继续调整。此前,因有报告称AI智能体获得敏感领域访问权限并出现意外行
AI 新闻中心 过去7天分析了 1086 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
OpenAI提议,企业在开展前沿AI强化学习训练前,应提交结构化的安全论证文件,并由多名高级管理人员审查;研究和安全负责人等应有权叫停训练。负责训练的高管还应对安全论证和事故响应承担责任。若高优先级安全警报未在规定时限内得到确认,相关训练应自动暂停。建议还要求识别未对齐模型的下游用途。OpenAI表示,这些建议已开始落实,未来可能继续调整。此前,因有报告称AI智能体获得敏感领域访问权限并出现意外行
韩国芯片设计服务企业 SEMIFIVE 宣布,将为一家美国无晶圆厂 AI 芯片企业开发支持 LPDDR6 和 PCIe Gen5 的数据中心级推理加速器。这将成为 LPDDR6 作为 ASIC 片外缓存的早期应用案例之一。该芯片预计于 2027 年上半年流片,2028 年量产出货。订单采用“规格交接”模式:客户提供核心性能目标和规格,SEMIFIVE 负责从详细设计、封装、测试到量产及软件开发的完
2026年世界互联网大会乌镇峰会将于11月2日至5日在浙江乌镇举行,主题聚焦人工智能开源开放发展,以及创新、安全治理和国际合作。大会将设置27个分论坛,讨论全球网络空间治理、数智时代的理论与政策、机器人和具身智能等议题。主论坛将举行“人工智能乌镇对话”,邀请科技企业、开源大模型企业负责人和人工智能科学家,探讨全球人工智能开源生态建设。“互联网之光”博览会预计有400多家企业参展,并将举办涉及智能医
xAI 已面向 Teams 和 Enterprise 计划推出 Team Bots 公开测试版。共享的 Grok 智能体可以访问团队文件、指令和已连接的应用,并积累团队共用的工作知识,同时保持每位用户对话的私密性。它们可在 Slack 中使用,也能配置用于销售、产品开发、营销或数据分析等任务。xAI 称,一家保险公司在 24 小时内搭建了 Team Bot 并自动化一项工作流程,帮助客户挽回超过
Anna Edwards、Guy Johnson、Tom Mackenzie和Mark Cudmore在《Bloomberg: The Opening Trade》中讨论分析师和投资者当天关注的主要议题。节目将AI安全担忧视为股市面临的阻力之一。
针对前沿 AI 训练安全案例的初步指南涵盖技术防护措施、运营实践,以及对目标错位事件的调查。
浙江乐清警方破获一起利用AI语音系统自动拨打电话的诈骗案。据警方介绍,该团伙两个月内骗取上千人,涉案流水超过千万元。系统向非法获取的电话号码批量外呼,根据对话关键词判断用户意向,再将有兴趣的人转接给人工话务员。话务员以虚假贷款额度和代办会员费退款为诱饵,诱使受害者转账。警方已抓获30名嫌疑人,案件仍在进一步侦办中。
OpenAI 将于明日重新开放月费 200 美元的 ChatGPT Pro 订阅新用户申请。调整用量计算方式后,该订阅的 API 等值将接近原来的两倍。OpenAI 不会恢复此前的 5 小时使用限制,而是仅保留每周用量管理,让用户可在需要时集中使用额度。由于 GPT-6 Astra 带来算力需求激增,OpenAI 曾于 9 月暂停新用户注册。公司还预告将新增更多不计入用量的功能,但暂未公布具体内容
TrendForce称,受AI智能体相关需求增长影响,全球服务器CPU交付周期已延长至25至30周,通常为16至20周。该机构以Meta的Muse为例:这项服务可执行多步骤任务,通过云端浏览器访问网站,并在用户关闭应用后继续于后台运行。Muse部署在独立虚拟机中,每台虚拟机配有专属浏览器并保存用户数据。Meta曾提出为每位用户配置一台虚拟机,包含2个vCPU、8GB内存和100GB固态硬盘;这一方
QwenGyre是一套面向在线强化学习的框架,适用于执行时间长达数小时、包含数百次模型与环境交互,并在每次rollout中生成数十万令牌的智能体任务。该框架可在rollout与训练之间动态调配GPU,重建分支轨迹,评估阶段性进展,并去除冗余路径。根据文中评测,QwenGyre将NL2RepoBench成绩从52.5%提升至58.5%,相较Colocate最高加速1.85倍,相较Async最高加速1
该研究分析了扩散 Transformer(DiT)中的残差连接。现有 DiT 通常将前面各层的信息整合到统一的残差流中。研究人员提出一种自适应连接架构,将局部残差连接与通往重要早期表示的长距离路径结合起来,使每个 Transformer 模块能够在图像去噪过程中选择性地提取空间和语义特征。实验显示,该方法最多可减少至原先 1.73 分之一的训练迭代次数,并将强大的 REPA-XL/2 模型在无引导
一项研究比较了使用预训练视觉编码器的多模态大语言模型,与直接从原始像素学习视觉表征的无编码器模型的缩放特性。无编码器模型在较小规模下表现较差,但研究预测其可能在约 10^22 FLOPs 时追上传统架构。在多模态目标上,最优计算分配会转向更大的模型,而文本目标的缩放趋势基本不变。随着训练计算量增加,语言模型逐渐承担视觉编码器的功能:视觉 token 之间的双向交互变得更有益,视觉处理转向更早的层,
ColNanoVDR 是一个将视觉语言模型大型查询编码器蒸馏为小型模型的框架,面向视觉文档检索。不同于需要编码并缓存所有训练页面的传统方法,它仅使用教师模型的查询嵌入训练学生模型。其 OTW 目标通过带熵正则的最优传输和可学习的令牌权重,对齐教师与学生的查询令牌,且不要求两者采用对应的分词方式。基于五个先进教师模型蒸馏出的 1.49 亿参数纯文本学生模型,在 ViDoRe v1 至 v3 上保留了
该研究提出 Imprint Reader,利用 Semantic Mount-and-Read Tuning,以自然语言描述语言模型冻结的权重更新。研究通过无变化和随机扰动对照,减少缺乏依据的解读。在未见过的更新上,系统由评审判定的 Pass@100 在知识任务上为 2%,在行为任务上为 16%,表明用语言读取权重更新具有可行性,但可靠性仍然有限。Reader 还可作为可微分代理指标,用于引导模型
中国互联网络信息中心发布的报告称,2026年上半年我国生成式人工智能用户规模超过7亿,普及率突破50%。智能问答仍是最主要的使用方式,图片和视频处理、文本处理等场景也快速增长。报告还称,我国智能算力规模达到2185EFLOPS,首个全国产10万卡人工智能超集群已投入运行。中国开源大模型、工业和农业应用、具身智能及人形机器人产业均取得进展。2026年上半年,我国人工智能相关投融资事件达1255起,披