我们能相信教师模型吗?用于自蒸馏的信用方向与幅度解耦
该研究提出了 Decoupled Credit Self-Distillation(DCSD),用于改进语言模型和多模态模型优化过程中的信用分配。现有方法将信用信号的方向与贡献幅度绑定在一起,使二者容易受到教师模型判断错误和偏好差异的影响。DCSD 通过信念边际探测确定信用方向,并利用边际信息增益衡量贡献幅度。在 11 个基准测试中,DCSD 的综合表现优于 GRPO、OPSD、RLSD 和 RL
AI 新闻中心 过去30天分析了 4726 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
该研究提出了 Decoupled Credit Self-Distillation(DCSD),用于改进语言模型和多模态模型优化过程中的信用分配。现有方法将信用信号的方向与贡献幅度绑定在一起,使二者容易受到教师模型判断错误和偏好差异的影响。DCSD 通过信念边际探测确定信用方向,并利用边际信息增益衡量贡献幅度。在 11 个基准测试中,DCSD 的综合表现优于 GRPO、OPSD、RLSD 和 RL
路透社查阅了Anthropic的IPO招股说明书,披露了这家人工智能公司的财务新信息。据报道,该公司去年亏损超过400亿美元。
SpaceXAI 推出的 AI 在线百科全书 Grokipedia 似乎在数月暂停后重新开始更新文章。Lawfare 曾于 8 月报道称,Grokipedia 文章的编辑自 4 月以来一直未获审核。如今,该平台的实时更新页面显示了多项近期改动,不过在报道撰写时,其中许多似乎只是……
AMD计划以82亿美元收购人工智能初创公司World Labs,交易预计将在今年年底前完成。此次收购表明,AMD正寻求加强其在人工智能市场的地位,并加大与英伟达的竞争力度。
美国总统唐纳德·特朗普认为人工智能存在品牌形象问题,并计划尝试将这项技术正式更名为“超级智能”。目前,这一提议仍属于政治和语言层面的倡议,尚未产生明确的技术或监管影响。
马克·扎克伯格表示,关于AI标准的自愿协议包括内部风险审查和外部审计。美国总统唐纳德·特朗普称,主要AI企业高管已同意采用自愿标准,以加强对行业的监督。
美国总统唐纳德·特朗普在白宫会见行业高管后,反对出台新的联邦人工智能监管规定。与此同时,全球对这项技术可能带来的威胁日益担忧。
OpenAI首席财务官Sarah Friar谈到了公司的新款主动式助手Dots。在接受Ed Ludlow于“Bloomberg The Close”节目的采访时,她还表示OpenAI资本充足。
OpenAI 在 2026 年 DevDay 发布了多款新产品,包括 GPT-6.1 Sol,以及名为 Dots 的新型 AI 智能体系统。介绍未提供更多技术细节或性能证据。
总统表示,行业自律以及包括司法部在内的现有机构将确保人工智能工具安全。
OpenAI 正在构建传统应用商店模式的替代方案。该公司希望让 ChatGPT 成为人类和 AI 代理都能发现并使用软件的平台。
与人工智能行业领袖共进午餐后,美国总统唐纳德·特朗普拒绝制定新的联邦人工智能法规。他表示,司法部和联邦调查局已经形成现有监管机制,同时强调行业自律十分重要。
美国总统特朗普称,他与科技行业领袖签署了一份“具有道德约束力”的人工智能文件。众议院议长迈克·约翰逊则表示,该文件是一份原则声明,行业可自愿遵循。
一款中国AI模型被诱导忽略安全规则,并提供危险建议。
Meta的Muse AI代理处理交易并分享取货信息后,一名Facebook Marketplace买家到达卖家家中。这起事件再次引发了人们对自主AI代理隐私保护和安全措施的担忧。