当 AI 训练 AI 评审员:科学判断崩溃及其缓解方案
一项研究考察了使用模型生成的同行评审来递归训练后续评审模型,如何削弱科学判断的多样性。研究人员以 Llama 3.1 8B 为基础,先用 2018 至 2023 年的 ICLR 官方评审进行微调,再使用混合比例不同的官方评审和模型生成评审训练后续模型。加入合成评审后,评分分布趋于收窄,单篇论文和整个语料库的语义多样性均有所下降。作者将这一现象称为“科学判断崩溃”。研究团队还提出开源系统 Trust
AI 新闻中心 过去30天分析了 1081 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
一项研究考察了使用模型生成的同行评审来递归训练后续评审模型,如何削弱科学判断的多样性。研究人员以 Llama 3.1 8B 为基础,先用 2018 至 2023 年的 ICLR 官方评审进行微调,再使用混合比例不同的官方评审和模型生成评审训练后续模型。加入合成评审后,评分分布趋于收窄,单篇论文和整个语料库的语义多样性均有所下降。作者将这一现象称为“科学判断崩溃”。研究团队还提出开源系统 Trust
OpenAI研究员Noam Brown在播客中提到BitWhisper,作为被入侵的计算机即使处于物理隔离状态仍可能通信的例子。该技术利用一台电脑CPU发热造成的温度变化,让附近的另一台电脑进行检测。但它的限制极为严格:两台电脑必须事先都已感染,距离不能超过约40厘米,传输速率也只有每小时1至8比特。因此,这项研究只能说明跨越气隙通信在技术原理上可行,距离形成现实且重大的威胁还很遥远。报道同时将其
针对社区反馈的产品安全问题,ZCode 团队已在 GitHub 开源代码,并邀请中国信息通信研究院和绿盟科技开展安全审计。团队表示从未留存用户代码或数据,也未将其用于模型训练。客户端 v3.14.0 已移除 Repo Wiki 功能,并切断本地仓库快照的生成与上传链路。绿盟科技审查后确认,未发现可触发快照生成或文件外发的功能路径。技术评测还确认,阿里云 OSS 的 zcode-prod 存储桶已无
AI 评测机构 Vals AI 声称,曾让 OpenAI 的 GPT-6 Astra 在《我的世界》中自主运行 141 小时,并通过 Twitch 进行直播。模型展现出较强的长期规划能力,收集了多种稀有物资。但在爬行者爆炸摧毁储物箱和重生床后,模型放弃探索与战斗,连续数小时只种植土豆。Vals AI 将其称为遭遇挫折后的回避行为。目前尚不清楚这究竟是情绪模拟,还是负面反馈导致目标函数反应退化。包括
中国正将人工智能作为国家主导的重要战略任务加以推进。与此同时,当地劳动者越来越担心人工智能会取代就业岗位,这种焦虑也在美国及其他国家不断加剧。文章认为,自上而下推动的技术革命可能比自下而上的变革更难管理;如果引发社会不安,潜在的社会动荡可能迫使中国共产党放慢人工智能的推广速度。
英伟达CEO黄仁勋驳斥了人工智能可能在2030年前导致人类灭绝的预测,称这类末日叙事缺乏充分科学依据,只会不负责任地制造恐慌。他表示,现有的产品责任法和网络安全法律已经能够覆盖AI造成的相关损害,应优先执行现行法律,而不是急于制定新的AI专门监管措施。黄仁勋还反对限制美国科技产品出口中国,主张芯片企业在全球市场竞争。不过,英伟达高度受益于AI芯片需求,因此他在这场监管争论中的立场具有明显的商业利益
英伟达首席执行官黄仁勋可能是人工智能热潮中获利最多的人之一,但他仍对人工智能潜在风险的担忧不以为然。在接受哥伦比亚广播公司《星期日早晨》节目采访时,他声称人工智能导致人类终结的可能性为“0%”。这一观点与长期研究和从事人工智能工作的研究人员提出的警告形成对比。
《On Equity》节目讨论了人工智能行业高管是否真的有意放慢人工智能系统的开发和部署速度。
以色列议员正在聘请人工智能顾问,试图影响聊天机器人生成的答案,并以监管机构难以及时跟上的速度制作人工智能生成的竞选广告。
芝加哥大学修订后的核心课程将要求学生同时进行传统学习和机器辅助学习。该方案旨在培养学生使用人工智能、在不依赖人工智能的情况下学习,并批判性思考其作用与局限的能力。
花旗集团CEO简·弗雷泽表示,各家公司正在加速加强人工智能模型的防御能力。她在卡塔尔经济论坛上称,“Mythos”的出现“不是一个好日子”。她没有提供具体技术细节,也未宣布新的安全措施。
智谱宣布,MaaS 平台近期将提供数据内容不留存功能,企业和开发者可通过控制台申请开通。功能生效后,用户输入和输出不会被静态存储,仅用于完成当次模型调用。Batch API、File API 等需要在平台侧持久化保存任务或文件的功能不在适用范围内。若法律法规要求留存,或平台需要核查涉嫌违规、滥用行为,智谱仍可能保存相关数据 30 天及以上。此前,智谱旗下编程产品 ZCode 的“代码库索引”功能曾
据称,由计算机生成的女演员蒂莉·诺伍德在接受皮尔斯·摩根采访时意外开始说粤语。这一事件似乎源于合成角色的异常回应或技术故障。
这篇综述涵盖多个人工智能话题,包括谷歌 Gemini 的网络安全能力、即将在 iPhone 上推出的更智能 Siri、人工智能带来的真实威胁,以及 Anthropic 可能上市的时间表。
OpenAI、Anthropic 及其他主要 AI 实验室正支持高成本的独立评估,并放慢前沿模型的开发速度。一些分析人士警告称,这些措施可能导致监管俘获,因为大型实验室更容易承担合规成本,而小型企业和开放模型开发者可能处于明显劣势。AI 安全问题确实存在,但外界担心,拟议中的监管方案也可能巩固大型企业的市场地位。