AI 新闻中心

AI 新闻中心 过去一年分析了 1513 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

GGSS:用于生成式视觉语言模型推理时去偏的测地线门控球面引导

生成式视觉语言模型即使面对仅在感知种族或性别等受控属性上存在差异的图像,也可能生成带有人口统计偏见的内容。GGSS是一种推理时去偏方法,它在单位超球面上发现反事实偏见子空间,沿测地线弧线调整视觉标记,并自适应地重点修正携带更强人口统计信号的标记。在四个生成式视觉语言模型和十种对比方法上的评估中,GGSS在全部四个模型上取得了最低的平均偏见;其中三个模型骨干上的改进具有统计显著性。同时,MMStar

新石器回应郑州无人配送车遭人攀爬事件

新石器表示,郑州一辆在路口等红灯的无人配送车遭三名疑似未成年人爬上车顶,车辆起步后仍未离开。车载传感器记录到了相关行为,但由于动作迅速且属于非标准异常行为、局部存在遮挡,且人员重量未达到车辆异常载重告警阈值,系统未将其判定为需要制动或靠边停车的风险。公司已向交警部门报告,并将改进非常规目标识别、强化远程安全员处置能力,以及增加重点运营线路的现场巡检。

豆包辟谣“建议煮拖鞋”:网传内容系诱导模型摆拍

豆包否认近期在多个平台流传的“建议把暴晒变形的拖鞋放进开水里煮”的说法。官方表示,该内容源自事先策划的搞笑视频。最早发布相关内容的博主承认,曾故意诱导豆包按照预设产生错误回答,再将对话摆拍成真实回复传播。豆包称,针对拖鞋暴晒变形问题,实际会明确提醒用户不要使用开水烫、蒸煮等方法。事件显示,通过操纵提示获取错误输出,再以摆拍形式传播,可能使公众误以为这些内容反映了AI产品的真实缺陷。

索尼牵头35家音乐出版商起诉Anthropic,索赔金额或达数十亿美元

索尼音乐出版、华纳查佩尔音乐及另外33家音乐出版商已在美国加州北区联邦地区法院起诉Anthropic及其联合创始人达里奥·阿莫代伊和本杰明·曼。原告指控Anthropic未经授权,通过下载、网络爬虫等方式获取数万份受版权保护的歌词和乐谱,并将其用于训练Claude。出版商要求法院禁止Anthropic继续使用相关作品;若所有涉案作品均按法律规定的最高赔偿额计算,索赔规模可能达到数十亿美元。Anth

英国监管机构警告:医疗 AI 转录工具频繁出错,威胁患者安全

英国患者权益机构 Healthwatch England 警告,用于录音并总结医生与患者问诊内容的 AI 工具可能危及患者安全。已披露的问题包括误识别药物和疾病名称、生成不存在的诊断,以及遗漏重要治疗指示。一名患者曾因 AI 错误记录其 MRI 显示“脱髓鞘”而受到严重惊吓;其他案例中,也有患者自行发现药物名称记录错误或关键信息缺失。若错误未被及时发现,可能持续留在病历中并影响后续治疗。目前英格兰

英格兰银行行长贝利警告:先进人工智能可能威胁全球金融稳定

英格兰银行行长兼金融稳定委员会主席安德鲁·贝利警告二十国集团财长和央行行长,先进人工智能可能加剧全球金融稳定风险。他在信中指出,前沿AI模型的自主能力和问题解决能力不断增强,也可能被用于发动网络攻击,使破坏迅速跨越不同司法管辖区。贝利表示,许多国家尚未建立管理先进AI模型开发、发布和部署的机制。此外,资产估值偏高、市场集中,以及投资者对AI前景的乐观情绪,也可能放大未来金融市场冲击。他呼吁国际社会

Claude 账户遭信息窃取恶意软件入侵,Anthropic 删除支付方式

Anthropic 警告部分 Claude 用户,信息窃取恶意软件可能窃取了浏览器中的有效登录会话,使攻击者能够访问账户和使用数据。该公司仍在调查,但表示没有证据表明恶意软件与 Claude 有关,或是通过 Claude 安装。Anthropic 正在撤销受影响的会话、删除已保存的支付方式,并退还认定为未经授权的费用。已提及的恶意软件包括 Windows 上的 Vidar、LummaC2、Stea

StepGuard:通过可扩展监督学习逐步防护AI代理

StepGuard是一种面向大语言模型代理的防护模型,既能审计已完成的代理执行轨迹,也能在工具操作执行前检查潜在风险。研究团队使用StepGen自动生成安全和不安全的轨迹:两者拥有相同上下文,但在风险步骤采取不同操作。为减少过度防御和防御不足,研究人员还提出了Balance-GRPO,根据观测到的准确率动态平衡安全与不安全操作的学习。实验显示,StepGuard在开放权重防护模型中取得最高平均准确

LMSM:受 Linux Security Modules 启发的 LLM 安全框架

LMSM 将 Linux Security Modules 的设计应用于大语言模型服务。该框架将经过校准的安全证据、版本化策略评估,以及缓冲输出的发布授权彼此分离。原型系统可在 Hugging Face Transformers 和 vLLM 中支持稀疏自编码器、转换器和密集探针。在 Qwen3-4B 上,LMSM-Checkpoint 将 HarmBench 攻击成功率从 39.20% 降至 3

丹麦整治 AI 作弊:增加口头答辩并监控考试电脑屏幕

丹麦政府针对学生使用生成式 AI 写作业和考试作弊案例增加,推出紧急应对方案。约 9000 名学生在完成专业书面作业后,还将接受口头答辩。政府同时建议在笔试期间监控学生电脑屏幕,通过网络过滤限制访问未经允许的内容,并鼓励学生在受控环境中完成书面作业。政策重点不是将 AI 排除在校园之外,而是规范其使用。澳大利亚和韩国首尔近期也在改革考试与评估方式,以维护学位和考试制度的公信力。

Glassdoor报告:美国员工对AI的正面评价降至43%

Glassdoor最新报告显示,美国员工对企业引入AI的态度明显转差。报告称,正面评论比例已从2019年的81%降至2026年年中的43%,负面评论则升至53%。软件工程师,以及保险理赔、写作、会计和客服从业者的不满最为强烈。主要原因包括担心失业、被迫使用尚不成熟的工具、职场监控、AI分散核心工作精力,以及不切实际的生产力预期。报告指出,管理层的乐观态度与一线员工的实际体验之间存在日益扩大的鸿沟。