AI 新闻中心

AI 新闻中心 过去24小时分析了 150 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

苹果新任CEO特努斯9月1日上任,AI与新版Siri成为首要任务

据报道,苹果硬件工程负责人约翰·特努斯将于9月1日接任CEO,现任CEO蒂姆·库克将转任董事会执行主席。AI预计将成为特努斯任期内的核心任务。特努斯拥有25年硬件产品开发经验,曾参与Mac、iPad、AirPods和iPhone等产品。上任后,他将面对苹果在AI领域相对落后、服务业务增长放缓以及供应链成本上升等挑战。苹果据称计划在9月推出新版AI Siri,并继续开发个性化智能家居设备、具备环境感

J-Zero:从零数据出发的 Challenger、Solver、Judge 统一协同进化

J-Zero 是一种无需额外训练数据、用于推动语言模型自我改进的框架。Challenger 生成难度不断增加的任务,Solver 学习给出质量更高的回答;与此同时,Judge 根据回答的生成方式,利用顺序预先确定的偏好对进行自适应。作者报告称,与基线方法相比,J-Zero 在可验证领域平均提升 4.2 分,在不可验证领域提升 8.0 分。J-Zero 至少持续迭代改进了十轮,而基线方法在两轮后出现

Claude 账户遭信息窃取恶意软件入侵,Anthropic 删除支付方式

Anthropic 警告部分 Claude 用户,信息窃取恶意软件可能窃取了浏览器中的有效登录会话,使攻击者能够访问账户和使用数据。该公司仍在调查,但表示没有证据表明恶意软件与 Claude 有关,或是通过 Claude 安装。Anthropic 正在撤销受影响的会话、删除已保存的支付方式,并退还认定为未经授权的费用。已提及的恶意软件包括 Windows 上的 Vidar、LummaC2、Stea

需求激增,腾讯紧急扩容混元 Hy4preview 推理集群

腾讯表示,混元 Hy4preview 于8月28日接入 WorkBuddy 后,凭借升级的 Agent 能力引发较高需求。上线首日出现任务排队,公司随后紧急扩容 Hy4preview 推理集群,并将继续动态调配资源。腾讯同时提醒,在调用集中于高峰时段时,仍可能再次出现短时等待。作为过渡措施,Hy3 等既有模型的 WorkBuddy 限时免费权益延长至2026年9月30日。公告未披露具体使用量,也未

StepGuard:通过可扩展监督学习逐步防护AI代理

StepGuard是一种面向大语言模型代理的防护模型,既能审计已完成的代理执行轨迹,也能在工具操作执行前检查潜在风险。研究团队使用StepGen自动生成安全和不安全的轨迹:两者拥有相同上下文,但在风险步骤采取不同操作。为减少过度防御和防御不足,研究人员还提出了Balance-GRPO,根据观测到的准确率动态平衡安全与不安全操作的学习。实验显示,StepGuard在开放权重防护模型中取得最高平均准确

重新审视长时序流式三维重建中的局部上下文

ABot-Recon 是一种从超长视频中进行三维场景重建的流式模型。它不维护庞大的长期记忆,而只缓存前 11 帧的键值特征。模型在当前相机坐标系中预测点图,并估计相邻帧之间的相对位姿,再通过序列组合恢复全局相机位姿和场景几何。轻量级时间细化器用于减少旋转漂移,考虑组合过程的位姿损失则用于训练多步位姿组合。在 Oxford Spires 基准测试中,ABot-Recon 的绝对轨迹误差为 4.35

荣耀预告 MagicOS 11:AI 防窥功能覆盖多款设备

荣耀发布了 MagicOS 11 的第四弹预告。据介绍,AI 防窥功能可智能识别机主身份,当他人查看屏幕上的消息或表情包等内容时发出警告。用户可通过“设置 > 隐私与安全 > 窥屏防护”开启该功能。据荣耀介绍,内测招募覆盖 Magic8、V6、WIN、GT Pro、600 系列和 MagicPad 3 Pro 等 17 款手机和平板。荣耀还宣传了新的系统架构,但尚未提供经过独立验证的技术细节。

LMSM:受 Linux Security Modules 启发的 LLM 安全框架

LMSM 将 Linux Security Modules 的设计应用于大语言模型服务。该框架将经过校准的安全证据、版本化策略评估,以及缓冲输出的发布授权彼此分离。原型系统可在 Hugging Face Transformers 和 vLLM 中支持稀疏自编码器、转换器和密集探针。在 Qwen3-4B 上,LMSM-Checkpoint 将 HarmBench 攻击成功率从 39.20% 降至 3

超越数据扩展:面向视觉语言动作模型的表征中心持续预训练

该研究提出了 VLAct,一种面向视觉语言动作(VLA)系统的视觉语言模型骨干。VLAct 使用来自多种机器人形态的异构机器人数据进行持续预训练,在保留视觉语言模型通用知识的同时,促进跨机器人形态的共享动作语义。在固定机器人数据量和微调预算下,VLAct 在仿真、真实环境任务以及向未见机器人形态迁移时均提升了性能。它在 LIBERO-Plus 和 RoboTwin 2.0 上分别取得 82.6%

RCCA 改进代码生成强化学习中的信用分配

该研究提出了 Rubric-to-Code Credit Assignment(RCCA),一种面向强化学习的框架,用于让模型根据自然语言需求生成可用的 HTML、CSS 和 JavaScript 应用。RCCA 不再将单一的序列级奖励平均应用于所有 token,而是把功能反馈对应到相关代码区域和生成 token。其分层奖励机制区分格式、源代码、运行时和功能错误。Ling-RCCA-Flash 在

利用视频生成模型学习几何信息

GeoNeXt重新利用预训练视频生成模型,从单张图像中联合估计深度和表面法线。该方法将几何估计定义为下一帧预测任务,从而利用视频模型中结构化的视觉先验,并以远少于以往方法的标注数据学习图像与几何信息之间的关系。在多个数据集上的实验表明,GeoNeXt在零样本单目深度和表面法线估计方面优于以往的任务专用型和统一型生成方法。它的性能还接近使用超过百倍数据训练的判别式先进方法,并在多个基准测试中超过这些

小马智行与 FutureLink 计划首批在韩国商业投放 200 辆 Robotaxi

韩国自动驾驶移动出行企业 FutureLink 与小马智行签署战略合作协议,计划在韩国市场提供基于小马智行第七代 Robotaxi 的商业出行服务。两家公司去年已在首尔江南自动驾驶示范区开展技术验证,累计行驶约 8 万公里且未发生事故。首批计划投放 200 辆车,由北汽负责制造,预计在 2028 年前取得韩国政府相关认证。FutureLink 将负责市场准入和车队运营,小马智行则提供自动驾驶技术支

ING:美国主导的人工智能热潮抵消能源危机对全球增长的冲击

ING表示,美国主导的人工智能热潮正在帮助抵消能源危机对全球经济增长造成的压力。该机构估计,与人工智能相关的活动约占近期美国经济增长的三分之一。尽管贸易、地缘政治和债券市场的紧张局势再次升温,经济增长仍保持韧性。不过,人工智能热潮对经济增长的贡献过大,也引发了外界对经济日益依赖人工智能投资及相关活动的担忧。