AI 新闻中心

AI 新闻中心 过去30天分析了 2422 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

智谱究竟“拿走”了什么?

9月18日,开发者发现,在“代码库索引”默认开启的情况下,智谱ZCode会将用户的完整工作区和Git历史上传至云端。智谱随后致歉,称数据用于生成Repo Wiki,并会在页面生成后立即删除。但这一解释并未消除对日志、缓存、备份、内部访问,以及数据是否被用于模型训练或产品优化的担忧。目前公开证据只能确认数据被上传,尚无证据证明这些代码已经用于模型训练。事件凸显了具备广泛文件权限的编程代理所带来的风险

研究人员使用 GPT-6 Astra 破解1918年德国一战无线电讯息

据报道,一名研究人员使用 GPT-6 Astra 破解了一段在第一次世界大战期间、于1918年发送的德国无线电讯息。该讯息被列入德国科学门户网站 ScienceBlogs.de 整理的50个著名未解密码之中。报道只介绍了模型的一次具体应用,没有提供相关技术方法的细节,也未说明破解结果是否经过独立验证。

TeleAntiFraud 2.0:可更新、基于画像的语音电信诈骗检测基准

电信诈骗话术变化迅速,而且常常伪装成普通客服通话。TeleAntiFraud 2.0提出按月冻结的评测集,在加入新诈骗模式的同时不覆盖既有测试集,并要求模型区分诈骗通话与合法、但处于相近领域的通话。每个评测集包含900段中文通话,其中600段为诈骗,300段为非诈骗。受控文本实验显示,分类器面对无关或普通负例时可达到完美的Macro-F1,但面对相近领域的负例时,得分降至0.65至0.68。完整音

苹果Siri集体诉讼和解程序启动:美国符合条件的iPhone用户最高可获95美元

苹果在美国涉及Siri的集体诉讼和解网站现已上线。符合条件的部分iPhone 15 Pro系列和iPhone 16系列用户最高可获得95美元赔偿。案件源于苹果此前宣称,Apple Intelligence将让Siri理解个人信息、识别屏幕内容,并在应用内执行更深入的操作。苹果推迟个性化Siri后,原告指控公司存在误导性宣传。苹果否认相关指控,但同意支付2.5亿美元和解。索赔截止日期为2026年12

Paint-Anything 实现图像生成与编辑中的任意颜色精准控制

Paint-Anything 提出了一种基于 24 位十六进制颜色值的统一接口,使用户能够在图像生成和编辑时指定对象的目标颜色。该方法结合真实图像中的对象级颜色监督,以及像素与指定颜色完全一致的纯色锚点,以减少阴影造成的标注误差。研究团队还构建了 Paint-500K 数据集和 Any Color Benchmark,用于评估对象级颜色还原度。在 FLUX.2-4B 上,与基础模型相比,该方法在生

快手将直播字幕延迟降至500毫秒以内

快手电商直播技术团队推出了自研的实时字幕工程架构,将主播发声到字幕可展示的端到端延迟从过去的1.5至2秒降至400至500毫秒,并将字符错误率从7.81%降至3.51%。系统由语音识别、PTS音画对齐、海量分发和端侧渲染四部分组成,可支撑千万级并发。其核心是流式修订机制,通过sentenceId、revision和播放器时间线管理持续更新的识别结果,确保修订后的字幕在正确画面时间点刷新,同时避免闪

DeformSmith:物理验证环境引导的机器人操作可变形资产分层生成

DeformSmith 是一个可根据文本或单张图像,自动生成交互式且具有物理可信度的可变形物体模型的框架。其基于智能体的分层构建流程结合共享物理验证环境,逐步生成和测试几何结构、物理模型与材料行为。机器人交互产生的操作反馈用于进一步优化模型,并生成可重放的交互数据。报告结果显示,DeformSmith 在视觉质量和物理合理性方面优于 PhysGen3D、PhysGM 和 PhysX-Omni 等基

CodeMidas:直接利用源代码扩展智能体编码强化学习环境

CodeMidas 是一个自动化管线,旨在通过直接从现有源代码中生成任务,来扩展编码智能体(Agent)的强化学习(RL)环境。与依赖 Issue 或 Commit 等开发遗留产物的传统方法不同,CodeMidas 利用智能体分析代码库、制定行为规范,并验证基于执行的测试。该管线在 23 种编程语言中生成了 5,545 个训练任务。通过 GRPO 算法在此数据集上训练 MiMo-V2.5 模型后,

消息称特斯拉机器人团队在长三角审厂,多家企业已获订单

据中国媒体报道,特斯拉机器人团队上周开始对拓普集团、三花智控、均胜电子等供应商进行审厂。这些企业主要供应人形机器人 Optimus 所需的关节模组、执行器和精密结构件等核心机电部件。产业链人士称,相关企业此前已经获得不同程度的 Optimus 订单,本轮审厂将评估生产线质量和合规情况。审厂范围据称不仅包括宁波,还覆盖杭州和上海。通过审核后,相关企业可能很快开始生产。此前有报道称,特斯拉计划今年生产

深蓝 S07 AI 激光版将于 9 月 28 日亮相

深蓝汽车宣布,全新 S07 AI 激光版将于 9 月 28 日发布。新车搭载 AI 激光感知方案和升级版电驱系统。此前推出的华为乾崑 ADS 4 Pro 增程版采用 1 颗激光雷达、3 颗 4D 毫米波雷达、11 个高清摄像头和 12 个超声波雷达组成的传感器融合系统,支持城区、高速公路和园区领航辅助。车辆 CLTC 纯电续航最高可达 300 公里,并支持 3C 快充。其他配置包括高通骁龙 829

Siri AI 和解网站上线:苹果将向部分 iPhone 用户付款

苹果已上线一项 2.5 亿美元和解协议的申请网站。该协议源于美国一宗集体诉讼,涉及个性化 Siri AI 功能延期发布。符合条件、在美国购买指定 iPhone 机型的用户可在 9 月 21 日至 12 月 21 日期间提交申请。每台设备预计可获赔 25 美元,但最终金额可能根据有效申请数量增加至最高 95 美元。苹果否认相关指控,并表示同意和解是为了避免审判带来的成本和风险。

当 AI 训练 AI 评审员:科学判断崩溃及其缓解方案

一项研究考察了使用模型生成的同行评审来递归训练后续评审模型,如何削弱科学判断的多样性。研究人员以 Llama 3.1 8B 为基础,先用 2018 至 2023 年的 ICLR 官方评审进行微调,再使用混合比例不同的官方评审和模型生成评审训练后续模型。加入合成评审后,评分分布趋于收窄,单篇论文和整个语料库的语义多样性均有所下降。作者将这一现象称为“科学判断崩溃”。研究团队还提出开源系统 Trust

MintAct:面向数字环境的统一视觉智能体

研究人员推出 MintAct,这是一系列参数规模为 20 亿、40 亿和 80 亿的视觉语言模型。该模型统一支持用户界面定位、移动端、桌面端和网页环境中的多步骤导航,以及视觉工具使用。研究团队构建了可扩展的环境与强化学习基础设施,用于跨领域轨迹数据收集和在线训练。实验结果显示,MintAct 在这些能力上的表现可与各领域专用模型相当,并在 OSWorld-Verified 上取得 48.9 分。研

OmniVBench:面向参考生成视频的大规模基准与数据集

OmniVBench是用于评估多种参考控制视频生成模型的基准,涵盖内容、动作、风格、结构、叙事和多参考等7类任务、18项细分任务。其包含12,172个针对具体案例的检查项,用于评估参考因素是否被准确保留、解耦、绑定到正确目标,并按照指令实现。配套的Omni-R2V数据集包含34万个经过处理的训练样本,主要来自专业视频素材。对开源和闭源模型的评估显示,不同任务类别和评估维度之间仍存在明显性能差距。