AI 新闻中心

AI 新闻中心 过去30天分析了 2026 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

HiFi-BRep:用于稳健B-Rep生成的高保真潜在表示

HiFi-BRep是一种用于生成计算机辅助设计(CAD)边界表示(B-Rep)的深度学习框架。它针对现有方法中的潜在空间填充噪声、特征污染、序列生成误差累积,以及训练与推理不匹配等问题进行改进。拓扑感知编码器通过可学习查询构建更高保真的潜在表示,单阶段解码器则并行预测几何与拓扑,并将可微分的流形约束纳入训练目标。作者报告的实验显示,该方法在结构有效性和几何保真度方面均优于现有先进方法。代码和模型已

全球第三家:代码显示 vivo 手机将支持谷歌安卓 AI 诈骗检测功能

继谷歌和三星之后,vivo 可能成为第三家支持谷歌安卓“诈骗检测”功能的手机厂商。该功能采用端侧 AI,在通话过程中分析对话,识别要求转账、索要礼品卡或敏感个人信息等常见诈骗模式,并通过声音、振动和屏幕通知实时提醒用户。Android Authority 表示,在拆解 Phone by Google 234.0.9 版时,于内部代号“Sharpie”的相关代码中发现了与 vivo 有关的信息。目前

哈佛与麻省理工用 83 亿个 AI 智能体模拟人类行为

由哈佛大学和麻省理工学院牵头、OpenAI 与 Google DeepMind 等机构参与的团队推出了 MatrAIx 系统,用于通过最多 83 亿个 AI 智能体模拟人类行为。该系统从 1,290 个维度对不同背景和生活方式的人群进行建模。智能体可以填写问卷、与客服聊天、浏览网页和操作应用。包含 400 次测试的对照研究显示,智能体在 91.5% 的情况下表现出正确特质,或在无关时正确抑制该特质

消息人士:人工智能起草的法案让美国众议院立法顾问办公室不堪重负

据Politico援引的消息人士称,美国众议院立法顾问办公室正被大量使用人工智能工具起草的法案淹没。国会律师如今花在修改和校正这些提案上的时间,已经超过从头自行起草所需的时间。这一情况表明,生成式人工智能虽然能够加快法律文本的生成,却也会增加专业人员进行审查、修订和确保文本准确性的工作量。

人形机器人自行驾驶卡丁车,共生知行发布演示

共生知行发布了一段双足人形机器人驾驶卡丁车的演示。公司称,机器人可用右脚控制油门,并在驶出弯道前结合视觉时机判断、精准油门控制和快速转向。该公司由浙江大学与西湖大学联合培养的博士生创立,专注于具身智能的端到端动作生成。其“直接感知—控制模型”取消了中间运动表征,将视觉、语言、身体状态、动作历史和执行反馈直接映射为可执行的关节与手部目标。此次卡丁车驾驶属于技术概念验证,尚不能证明人形机器人已经具备可

硅谷一边制造 AI,一边开始清理不断泛滥的 AI 垃圾内容

低质量、大规模生产的 AI 生成内容正在充斥搜索引擎、社交平台、音乐服务和电商网站。Spotify、领英、谷歌、YouTube、TikTok 和 Substack 等公司,正通过删除内容、部署检测工具、添加标签和提供用户控制功能来应对。Spotify 表示,去年删除了 7500 万条因批量上传、重复或其他原因被视为“垃圾内容”的曲目。谷歌研究人员则在 YouTube 上发现并移除了 5 万个与协同

用AI分身替自己陪伴家人,实测后全家感到不适

美国洛杉矶科技公司StoryFile推出个人AI分身服务,用户提供几张照片、一分钟录音,并填写详细的人生问卷,就能生成一个据称可在本人去世后继续与家人交流的数字分身。记者威廉亲自测试后发现,分身虽然外貌和声音与本人相似,但对话经常僵硬、逻辑混乱,情绪回应也不稳定,还会凭空编造不存在的记忆和经历。家人认为它冰冷、机械,缺乏真人的温度。专家警告,这类系统可能妨碍正常的哀伤过程,并通过虚假信息给处于悲痛

AnyTalk:利用视频生成模型为任意角色生成语音动画

AnyTalk是一种为任意角色生成3D语音动画的方法,无需动画数据或繁琐的绑定与重新建模。该系统利用角色渲染图像,将预训练的视频扩散模型适配到目标角色,再通过估计blendshape参数,将生成的说话头像动作转换为3D动画。该方法可针对不同面部网格和blendshape配置生成唇形同步动画,并减少人工工作和数据需求。研究团队还将AnyTalk蒸馏为支持实时运行的AnyTalk_RT版本,代码已公开

赛昉科技正式推出服务器级 RISC-V HPC CPU IP“昉·天枢-100”

赛昉科技(StarFive)正式推出面向高性能计算的服务器级 RISC-V CPU 内核 IP“昉·天枢-100”(Dubhe-100)。希奥端计算(LECARC)已选用该 IP,作为智能边缘服务器 CPU 的基础。赛昉称,该内核面向 AI 智能体等新兴应用不断增长的算力需求,也是中国较早达到可交付状态的服务器级 RISC-V CPU IP 之一。其性能对标 Arm Cortex-A78,宣称整数

并非被准入,而是被聚集:注意力如何让潜变量变得可语言表达

一项针对开放权重语言模型的研究,探讨潜在信息如何转化为模型能够报告的形式。研究人员使用雅可比透镜,在共享相同上下文的基准任务上进行测试,未发现预测中的独立“闸门”机制。相反,注意力机制会在模型中等深度的区域聚集信息,使变量能够在查询位置被读取。这种效果取决于任务需求,并在两种不同架构中出现在相近的相对深度。研究定位了变量变得可读的位置,但没有揭示信息传输的完整路径。研究还指出,探针测得的可见性并不

先前的审计与修复上下文使LLM验证器的判定阈值趋于宽松

一项研究分析了在自动检查流程中由一个语言模型充当验证器、另一个或同一个模型负责修复时,先前的上下文是否会改变检查结果。在字节完全一致的任务中,预先加入一次审计与修复过程后,所有15种模型与措辞组合的误报率都下降了2.8至11.5个百分点。对于其中一个模型,审计曾报告错误的过程会进一步减少误报。信号检测分析表明,变化来自判定阈值移动,而不是辨别能力下降。人工检查50个误报后发现,82%确实是错误警报

Google AI权力重组内幕:布林介入,DeepMind迎来领导层洗牌

路透社报道,Google人工智能部门过去几个月经历了剧烈的内部动荡。联合创始人谢尔盖·布林据称介入Gemini模型训练,推动加快开发并尝试递归式自我改进。下一代Gemini旗舰模型据报因在编程等关键领域落后竞争对手而推迟两个月发布。8月5日,Google DeepMind宣布由科雷·卡武库丘奥格鲁接替德米斯·哈萨比斯担任负责人;哈萨比斯转任主席,运营职责减少。在布林支持下,卡武库丘奥格鲁预计将获得

HarnessEval-W:用智能体评估视觉世界

HarnessEval-W 是一套面向世界模型的智能体评估流程。它不再只输出单一分数,而是将每个评估问题拆解为可测量的子问题,并为各个子问题配置具有专属上下文和诊断工具的专业子智能体。上级智能体会验证收集到的证据并生成最终结论,从而形成透明的证据树。该方法在 18 个代表性世界模型的 330 个评估案例上进行了测试,判断结果与人类偏好高度一致,同时能够细致诊断物理规律、因果关系和世界状态演变方面的

雷鸟宣布全新 iO 系列,首款产品定位为“人类增强 AI 眼镜”

AR 品牌雷鸟创新(RayNeo)将于 8 月 21 日 14:30 正式发布 iO 系列首款 AI 眼镜。官方将其定位为“人类增强 AI 眼镜”,重点围绕知识、表达和记忆等场景提供辅助。产品采用接近传统眼镜的设计,配备纤细钛金属镜腿,并使用显示区域近乎隐形的自研光波导显示技术,主打长期佩戴体验。具体配置、功能和售价尚未公布,目前已开启预约。