AI 新闻中心

AI 新闻中心 过去一年分析了 8797 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

AI演员蒂莉·诺伍德的创作者称,好莱坞不必恐慌

创造蒂莉·诺伍德的荷兰演员兼科技创业者艾琳·范德费尔登表示,人工智能有望降低制作成本,让更多人参与电影制作,并为演员带来新的机会。不过,这位AI生成的演员也引发了强烈反对和威胁。范德费尔登强调,讲好故事仍离不开人类的创作技艺,并提醒业界不要忽视人工智能带来的影响。

欧盟 iPhone 和 iPad 用户可能仍需等待数月才能使用 Siri AI

据彭博社记者马克·古尔曼报道,苹果升级版 Siri AI 可能还要数月才能在欧盟推出。古尔曼在其 Power On 通讯中表示,延迟约五个月已是最理想的情况;在苹果就遵守欧盟数字规则进行协商期间,等待时间可能更长。他推测苹果可能通过暂缓推出升级版向欧盟委员会施压。欧盟用户可以在 Mac 上使用 Siri AI,但 iPhone 和 iPad 目前尚未开放。

人类的思维尚未准备好应对人工智能

文章探讨技术如何塑造人类思维,以及人工智能行业人士如何将人脑与计算机相比较。诺伯特·维纳曾说,每个时代的思想都会反映在其技术之中。谷歌DeepMind首席执行官德米斯·哈萨比斯将大脑称为“图灵机的生物学近似体”。所提供的节选在提及埃隆·马斯克的观点后中断。

通过渐进式视觉规划进行世界动作建模

ProWAM 是一种用于机器人控制的世界动作模型,可同时预测动作和按顺序排列的视觉子目标。与生成完整视频序列或仅预测单个未来画面的方法相比,该设计旨在提升长时程任务的执行能力。ProWAM 只需运行一次视频骨干网络即可缓存子目标特征,重新规划时仅需进行轻量级动作调整。研究团队报告称,该模型在 LIBERO-Plus(85.8%)和随机化 RoboTwin(75.7%)模拟基准上取得了当时的最佳成绩

阿里千问 AI 耳夹式耳机开启预约,支持 Bose 调音与 89 种语言翻译

阿里千问 AI 耳夹式耳机已在中国电商平台上架并开启预约,价格暂未公布。耳机采用开放式设计,续航最长 9 小时,配合充电盒可达 40 小时,支持 IP55 防尘防泼溅、无线充电及双设备同时连接。音频方面搭载 Bose 调音、动态 EQ、LHDC 5.0,并获得 Hi-Res Wireless 认证。AI 功能包括语音操控千问、实时转写、离线录音、92 种语言转写纪要,以及适用于面对面交流和通话的

LVMT:面向长时视频分割的视频掩码变换器

现有在线视频分割方法难以在存在长时间遮挡的复杂长视频中持续跟踪物体。LVMT采用轻量级GRU模块,学习选择需要随时间保留和传递的物体信息。其训练策略“截断查询传播”将视频分段处理,使模型能够学习更长时间跨度的信息,同时避免过高的内存需求和跨片段反向传播。研究团队称,在六项基准测试中,LVMT在多种视频分割任务上达到当时的最佳水平,速度比此前的领先方法快十倍。

交警提醒“智驾”不是“代驾”:男子酒驾后被吊销驾照

中国交警提醒,智能辅助驾驶系统不能替代驾驶人。一名男子当晚饮用约一斤白酒后驾车上高速,并开启辅助驾驶功能,随后在车内睡着。车辆最终停在高速公路中间车道,导致其他车辆紧急变道。其呼气酒精检测结果为111mg/100ml,血液检测结果为123mg/100ml,达到醉酒驾驶标准。该男子被吊销驾驶证,5年内不得重新申领,并因危险驾驶罪被判处拘役和罚金。中国司法指导案例明确,即使驾驶人启用了辅助驾驶功能,驾

Dream4ACT:面向多种机器人构型的共享视觉动作接口

Dream4ACT 是一种面向不同机器人构型、联合建模视频与动作的世界模型。其共享视觉动作接口从四个虚拟摄像机视角渲染目标关节配置,使观测序列与动作序列能够共用视频自编码器和扩散 Transformer。该模型支持正向动力学、逆向动力学,以及观测与动作的联合生成。为将预测的动作视图还原为可执行动作,研究提出了一种受 URDF 约束、无需训练的多视角恢复方法,无须为每种机器人单独训练解码器。Drea