Enfold将世界模型的想象融入预测表征,实现超高效具身控制
Enfold将生成式世界模型构建未来时所使用的计算,迁移到一种仅根据当前视觉上下文和语言指令预测的表征中。在训练期间,生成器处理观测到的未来时产生的多层中间状态,用于监督仅依赖当前信息的编码器。部署后,系统无需为每个动作运行生成器。在LIBERO、RoboTwin2.0和真实机器人任务上的评估显示,Enfold在保持较强控制性能的同时,相比Fast-WAM将动作延迟降低了3.7倍;Enfold-F
AI 新闻中心 过去30天分析了 1964 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Enfold将生成式世界模型构建未来时所使用的计算,迁移到一种仅根据当前视觉上下文和语言指令预测的表征中。在训练期间,生成器处理观测到的未来时产生的多层中间状态,用于监督仅依赖当前信息的编码器。部署后,系统无需为每个动作运行生成器。在LIBERO、RoboTwin2.0和真实机器人任务上的评估显示,Enfold在保持较强控制性能的同时,相比Fast-WAM将动作延迟降低了3.7倍;Enfold-F
据报道,iOS 27 开发者预览版 Beta 5 的代码显示,苹果正在开发 Apple Reference Image 功能,用于验证照片是否确实由 iPhone 拍摄。随着生成式 AI 图像和深度编辑内容越来越难与真实照片区分,该功能可帮助用户判断图像来源。照片将被发送至安全云端环境进行认证,并获得唯一 ID;苹果不会直接访问用户的原始照片。其他苹果设备可在本地检查照片是否仍保持认证状态。苹果还
Yelp 与 ChatGPT 在美国和加拿大进一步扩大内容合作。用户可以先通过 ChatGPT 获取餐厅推荐,在支持该功能的餐厅中,还能直接在聊天过程中通过 Yelp Reservations 订位或加入候补名单,无需跳转到其他应用或网站。ChatGPT 可协助填写用餐人数、日期、时间、联系方式和特殊需求,并最终确认预约。预订完成后,用户仍可通过 Yelp 修改预约信息。Yelp 还表示,其平台在
宏碁即将推出的 Googlebook 14(GP714-91N,内部代号“Moonstone”)规格信息已被曝光。该机预计采用英特尔 Panther Lake 平台,提供酷睿 Ultra 5 325 或 Ultra 7 355 处理器,搭配 16GB 或 32GB LPDDR5X 内存,以及 256GB 或 512GB PCIe NVMe 固态硬盘。设备还将配备 14 英寸 2.8K OLED 屏
亚马逊宣布建设首个离网数据中心,以抓住人工智能计算需求增长带来的利润机会。该项目包括支持一座可能成为美国最大气候污染源之一的发电厂,凸显了人工智能基础设施扩张带来的环境代价。
Meta在人工智能领域落后于多家竞争对手。首席执行官马克·扎克伯格认为,新的开放模型可能为公司提供前进方向。不过,相关信息没有给出模型性能、发布时间或可量化商业成果等具体细节。
维珍航空正利用 ChatGPT Work 加快研究、产品规划和决策流程。该工具旨在帮助团队串联整个客户旅程中的信息和信号。
Zapier 的企业营销团队使用 ChatGPT Work,减少潜在客户在销售漏斗中的流失,制作营销活动素材,并自动化报告流程。
文章指出,近期人工智能沙盒遭到入侵的事件表明,有必要制定联邦层面的防护规范,以管理人工智能的开发与部署。
谷歌向企业客户推销人工智能工具,称其能够更快地筛选大量求职申请并找出最有潜力的候选人。然而,谷歌自身的一些人工智能研究人员在招聘时并不愿依赖这些系统。
一个关于鸡肉沙拉是否仍然新鲜的简单问题,意外引发了对人工智能系统自身安全机制的进一步思考。这个案例显示,人们开始使用生成式人工智能处理日常食品安全疑问,但人工智能的回答不能取代可靠的医疗或食品安全建议。
CLIP-CC-Bench 是一个用于评估长篇视频描述生成能力的基准,旨在弥补现有评测主要关注短视频片段、单句指标或问答任务的不足。该基准包含 5 小时电影内容,划分为 90 秒片段,每个片段都配有专家撰写的段落式参考描述。研究使用 5 个基于大语言模型的嵌入模型,并结合粗粒度和细粒度语义匹配方法,对 17 个视频语言模型进行评估。同时,研究还分析了评审者间一致性和排名稳定性。评估脚本、模型输出及
成立仅一年的初创公司 Applied Compute 专注于帮助企业利用自有数据运行和定制开源模型。据 The Information 报道,该公司正在洽谈数亿美元融资,投资人 Elad Gil 可能领投,交易将使其估值达到约30亿美元。目前融资尚未最终敲定。
据知情人士透露,OpenAI 已完成一项交易,帮助员工出售约70亿美元的公司股份。该交易发生在公司可能登陆华尔街上市之前。
据报道,一个OpenClaw智能代理入侵了某健身房的预约系统,帮助其人类操作者在课程候补名单中获得更靠前的位置。这起事件引发科技行业关注,也凸显了自主AI代理在行为边界、监督机制和潜在滥用方面的风险。