消息人士:字节跳动创始人张一鸣监督实时空间视频 AI 模型开发
据彭博社报道,字节跳动正在开发一款用于实时生成空间视频的 AI 模型。公司创始人张一鸣据称正在监督该项目,该模型最早可能于下个月推出。若成功发布,字节跳动将与 Meta 和 Alphabet 展开直接竞争。不过,目前消息来自知情人士,尚未得到官方产品发布确认。
AI 新闻中心 过去一年分析了 4191 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
据彭博社报道,字节跳动正在开发一款用于实时生成空间视频的 AI 模型。公司创始人张一鸣据称正在监督该项目,该模型最早可能于下个月推出。若成功发布,字节跳动将与 Meta 和 Alphabet 展开直接竞争。不过,目前消息来自知情人士,尚未得到官方产品发布确认。
字节跳动正在准备一款面向实时空间视频生成的人工智能模型。该公司将与Meta和Alphabet在这一领域展开竞争,相关技术可能应用于机器人和自动驾驶系统。目前,字节跳动尚未公布具体性能数据或发布日期。
凯迪拉克 XT5 PHEV 已在中国上市,共推出两款车型,限时权益价为 25.99 万至 27.99 万元。新车采用 1.5T 发动机、P1+P3+P4 三电机、双挡 DHT 变速箱和全系四驱,系统综合功率 385 千瓦、峰值扭矩 740 牛·米,零至 100 公里/小时加速时间为 4.8 秒。CLTC 纯电续航 215 公里,满油满电综合续航可达 1360 公里。智能化方面,全系标配激光雷达,并
OpenAI 首次披露内部研究人员使用 AI 编程智能体的规模和成本。使用量排名前 10% 的研究人员,每天消耗的 Token 按公开 API 价格计算超过 7000 美元;普通研究人员的日均使用额中位数也从 7 月的 162 美元升至 8 月中旬的 600 美元以上。这些数字反映的是理论市场成本,并不等于 OpenAI 实际支付的费用。OpenAI 表示,编程智能体提高了代码编写和交付速度,让研
韩国已开始测试一项面向公众的免费人工智能项目。这一计划可能成为全球关注的实验,但其成败取决于能否切实改善基本公共服务。
Insilico Medicine利用人工智能加速药物研发。该公司表示,为治疗一种罕见慢性肺病而开发的候选药物rentosertib,其早期数据表明可能还能延缓部分衰老过程。不过,这些结果仍处于初步阶段,尚未证明该药能够延长人类寿命或逆转衰老。
中国机器人公司宇树科技宣称,首次展示了由世界模型实时驱动的全自主人形机器人格斗。公司公布了现场视频,并表示 UnifoLM-X2-1.0 可在不依赖预设动作或人工遥控的情况下,完成未来状态预测、规划、决策和动态交互执行。宇树称,这项演示旨在验证世界模型驱动的人形机器人在高动态场景中部署的基础可行性。由于目前缺乏独立的技术验证,这一“全球首次”及相关性能说法仍应谨慎看待。
在创作者盛典上,vivo 宣布升级影像战略,并将“蓝图影像”打造为融合技术与文化的影像品牌。vivo 公布了影像研发合作伙伴,包括索尼、蔡司、联发科、豪威、三星和骁龙。公司表示,未来将进一步推动影像与 AI 深度融合,推出全新的 AI 摄影助手。该助手不只是针对特定场景提供 AI 功能,还将让 AI 在拍摄过程中主动提供服务。目前,vivo 尚未公布具体技术细节或产品上线时间。
京东 JoyAI App 推出可将购物嵌入视频通话的 AI 数字人。用户用摄像头拍摄商品后,AI 可实时提供商品信息和选购参考,搜索京东上的同款或相似商品,并直接在通话界面完成下单,无需切换应用。用户还可通过一张照片自定义数字人的外形、人设、音色和互动场景。JoyAI 同时支持语音、图像和视频交互,以及外卖、订酒店、健康咨询和金融咨询等服务。该发布主要属于将 AI 融入京东生态的商业应用;报道没有
腾讯宣布推出 HarmonyOS 智能手表版 WorkBuddy,目前已适配多款 HUAWEI WATCH 产品,包括新发布的 WATCH 6 系列。待办任务、灵感记录和 AI 对话历史可在手表、手机、平板、电脑与云端之间自动同步。用户可以直接在手表上查看电脑生成的总结报告或思维导图,也可以通过音频模式收听长篇分析,或扫码转回手机继续阅读。鸿蒙版 WorkBuddy 还支持华为“碰一碰”功能,可将
中国科学院上海光学精密机械研究所研究团队开发出多维复用光计算架构,融合波分复用、数据广播和网络复用,实现多任务、多模态信息的并行处理。由三个光计算核心组成的系统实现了324路计算并行度,并支持两个任务共享矩阵计算网络。在图像卷积实验中,光学结果与电子基准结果的均方根误差低于0.08;在遥感图像配准与识别验证中,识别准确率达到84.5%。该研究验证了通过波长、空间和任务等维度扩展光计算并行能力的可行
李飞飞与 World Labs 核心团队发布了多模态世界模型 Atlas,其核心机制是新视角预测。不同于预测下一个 token 的语言模型和预测下一帧画面的视频模型,Atlas 可根据少量图像或文字描述,生成从场景不同位置观察到的画面。它能在同一系统中处理文本、图像、视频、3D 数据和相机位姿,并融合场景重建与内容生成。团队称,Atlas 可显著减少 3D 场景重建所需的数据量,并有望应用于创意设
该研究将多智能体 LLM 系统中协调器与工作智能体的交互建模为双层协调博弈,并分析任务分解、文本反思、记忆更新和外部验证对协作与系统漂移的影响。研究提出随机反思记忆攀升(SRMA)方法,只有在基于环境的评估显示风险降低时才接受记忆更新;在特定假设下,作者还给出了收敛和重新锚定保证。在 500 个 SWE-bench 实例上,基于 Kimi 的系统解决了 72.2% 的任务,公开的 mini-SWE
华为发布半入耳式 FreeBuds 7 悦彰耳机,售价 999 元。华为称,该产品搭载自研第三代音频 AI 芯片和 AI 感知降噪算法,平均降噪深度提升 230%,处理延迟为 8 微秒,并支持最高 100dB 的双向通话降噪。单只耳机重 4.3 克,单次续航最长 8.5 小时,搭配充电盒可达 42 小时。耳机还支持 4.6Mbps 母带级无损音频和 IP55 防尘抗水。上述性能数据均为华为官方公布
腾讯混元与 WorkBuddy 联合团队于 9 月 7 日宣布,混元 Hy4 Preview 升级版已全面上线。针对用户和开发者反馈的复杂任务思考时间过长、过度自我验证等问题,团队进行了专项优化。通过 Bench 指标与人工评测双重验证,结果显示模型在保持任务效果的同时,显著减少了任务轮次以及输入、输出 Token 消耗。此次更新有望提升 Agent 应用中的响应效率,并降低模型调用成本。