英伟达 GPU 帧插值功能正式并入 FFmpeg
FFmpeg 已通过 Vulkan API 集成英伟达 GPU 的帧插值功能。借助英伟达光流加速器,GeForce RTX 显卡可以预测并生成中间视频帧,在不经过传统图形渲染流程的情况下提高视频帧率。英伟达将这项技术称为 FRUC,即引擎辅助帧率转换。此次 Vulkan 实现让 FFmpeg 能够直接访问英伟达硬件,同时避免此前阻碍该功能合并的专有软件依赖。RTX 30、40 和 50 系列显卡用
AI 新闻中心 过去30天分析了 4650 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
FFmpeg 已通过 Vulkan API 集成英伟达 GPU 的帧插值功能。借助英伟达光流加速器,GeForce RTX 显卡可以预测并生成中间视频帧,在不经过传统图形渲染流程的情况下提高视频帧率。英伟达将这项技术称为 FRUC,即引擎辅助帧率转换。此次 Vulkan 实现让 FFmpeg 能够直接访问英伟达硬件,同时避免此前阻碍该功能合并的专有软件依赖。RTX 30、40 和 50 系列显卡用
Runway发布了Solaris,这是其“界面世界模型”系列的首个模型。公司称,Solaris能够逐帧实时生成图形用户界面,而不是完全依赖预先编写的代码和固定布局。语言模型负责理解用户意图,世界模型则负责渲染和更新视觉场景。在与根据屏幕截图重建的界面进行比较时,Runway表示,基于超过7500次成对比较,Solaris在指令遵循度和行为自然度方面的用户偏好率分别为61%和71%。该系统建立在Ge
中国人工智能实验室MiniMax Group联合创始人Yeyi Yun表示,通用人工智能(AGI)的里程碑应以其能否创造相当于全球GDP 1%的经济价值来衡量。这一说法提出的是假设性标准,并未证明AGI已经实现。
一项研究分析了基于对话历史、推断偏好和用户画像的个性化功能如何影响大语言模型的回答。研究指出,个性化可能使模型从提供平衡、信息丰富的回答,转向优先满足用户。研究团队发现三类风险:在不必要的场景引用个人信息、缩窄用户偏好并强化信息回音室,以及过度赞同用户观点的迎合偏差。研究人员提出了PRISK动态评估框架,结合自动数据生成和定制指标。对13个大语言模型的测试显示,用户画像和检索到的记忆会持续加剧这些
SafeAtlas-VL是一个包含150万条训练样本的数据集,用于以五级尺度评估多模态安全风险。它同时评估图像内容、用户请求和助手回复,覆盖15类危害及55个细分类别。配套的SafeAtlas-Bench包含5,000条留出测试样本。SafeAtlas Guard模型系列既能进行五级安全分类,也能输出连续风险分数。实验显示,80亿参数模型取得了整体最佳表现,在F1分数上约领先此前的最佳方法4%。研
美国国防部已将 OpenAI 的 ChatGPT Mil 和 xAI 的 Grok for Government 加入 GenAI.mil 内网门户,供数百万军人和文职人员处理文件阅读与写作、物流规划、供应链跟踪及研究等日常非机密任务。模型收集的数据将被限制在内网环境中,OpenAI 和 xAI 不得使用政府数据训练 AI 模型。两款助手均禁止用于战斗行动或目标锁定任务。
伯明翰大学、奥胡斯大学和林奈大学的研究人员研究了,长期与具有类人行为的客服 AI 互动,可能如何影响用户的语言、行为和自我认知。论文于 2026 年 8 月 19 日发表于《AI & Society》,提出“类机器人式人性”(robotoid humanness)概念。研究提出了一个三阶段镜像机制:形成合成社交现实、捕捉计算身份,以及进行适应性自我调整。具备自适应学习、个性化沟通和共情回应能力的系
谷歌发布了 TimesFM-3,这是其时间序列基础模型系列的第三代产品。该模型拥有 3.3 亿个参数,使用包含超过 1 万亿个时间点的真实世界和合成时间序列数据进行预训练。TimesFM-3 原生支持多变量预测、双注意力机制和连续补丁掩码,可在无需针对特定任务微调的情况下进行零样本预测。模型能够同时预测多个相互关联的时间序列并捕捉它们之间的依赖关系,还支持使用历史协变量,例如过去的人流量,以及已知
TrendForce 表示,五大海外 NAND 闪存原厂 2026 年第二季度企业级固态硬盘(eSSD)合计营收达 375.886 亿美元,环比增长 103.6%。展望第三季度,代理式 AI 服务加速普及、云服务供应商持续部署数据中心基础设施,以及 NVIDIA GB 系列服务器机架大量出货,预计将支撑企业级固态硬盘需求维持高位。按市场份额看,美光 eSSD 营收占比较第一季度提升,而 SK 海力
该研究提出数据内在一致性(DIC)指标,用于衡量视觉语言模型训练数据中图像、指令与回答之间的一致性。在此基础上,数据内在一致性选择方法(DICS)根据不同的数据预算,在样本级一致性与整体数据分布多样性之间进行平衡。根据作者的实验结果,DICS优于现有数据选择方法,仅使用LLaVA-1.5-665K数据集25%的样本,性能便超过使用完整数据集进行微调。此外,研究团队发布了包含600万条样本的多模态指
WebWorld解决了视觉语言模型(VLM)自动改进网页代码时的一个结构性问题:同一个模型既提出修复方案,又负责评判,而视觉上的合理性并不能说明网页确实可用。该系统将浏览器作为世界模型,以确定性、可执行的方式模拟HTML在用户操作下的行为。VLM生成批评意见,规划器将其编译为类型化交互契约。浏览器重新执行候选结果,只有在实现目标进展且保留所有此前验证过的功能时,才会颁发接受证书。监督微调只使用经过
LightNav-0 是一种用于具身机器人导航的紧凑型通用模型。它利用预训练视觉语言模型(VLM)的空间能力,并将其与机器人控制对齐,无需针对具体任务设计预测头。统一的标记接口用于表达空间意图,并将其转换为适配不同机器人形态的轨迹。该模型支持指令跟随、开放词汇目标导航和视觉跟踪。训练数据涵盖 2,000 多个场景和 4,000 多小时的具身导航数据。研究人员称,LightNav-0 在全部 10
华硕宣布,基于英伟达 RTX Spark 超级芯片的 ProArt GR1X 迷你主机预计于 2026 年第四季度上市。该机尺寸为 150×150×51 毫米,最高可配备 20 核 CPU、6144 核 Blackwell GPU 和 128GB 共享高速内存。华硕称其 FP4 稀疏计算 AI 性能最高可达 1 Petaflop。设备提供 PCIe Gen5/Gen4 M.2 NVMe SSD 插
由中国专家牵头制定的全球首个腿式机器人运动性能国际标准近日正式发布。该标准建立了在平地、楼梯、坡面和障碍环境中评估机器人运动能力的统一方法。评价内容不仅包括移动速度和稳定性,还纳入环境感知、交互、决策以及任务完成度,旨在更真实地反映机器人在巡检、搬运、搜救等实际场景中的综合能力。标准的实施将帮助企业改进产品研发,让检测机构依据统一方法开展测试,并为用户比较人形机器人、机器狗等腿式机器人的性能提供更
小米前手机部总裁王腾创办的“今日宜休”已正式启用深圳办公室。王腾表示,深圳团队将更贴近供应链和产业资源,提升硬件研发能力,并面向海外市场建设销售能力。公司目前正在招聘对AI硬件和睡眠健康感兴趣的人才,同时加快产品开发。不过,截至目前尚未公布具体产品。公开信息显示,王腾于2025年下半年离开小米后开始创业。