AI 新闻中心

AI 新闻中心 过去一年分析了 1732 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

PS3 模拟器 RPCS3 因性能影响拒绝跟进英伟达 DLSS 5

RPCS3 团队表示,不会将英伟达 DLSS 5 集成到 PS3 模拟器的官方版本中。部分用户据称已在 RPCS3 渲染器中测试泄露的 DLSS 5 DLL 文件,团队称测试结果显示性能下降。据相关报道,英伟达表示,目前启用 DLSS 5 可能导致游戏性能下降 50% 至 60%。DLSS 5 被描述为面向 RTX 50 系列显卡的新一代超分辨率和神经渲染技术。上述信息基于泄露文件测试及文章引用的

像素文本表示学习的设计基础

该研究探讨模型如何直接在像素空间中读取、检索和压缩语言。通过系统性的控制变量实验,研究人员确定了四项关键因素:可变图像分辨率和字体大小、用于视觉对齐的自然图像文本对、防止像素级捷径学习的布局感知渲染,以及用于跨语言对齐的两阶段多语言训练课程。研究团队将这些原则整合到 Pixel Linguist II 中。这是一款采用原生分辨率、支持即时渲染,并使用2.8亿个训练样本训练的视觉编码器。该模型在英语

后训练让语言模型在编程竞赛中达到金牌水平

一项研究提出了一套端到端流程,用于将大型语言模型专门训练成竞赛编程系统。该方法结合了精选题目、合成推理轨迹、监督微调和强化学习。使用22,000道题目训练的Nemotron-3-Nano-CC,在加入测试时生成、评估和改进解答的策略后,于IOI 2025获得468分,超过金牌门槛。更大的Ultra-CC模型获得502分。随后,一个针对竞赛专门调整的系统在IOI 2026的前瞻性评估中取得600分中

ExecRetrieval 衡量代码嵌入检索中的功能正确性差距

ExecRetrieval 是一个用于测试代码嵌入系统能否区分功能正确代码与几乎相同但存在错误的代码变体的基准。数据集包含 939 个 Python 任务,每个任务配有一个经过执行验证的标准实现,以及最多四个通过单一目标修改生成、同样经过执行验证的错误干扰项。研究人员评估了 23 种密集嵌入配置和 BM25。表现最佳的托管系统 exec@10 达到 1.00,但 exec@1 仅为 0.331。在

SolarWM:面向长时域视频世界模型的开放数据与可扩展训练

SolarWM 是一个完全开放的视频世界模型基础平台,覆盖从数据准备到长时域推理的完整流程。其数据引擎将来自 10 个数据集的 143 万个标准化视频片段转换为统一的逐帧对齐格式,涵盖视觉观测、度量相机几何、字幕、质量元数据、筛选决策和数据来源。统一的相机条件控制、训练和推理接口支持 4 个基于 Wan2.2、LTX-2.5 和 MiniMax-H3 的模型,参数规模为 50 亿至 330 亿,同

Cliff:从第一个错误开始学习推理过程奖励

这项研究提出了 Cliff,一种用于改进大语言模型可验证奖励强化学习的奖励塑形方法。研究利用现成的大语言模型识别每条推理轨迹中的第一个错误,并为正确前缀分配正向的词元级优势,为错误之后、已受无效前缀影响的部分提供负向反馈。在 12 个场景的实验中,Cliff 的推理性能比在线策略蒸馏高 15%,比标准 GRPO 高 7%;即使教师模型能力有限,也能取得改进。

估值目标500亿美元:月之暗面被曝秘密递交港股上市申请

据晚点LatePost报道,中国大模型企业月之暗面已于本周以保密形式向香港交易所提交A1上市申请文件。公司官方对此不予置评。与此同时,月之暗面正推进新一轮融资,市场消息称其投前估值为500亿美元,这可能是公司上市前的最后一轮融资。今年7月,月之暗面刚完成超过35亿美元的F轮融资,投后估值达到约350亿美元。由于投资者认购热烈,融资金额超过原定目标三倍,该轮融资提前结束。此次秘密递表若属实,将显示月

谷歌推出生成式 AI 图像设计工具 Google Pics,瞄准 Canva 与 Adobe Express

谷歌正式进入生成式创意设计领域,推出图像生成与编辑工具 Google Pics。该工具作为 Google Workspace 的一部分,面向企业客户以及 Google AI Pro 或 Ultra 订阅用户。Google Pics 采用谷歌自研的 Nano Banana 图像生成与编辑模型,主要通过自然语言提示词制作海报、社交媒体图片和日常插图。其功能包括隔离和变换单个对象、修改及翻译图片中的文字

AI提前9.24小时捕捉太阳活动早期信号

由美国新泽西理工学院牵头的研究团队开发了机器学习模型 EarlyDetect,用于预测太阳活动区的形成。该模型采用 Transformer 架构,分析 NASA 太阳动力学观测台获取的太阳声学活动和磁场数据。性能最佳的版本平均可在活动区变得可见前9.24小时识别出相关前兆信号。这项技术有望补充空间天气预报,为卫星通信企业和电网运营商争取更多时间,以应对太阳风暴风险。不过,EarlyDetect 目

IT早报9月3日:谷歌推出 Gemini 3.8 Flash,World Labs发布 Atlas 世界模型

本期科技资讯包含多项 AI 动态。谷歌上线 Gemini 3.8 Flash,面向软件工程、智能体任务和复杂知识处理流程,主打以较低成本进行大规模生产部署。李飞飞创办的 World Labs 发布 Atlas,称其为多模态世界模型,可实现高精度镜头控制、图像和视频生成,以及 3D 重建。腾讯推出 WorkBuddy 开放平台,支持开发者创建和管理智能体技能与专家能力。努比亚表示第二代豆包手机计划于

Meta发布Muse Spark 1.3,称其编码能力超过GPT-5.6 Sol

据IT之家报道,Meta于2026年9月2日发布Muse Spark 1.3,主要面向长周期智能体工作流和编码任务。Meta首席AI官Alexandr Wang称,该模型的编码能力超过OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1相当。Meta表示,与Muse Spark 1.2相比,新版本的工具调用次数减少约20%,完成相同任务所需的token减少2

中间训练阶段的知识蒸馏更有利于推理而非事实记忆

一项研究发现,基于logit的知识蒸馏在不同训练阶段会产生不同效果。在预训练阶段,它能同时提升推理能力和事实记忆;但在中间训练阶段,虽然推理能力继续增强,事实知识的获取却会放缓。研究人员将这一现象归因于教师模型在不同数据领域中的置信度差异,以及学生模型不断变化的知识状态。研究提出了Switch Distillation:利用教师模型的预测熵,仅在教师高度确信的词元上进行蒸馏,否则使用交叉熵训练。与

Muse Spark 1.3 开启最大推理模式,面向合作伙伴限量预览

Meta 发布了 Muse Spark 1.3。据现有信息,这是 Muse Spark 系列在五个月内推出的第四个模型。采用最大推理模式的版本目前仅向 Meta 的部分合作伙伴提供限量预览。在 Artificial Analysis Intelligence Index 上,该模型获得 62 分,排名落后于 Fable 5.1 和 Opus 5。关于评测条件、价格和更广泛开放时间的独立信息目前仍然