AI 新闻中心

AI 新闻中心 过去30天分析了 4661 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

消息称 Meta 将 AI 绩效考核中的 Token 使用量指标删除

据 The Information 援引的内部备忘录,Meta 将不再根据 AI Token 使用量或采用率评估工程师绩效。新版指引转而强调工作质量、实际影响和更快交付,不再要求员工使用特定 AI 工具。Meta 表示,目前公司内部 93% 的代码变更都有 AI 智能体辅助完成。此前,Meta 曾通过 AI GateWay 统一监控员工的 AI 使用情况,并在 Token 支出异常增长时发出警报。

开发者通过模组让 RTX 40 系列显卡运行 DLSS 多帧生成

开发者发布了一款模组,让原本仅面向 RTX 50 系列的 DLSS 多帧生成功能在 RTX 40 系列显卡的《赛博朋克 2077》中运行。该模组会在游戏运行时拦截 DLSS DLL,修改生成帧数量,并将面向 Blackwell 架构的帧时间控制指令移植到 Ada Lovelace。用户反馈显示,虽然原生渲染性能略有下降,最终输出帧率仍可大幅提升。RTX 4080 用户称,原生 38 FPS 的画面

我国牵头的智慧城市人工智能应用国际标准成功立项

由中国牵头提出的智慧城市运营模型人工智能应用国际标准提案,已获国际标准化组织(ISO)批准立项。该标准旨在为智慧城市中的人工智能应用建立治理框架,涵盖风险监督、绩效监测、数据治理、资源协同以及包容性公共服务等内容。来自中国、美国、英国、法国、新加坡等16个国家的专家将共同参与标准制定。

谷歌为 Gmail、Docs 和 Keep 推出 AI 语音功能

谷歌正在 Gmail、Docs 和 Keep 中推出由 Gemini 驱动的对话式语音功能,分别称为 Gmail Live、Docs Live 和 Keep Live。用户可以通过自然语言和语音输入查询收件箱内容、生成文档草稿,以及整理食谱或清单。相关功能还支持实时文字记录,并可调用 Gmail、Google 云端硬盘和网页信息。目前,Gmail Live 面向 Google Plus、Pro 和

努比亚推出搭载豆包助手的新款旗舰手机

努比亚表示,NaviX Ultra已获得中国工业和信息化部入网许可,计划于2026年9月上市。该公司将其称为全球首款AI智能体手机。搭载的字节跳动豆包助手直接集成于操作系统,可根据自然语言指令进行跨应用识屏和模拟点击,执行机票搜索、比价及信息填写等任务。最终支付仍需用户确认。努比亚称,记忆数据和运算均在手机本地完成,不上传云端。相关功能的实际性能、稳定性及安全性仍有待产品上市后的独立验证。

OpenAI据称正式发布GPT-6 Astra,宣称迈向AGI的重要里程碑

据报道,OpenAI推出了GPT-6 Astra,具备105万token上下文窗口、多档推理强度,以及通过屏幕、键盘和鼠标直接操作图形用户界面的能力。文章宣称,Astra在数学、科学、软件工程和GUI操作基准测试中取得极高成绩;标准价格为每百万输入token 10美元、每百万输出token 50美元。产品据称将先向少数企业合作伙伴开放,随后逐步推送给ChatGPT会员和API用户。OpenAI表示

微软推出 MAI-Transcribe-2:支持 60 种语言,词错误率达 5.2%

微软推出语音转文字 AI 模型 MAI-Transcribe-2。根据公司公布的数据,该模型在 FLEURS 测试中,无论指定语言还是自动识别语言,平均词错误率均为 5.2%。在同一比较中,其表现略优于 Gemini 3.1 Pro,并明显优于 GPT-Transcribe 和 Whisper v3-Large。微软称,MAI-Transcribe-2 的速度最高达到 GPT-Transcribe

微软为 Copilot Studio 新增 AI 代理强制人工审批功能

微软在 Copilot Studio 中新增了一项功能,允许开发者要求 AI 代理及其使用的特定工具必须经过人工审批。当代理尝试发送电子邮件、关闭客服工单或处理财务付款等敏感操作时,系统会暂停执行。用户可以查看代理的操作意图,并选择批准、允许当前会话继续或拒绝操作。该要求独立于代理的内置指令,即使代理判断某项操作是最佳下一步,也无法绕过人工授权。审批请求会直接显示在 Microsoft Teams

LatentPress:超越文本与视觉的上下文压缩

LatentPress将对话历史和长文档压缩为连续记忆标记,使冻结的语言模型能够通过输入嵌入接口直接读取,无需在推理阶段重建文本。一个与读取器匹配的小型写入器仅训练包含420万至2620万个参数的适配器,即可实现4至16倍压缩。在LongMemEval测试中,压缩7.7倍时准确率达到0.504,高于未压缩证据的0.490,也超过了基于文本摘要和OCR的压缩方法。每段对话的写入耗时约43毫秒,读取速

Gated DeltaNet 为何能承受 4 位量化:NVFP4 W4A4 应用于混合式 27B 大语言模型的循环部分

一项研究表明,混合式 Qwen3.8-27B 模型的全部 496 个线性层,包括 Gated DeltaNet 循环层,都可以采用 NVFP4 W4A4 量化,而不会造成明显的质量损失。在困惑度测试,以及 MMLU-Pro、GSM8K、AIME'25、GPQA-Diamond、LiveCodeBench 和最长 64K 上下文的 RULER 检索测试中,Minima 版本与 BF16 的差异处于随

LLaDA-Image:利用完全开放的训练方案构建高性能图像生成器

LLaDA-Image 是一个统一的图像生成框架,由从零开始训练的 60 亿参数 Diffusion Transformer,以及基于扩散语言模型 LLaDA2.0-Mini 的冻结视觉语言理解模块组成。系统没有从一开始就高度依赖图文配对数据,而是先通过纯图像预训练和中期训练建立强大的视觉生成先验。训练过程使用了 2.2 亿个样本,其中包括 9800 万张真实图像。蒸馏版本 LLaDA-Image