Vals分析:开放权重模型执行多阶段任务,环境影响可能是简单查询的1万倍
基准测试机构Vals AI的一项分析显示,使用开放权重模型执行构建网页应用等多阶段任务时,所需能源或用水量可能达到简单查询的1万倍。研究表明,人工智能的环境影响会随着任务复杂度和与模型交互次数的增加而显著上升。
AI 新闻中心 过去30天分析了 4661 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
基准测试机构Vals AI的一项分析显示,使用开放权重模型执行构建网页应用等多阶段任务时,所需能源或用水量可能达到简单查询的1万倍。研究表明,人工智能的环境影响会随着任务复杂度和与模型交互次数的增加而显著上升。
据 The Information 援引的内部备忘录,Meta 将不再根据 AI Token 使用量或采用率评估工程师绩效。新版指引转而强调工作质量、实际影响和更快交付,不再要求员工使用特定 AI 工具。Meta 表示,目前公司内部 93% 的代码变更都有 AI 智能体辅助完成。此前,Meta 曾通过 AI GateWay 统一监控员工的 AI 使用情况,并在 Token 支出异常增长时发出警报。
开发者发布了一款模组,让原本仅面向 RTX 50 系列的 DLSS 多帧生成功能在 RTX 40 系列显卡的《赛博朋克 2077》中运行。该模组会在游戏运行时拦截 DLSS DLL,修改生成帧数量,并将面向 Blackwell 架构的帧时间控制指令移植到 Ada Lovelace。用户反馈显示,虽然原生渲染性能略有下降,最终输出帧率仍可大幅提升。RTX 4080 用户称,原生 38 FPS 的画面
由中国牵头提出的智慧城市运营模型人工智能应用国际标准提案,已获国际标准化组织(ISO)批准立项。该标准旨在为智慧城市中的人工智能应用建立治理框架,涵盖风险监督、绩效监测、数据治理、资源协同以及包容性公共服务等内容。来自中国、美国、英国、法国、新加坡等16个国家的专家将共同参与标准制定。
谷歌正在 Gmail、Docs 和 Keep 中推出由 Gemini 驱动的对话式语音功能,分别称为 Gmail Live、Docs Live 和 Keep Live。用户可以通过自然语言和语音输入查询收件箱内容、生成文档草稿,以及整理食谱或清单。相关功能还支持实时文字记录,并可调用 Gmail、Google 云端硬盘和网页信息。目前,Gmail Live 面向 Google Plus、Pro 和
努比亚表示,NaviX Ultra已获得中国工业和信息化部入网许可,计划于2026年9月上市。该公司将其称为全球首款AI智能体手机。搭载的字节跳动豆包助手直接集成于操作系统,可根据自然语言指令进行跨应用识屏和模拟点击,执行机票搜索、比价及信息填写等任务。最终支付仍需用户确认。努比亚称,记忆数据和运算均在手机本地完成,不上传云端。相关功能的实际性能、稳定性及安全性仍有待产品上市后的独立验证。
据报道,OpenAI推出了GPT-6 Astra,具备105万token上下文窗口、多档推理强度,以及通过屏幕、键盘和鼠标直接操作图形用户界面的能力。文章宣称,Astra在数学、科学、软件工程和GUI操作基准测试中取得极高成绩;标准价格为每百万输入token 10美元、每百万输出token 50美元。产品据称将先向少数企业合作伙伴开放,随后逐步推送给ChatGPT会员和API用户。OpenAI表示
当地时间9月3日,OpenAI旗下ChatGPT、Anthropic旗下Claude和xAI旗下Grok几乎同时发生大规模服务中断,短暂影响了大量用户的日常使用和工作流程。各公司的技术团队随后展开调查和修复。目前三项服务均已恢复,官方服务状态页面显示,其核心功能和API调用已恢复正常。
微软推出语音转文字 AI 模型 MAI-Transcribe-2。根据公司公布的数据,该模型在 FLEURS 测试中,无论指定语言还是自动识别语言,平均词错误率均为 5.2%。在同一比较中,其表现略优于 Gemini 3.1 Pro,并明显优于 GPT-Transcribe 和 Whisper v3-Large。微软称,MAI-Transcribe-2 的速度最高达到 GPT-Transcribe
微软在 Copilot Studio 中新增了一项功能,允许开发者要求 AI 代理及其使用的特定工具必须经过人工审批。当代理尝试发送电子邮件、关闭客服工单或处理财务付款等敏感操作时,系统会暂停执行。用户可以查看代理的操作意图,并选择批准、允许当前会话继续或拒绝操作。该要求独立于代理的内置指令,即使代理判断某项操作是最佳下一步,也无法绕过人工授权。审批请求会直接显示在 Microsoft Teams
英伟达原计划仅在一款游戏中推出备受争议的 DLSS 5 AI 渲染技术,并且只支持最新的 RTX 50 系列 GPU。开发者原本将拥有对艺术呈现的完全控制权。不过,据报道,模组制作者已经将泄露版本移植到多种显卡上运行。提供的描述文本在句子中途截断。
LatentPress将对话历史和长文档压缩为连续记忆标记,使冻结的语言模型能够通过输入嵌入接口直接读取,无需在推理阶段重建文本。一个与读取器匹配的小型写入器仅训练包含420万至2620万个参数的适配器,即可实现4至16倍压缩。在LongMemEval测试中,压缩7.7倍时准确率达到0.504,高于未压缩证据的0.490,也超过了基于文本摘要和OCR的压缩方法。每段对话的写入耗时约43毫秒,读取速
一项研究表明,混合式 Qwen3.8-27B 模型的全部 496 个线性层,包括 Gated DeltaNet 循环层,都可以采用 NVFP4 W4A4 量化,而不会造成明显的质量损失。在困惑度测试,以及 MMLU-Pro、GSM8K、AIME'25、GPQA-Diamond、LiveCodeBench 和最长 64K 上下文的 RULER 检索测试中,Minima 版本与 BF16 的差异处于随
LLaDA-Image 是一个统一的图像生成框架,由从零开始训练的 60 亿参数 Diffusion Transformer,以及基于扩散语言模型 LLaDA2.0-Mini 的冻结视觉语言理解模块组成。系统没有从一开始就高度依赖图文配对数据,而是先通过纯图像预训练和中期训练建立强大的视觉生成先验。训练过程使用了 2.2 亿个样本,其中包括 9800 万张真实图像。蒸馏版本 LLaDA-Image
ChatGPT 的新贴纸功能起初看起来像又一种用过即弃的 AI 生成内容。但实际体验后,它出人意料地有趣,还能让用户制作出真正符合个人需求、愿意使用的贴纸套装。