AI 新闻中心

AI 新闻中心 过去30天分析了 1114 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

谷歌 DeepMind 发布 WeatherNext 3:AI 气象模型最高支持 5 公里分辨率

谷歌 DeepMind 和 Google Research 发布了 WeatherNext 3,并称其为目前最先进、最精准的全球气象模型。该模型利用最新卫星观测数据和气象站数据,每小时生成全球天气预报,部分关键地表变量的分辨率最高可达 5 公里。它旨在提供更本地化的预测,尤其面向过去因超级计算成本高昂而缺乏高分辨率区域模型的拉美、非洲和亚太地区。WeatherNext 3 还可预测约 100 米高

沙特 HUMAIN 发布阿语模型 humain-m3,由 MiniMax 受托开发

沙特主权财富基金旗下AI企业 HUMAIN 宣布推出阿拉伯语大模型 humain-m3。该模型由中国AI企业 MiniMax 受托开发,基于 MiniMax-M3 架构构建,并经过万亿级(T级)阿拉伯语原生文本 Token 的预训练。在7个公开的阿拉伯语基准测试中,该模型取得了参测模型的最高平均分。目前,该模型已在 HUMAIN Node 平台提供预览,后续计划发布开放权重版本。

Nvidia 因收购案上涨;Snowflake 与 Meta 受益 AI 进展股价走高

Nvidia 同意以约 130 亿美元收购 AI 初创公司 Hugging Face,股价随之微幅上涨。Snowflake 则因其 AI 辅助编码工具 CoCo 采用率迅速增长(累计达 9,100 个客户账户),调高全年营收预测,带动股价大涨。同时,Meta 发布了迄今为止最强大的 AI 模型,亦推升其股价走高。

NeoMME:用于高效微调与推理的单塔式多模态原生多语言基础编码器

研究人员推出 NeoMME,这是一个包含 2.6 亿和 8 亿参数模型的双向多模态、多语言编码器系列。模型在单一 Transformer 编码器中处理多语言文本和原始图像块,并支持 16,384 个 Token 的上下文长度。在 ViDoRe v3 文档检索基准测试中,NeoMME Retriever 的 nDCG@10 分别达到 0.523 和 0.556。在 NVIDIA L40S 上使用 2

研究探索语言代理与非语言代理的协作方式

一项研究考察,将非语言代理的连续状态表示压缩为简短文本摘要,是否会限制其与大型语言模型的协作。研究人员推出 LLAMIA-Bench,包含六项协作式国际象棋任务,涵盖行为模仿、状态评估和自然语言解释。作为语言化传递的替代方案,潜在状态内化方法将专用代理的表示直接投射到语言模型的 token 流中,以学习得到的状态 token 进行编码,并随环境状态变化动态重新编码。实验结果显示,基于语言描述的整合

奥尔特曼:OpenAI Astra 模型已接受美国政府自愿审查

OpenAI 首席执行官萨姆·奥尔特曼证实,公司即将推出的 Astra 模型已接受美国政府的自愿审查。Astra 预计将成为 OpenAI 首个被划入“关键”网络安全能力等级的模型,因此在开发期间和正式发布前需要采取更严格的安全措施。根据相关框架,政府官员最长可获得 30 天的模型访问权限,但白宫不打算公开审查规则。这使公众和未参与流程的企业仍难以了解美国政府将如何评估先进 AI 模型。奥尔特曼表

ZipTok3D:利用紧凑Token前缀实现高保真三维标记化

研究人员提出了ZipTok3D,这是一种能够利用极短Token序列高质量重建三维几何结构的标记器。训练期间,嵌套丢弃会随机截断潜在序列,并要求每个保留下来的前缀都重建完整物体,从而使前置Token优先编码关键几何信息。随后,采用参数共享的Transformer解码器逐步恢复更精细的几何细节。在Token维度相同的情况下,ZipTok3D据称达到了使用32个Token的COD-VAE基线相当的重建质

一眼足矣:利用 SimLoss 实现单次推理的细粒度图像描述

SimLoss 是一种无需参考文本的训练目标,旨在通过单次推理生成更细致的图像描述。该方法使用 InfoNCE 对比损失,将视觉语言模型的隐藏状态表示与冻结的图像嵌入对齐,使模型在生成文字前就能学习属性、数量、纹理、材质和空间关系等信息。它不需要人工撰写的细粒度描述,也不依赖多阶段流程生成伪描述。在评测中,可微分的 SimLoss FFT 取得了最高精确率,F1 分数接近多阶段验证系统,同时运行速