AI 新闻中心

AI 新闻中心 过去30天分析了 1114 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

商汤与MiniMax前元老半年募资57亿元,打造AI 3D独角兽VAST

中国AI 3D创业公司VAST(三启万物)宣布完成B轮和B+轮融资,合计约30亿元人民币。公司称,不到半年内累计融资已突破57亿元。投资方包括创投机构、游戏和汽车等产业公司,以及地方政府基金。VAST由曾任商汤科技员工、并以早期创始团队成员身份参与创办MiniMax的宋亚宸于2022年在北京成立。公司同步发布Tripo P2.0,主打原生四边形拓扑网格生成,并支持面数控制、局部编辑和部件拆分,目标

开发者通过模组让 RTX 40 系列显卡运行 DLSS 多帧生成

开发者发布了一款模组,让原本仅面向 RTX 50 系列的 DLSS 多帧生成功能在 RTX 40 系列显卡的《赛博朋克 2077》中运行。该模组会在游戏运行时拦截 DLSS DLL,修改生成帧数量,并将面向 Blackwell 架构的帧时间控制指令移植到 Ada Lovelace。用户反馈显示,虽然原生渲染性能略有下降,最终输出帧率仍可大幅提升。RTX 4080 用户称,原生 38 FPS 的画面

OpenAI据称正式发布GPT-6 Astra,宣称迈向AGI的重要里程碑

据报道,OpenAI推出了GPT-6 Astra,具备105万token上下文窗口、多档推理强度,以及通过屏幕、键盘和鼠标直接操作图形用户界面的能力。文章宣称,Astra在数学、科学、软件工程和GUI操作基准测试中取得极高成绩;标准价格为每百万输入token 10美元、每百万输出token 50美元。产品据称将先向少数企业合作伙伴开放,随后逐步推送给ChatGPT会员和API用户。OpenAI表示

微软推出 MAI-Transcribe-2:支持 60 种语言,词错误率达 5.2%

微软推出语音转文字 AI 模型 MAI-Transcribe-2。根据公司公布的数据,该模型在 FLEURS 测试中,无论指定语言还是自动识别语言,平均词错误率均为 5.2%。在同一比较中,其表现略优于 Gemini 3.1 Pro,并明显优于 GPT-Transcribe 和 Whisper v3-Large。微软称,MAI-Transcribe-2 的速度最高达到 GPT-Transcribe

LatentPress:超越文本与视觉的上下文压缩

LatentPress将对话历史和长文档压缩为连续记忆标记,使冻结的语言模型能够通过输入嵌入接口直接读取,无需在推理阶段重建文本。一个与读取器匹配的小型写入器仅训练包含420万至2620万个参数的适配器,即可实现4至16倍压缩。在LongMemEval测试中,压缩7.7倍时准确率达到0.504,高于未压缩证据的0.490,也超过了基于文本摘要和OCR的压缩方法。每段对话的写入耗时约43毫秒,读取速

Gated DeltaNet 为何能承受 4 位量化:NVFP4 W4A4 应用于混合式 27B 大语言模型的循环部分

一项研究表明,混合式 Qwen3.8-27B 模型的全部 496 个线性层,包括 Gated DeltaNet 循环层,都可以采用 NVFP4 W4A4 量化,而不会造成明显的质量损失。在困惑度测试,以及 MMLU-Pro、GSM8K、AIME'25、GPQA-Diamond、LiveCodeBench 和最长 64K 上下文的 RULER 检索测试中,Minima 版本与 BF16 的差异处于随

LLaDA-Image:利用完全开放的训练方案构建高性能图像生成器

LLaDA-Image 是一个统一的图像生成框架,由从零开始训练的 60 亿参数 Diffusion Transformer,以及基于扩散语言模型 LLaDA2.0-Mini 的冻结视觉语言理解模块组成。系统没有从一开始就高度依赖图文配对数据,而是先通过纯图像预训练和中期训练建立强大的视觉生成先验。训练过程使用了 2.2 亿个样本,其中包括 9800 万张真实图像。蒸馏版本 LLaDA-Image

智谱 9 月 3 日至 20 日夜间免费提供 GLM-5.3-Flash

智谱 AI 为 GLM Coding Plan 付费套餐用户推出夜间优惠:9 月 3 日至 20 日每天 23 时至次日 9 时(北京时间),通过官方编程工具 ZCode 使用 GLM-5.3-Flash 不消耗额度;通过其他支持的 Agent 使用时,可用额度翻倍。活动不适用于 GLM-5.3。GLM-5.3-Flash 是 GLM-5 系列的多模态模型,支持 100 万 token 上下文窗口

IT早报:ChatGPT、Claude、Grok集体宕机近4小时;OpenAI发布GPT-6 Astra

据 Downdetector,ChatGPT、Claude、Grok 和 Cursor 等多项主流 AI 服务曾同时出现大范围故障,持续近 4 小时,随后恢复正常。OpenAI 还发布 GPT-6 Astra,宣称这是其目前最强的大语言模型,并首次达到网络安全能力的“关键”门槛。不过,相关性能以及模型可监控性下降的说法尚未得到独立验证。英伟达 CEO 黄仁勋否认 AI 会消灭所有工作。演员戚薇则宣

WHALE:联合优化模型权重与执行框架的简单方法

AI代理的性能同时取决于模型参数,以及负责管理上下文和控制流程的可执行框架。WHALE(Weight-Harness Alternating Learning)交替执行两个阶段:先在当前框架下更新模型,再针对更新后的模型搜索更优框架。该方法结合了在线拒绝采样微调和Meta-Harness。在搜索问答、数学推理和国际象棋谜题三个领域使用Qwen3.5-2B和4B代理进行测试时,WHALE的最佳mea