AI 新闻中心

AI 新闻中心 过去一年分析了 1732 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Code World Model:让编程智能体成为世界模型的大脑

Code World Model 将世界演化与视觉呈现分离。编程智能体充当世界的“大脑”,负责推理事件及其后果,生成可执行代码以维护持久的世界状态,并按照规则推动世界演化。系统通过一种代理表示,将可执行状态转换为空间和时间约束,再提供给视频模型生成细致的视觉内容。经过游戏数据微调后,MiniMax-H3 能够在由编程智能体构建的简单互动世界中遵循这些约束。该方法为构建具备持久后果和更开放演化能力的

价格降至四十分之一:智谱开源原生多模态模型 GLM-5.3-Flash

智谱推出并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首款原生多模态模型。智谱称,该模型在 Artificial Analysis Intelligence Index 中获得 57 分,与 Claude Opus 4.8 持平,综合性能超过参数量更大的 GLM-5.2。其标准价格为 GLM-5.3 的十分之一,限时优惠最低可达 Opus 4.8 价格的四十分之一

MemUse:将对话式 AI 的记忆评估从直接问答转向自然整合

一项研究表明,传统的对话式大语言模型记忆测试未必能反映用户满意度。在一项为期4个月的部署中,40名用户进行了1,872次会话,涵盖7种记忆条件。针对过往对话事实的直接提问,准确率在19.7%至70.1%之间波动,但用户满意度没有变化。研究人员认为,直接问答测试的是系统在被明确询问时能否检索事实,而真实对话还要求系统识别信息的相关性,并将过往上下文自然融入回答。为此,他们推出MemUse,根据真实用

英伟达据称洽谈以超130亿美元收购 Hugging Face

据 Business Insider 报道,英伟达近几周一直在与 Hugging Face 就收购事宜进行严肃讨论。若交易达成,Hugging Face 的估值将超过130亿美元,可能成为英伟达迄今规模最大的交易之一,但双方尚未达成协议,谈判仍可能破裂。微软也曾与 Hugging Face 会面,但据知情人士透露,双方尚未进入实质谈判。去年年底,Hugging Face 拒绝了英伟达以5亿美元投资

当“必须”变成“也许”:LLM 智能体工作流中的约束弱化

这项研究分析了基于大语言模型的智能体在交接过程中如何削弱具有约束力的要求。研究人员在 1,296 个受控合成情境中,通过摘要、计划和其他工作流产物传递安全阻断条件。即使原始信息通常得到保留,那些必须在执行前解决的要求也会反复变成不具约束力的参考事项。在常规交接压缩下,100.0% 的阻断条件被停用,54.2% 的情境出现了被禁止的行动。恢复前提条件、权限、备用方案和执行后果这四个状态字段后,状态保

智谱发布轻量级旗舰模型,支持超10万张国产AI芯片

据报道,智谱AI正式推出轻量级旗舰模型GLM-5.3 Flash,定位为DeepSeek V4 Flash的竞争产品。该模型采用混合专家架构,总参数量为3200亿,实际激活参数仅180亿,并支持文本、图片和视频输入。其在线推理服务据称由超过10万张国产芯片组成的集群承载,全链路运行在国产硬件上。智谱尚未公布具体芯片型号,行业信息则指向华为昇腾、海光和摩尔线程等厂商。公司称该模型性能超过上一代GLM

开放世界多智能体环境中的自主数学发现

一项研究考察了不同模型系列的 AI 智能体如何在没有中央协调者或预设流程的开放环境“Station”中开展数学研究。在 12 个构造问题和另外两个案例研究中,该系统在五个问题上取得了相较既有文献的新成果,包括有限域 Kakeya 集合的新无限族、11 维空间中精确的 604 点接吻配置、离散 Kakeya 针问题和符号不确定性问题的新纪录,以及对 Erdős 最小重叠问题下界的显著改进。智能体不仅

访谈揭示OpenAI重启计划:萨姆·奥特曼称2026年底前或拥有可称为AGI的系统

对OpenAI高管、员工及其他相关人士的访谈,介绍了该公司的重启计划。首席执行官萨姆·奥特曼表示,OpenAI可能在2026年底前拥有一套他会称为通用人工智能(AGI)的系统。不过,这是一项预测,并不代表已经得到证实的技术成果。与此同时,抗议者举牌并在路面上用粉笔留言,呼吁停止人工智能竞赛。

Ox Alpha现身:智谱开源原生多模态模型GLM-5.3-Flash,限时价格为GLM-5.3的二十分之一

智谱发布并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型。该混合专家模型总参数量为3200亿,实际激活参数为180亿。正式发布前,模型曾以匿名名称Ox Alpha在OpenCode和OpenRouter上进行测试。智谱称,该模型在Artificial Analysis Intelligence Index中获得57分,与Claude Opus 4.8持平