AI 新闻中心

AI 新闻中心 过去一年分析了 1732 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

智谱 9 月 3 日至 20 日夜间免费提供 GLM-5.3-Flash

智谱 AI 为 GLM Coding Plan 付费套餐用户推出夜间优惠:9 月 3 日至 20 日每天 23 时至次日 9 时(北京时间),通过官方编程工具 ZCode 使用 GLM-5.3-Flash 不消耗额度;通过其他支持的 Agent 使用时,可用额度翻倍。活动不适用于 GLM-5.3。GLM-5.3-Flash 是 GLM-5 系列的多模态模型,支持 100 万 token 上下文窗口

IT早报:ChatGPT、Claude、Grok集体宕机近4小时;OpenAI发布GPT-6 Astra

据 Downdetector,ChatGPT、Claude、Grok 和 Cursor 等多项主流 AI 服务曾同时出现大范围故障,持续近 4 小时,随后恢复正常。OpenAI 还发布 GPT-6 Astra,宣称这是其目前最强的大语言模型,并首次达到网络安全能力的“关键”门槛。不过,相关性能以及模型可监控性下降的说法尚未得到独立验证。英伟达 CEO 黄仁勋否认 AI 会消灭所有工作。演员戚薇则宣

WHALE:联合优化模型权重与执行框架的简单方法

AI代理的性能同时取决于模型参数,以及负责管理上下文和控制流程的可执行框架。WHALE(Weight-Harness Alternating Learning)交替执行两个阶段:先在当前框架下更新模型,再针对更新后的模型搜索更优框架。该方法结合了在线拒绝采样微调和Meta-Harness。在搜索问答、数学推理和国际象棋谜题三个领域使用Qwen3.5-2B和4B代理进行测试时,WHALE的最佳mea

GPT-6 Astra 在 ARC-AGI-3 标准测试中得分 62.7%,使用供应商适配器测试达 99.9%

Greg Kamradt 和 ARC Prize 表示,GPT-6 Astra 使用标准测试框架,在 ARC-AGI-3 Semi-Private 测试中以 2.6 万美元的成本取得 62.7% 的成绩。使用新的供应商适配器测试框架后,模型据称以 1.9 万美元取得 99.9% 的成绩。Claude Opus 5 得分 30.2%,GPT-5.6 Sol 得分 7.8%。两种测试方式产生了巨大差异

据称 OpenAI 将 GPT-6 Astra 输入价格定为每百万 Token 10 美元

据 The Deep View 报道,OpenAI 计划将 GPT-6 Astra 的价格定为每百万输入 Token 10 美元、每百万输出 Token 50 美元,与 Anthropic Claude Fable 5.1 的传出定价相同。报道称,这款此前被指与 Hugging Face 一起卷入备受关注的安全漏洞事件的模型,可能会在增加新的安全防护措施后发布。目前这些信息尚未得到独立证实。