AI 新闻中心

AI 新闻中心 过去一年分析了 1725 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

白帽黑客利用 Anthropic Claude 入侵 OpenAI ChatGPT 账户,获得 6500 美元赏金

安全公司 Hacktron AI 的独立研究人员利用 Anthropic 的 Claude,攻击了托管 OpenAI 社区论坛的第三方服务 Discourse 的一个漏洞。研究人员获取的会话令牌出乎意料地也能用于 ChatGPT 账户及 OpenAI 的部分 GitHub 服务。他们因此有限访问了私有仓库的元数据和代码变更,疑似包括 OpenAI 的内部“Monorepo”,但发现可能接触敏感数据

智谱上线 GLM-5.3-FlashX,速度最高达每秒 200 tokens

智谱推出面向企业和开发者的 GLM-5.3-FlashX,宣称最高可达每秒 200 tokens。智谱表示,GLM-5.3-Flash 此前曾以“Ox Alpha”的名称面向全球开发者提供,调用量持续增长。为应对需求上升,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大了基础设施和推理优化投入。GLM-5.3-FlashX API 现已上线。

全国首个海洋产业Token工厂在青岛落地

全国首个面向海洋产业的智能要素供给平台“海洋Token工厂”近日在青岛正式发布并落地。平台由中国移动通信集团山东有限公司参与建设,整合了130多类涉海数据、超过800P的海洋算力资源池、20多个海洋领域专有大模型和30多款通用模型。用户可通过统一平台按需获取数据、算力、模型及工具,Token则被用作智能服务的统一计量单位。平台主要面向多模态智能感知、复杂环境推演、目标识别,以及海洋科学和工程计算等

安全研究人员在 OpenAI 漏洞赏金计划中入侵公司并访问 GitHub 内部代码库

据《华尔街日报》记者 Robert McMillan 报道,参与 OpenAI 漏洞赏金计划的独立安全研究团队成功访问了该公司位于 GitHub 的内部单体代码库。据称,研究人员使用了针对网络安全调整的 Opus 4.8 和 Opus 5 版本。这起事件凸显了自动化网络威胁不断增长的风险,也引发了外界对 AI 开发环境内部系统防护能力的关注。

阿里发布 Qwen3.8-Omni-Flash 多模态模型,支持百万 Token 上下文

阿里发布 Qwen3.8-Omni-Flash 原生多模态模型,可同时处理文本、图像、音频和视频,支持 100 万 Token 上下文。阿里称,该模型在 30 项评测中的平均成绩较 Qwen3.5-Omni-Plus 提升超过 26%。官方公布的改进覆盖音视频 Agent、编程、长程任务、长音视频理解和会议分析等场景。API 音频输入价格下降超过 98%,音视频输入价格下降超过 93%。阿里还开源

Claude 写下 Anthropic 八成代码,CI 工作量半年暴增 25 倍

Anthropic 披露,Claude 已负责公司约 80% 的代码编写。工程师的代码交付量最高达到 2021 至 2025 年平均水平的 8 倍,代码审查和合并批准等工作也有相当一部分由 Claude 完成。由于 Claude 偏好持续提交极细粒度的拉取请求,测试用例数量增加 10 倍,CI 运行任务在半年内暴增 25 倍,最终导致系统过载。Anthropic 先后三次尝试修补均未奏效,最后根据

Qoder 福利:阿里巴巴 Qwen3.8-Flash 10 月前免费,每日登录可领 100 Credits

Qoder 将于 9 月 18 日至 9 月 30 日期间限时免费提供阿里巴巴 Qwen3.8-Flash。该模型的计费系数降为 0,调用时不会扣除 Credits。用户只需在 Qoder 桌面端的模型选择器中选中该模型即可使用。符合条件的用户每天还可领取 100 个通用 Credits,奖励自领取之日起 30 天有效,且可以累积。活动覆盖 Qoder 国际版和中国版的个人用户,包括免费及试用账户

千问上线 Qwen3.8-Omni-Flash:支持百万级上下文,30项评测平均提升超26%

千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入,以及 100 万 token 上下文。千问称,该模型在 30 项评测中的平均得分较 Qwen3.5-Omni-Plus 提升超过 26%。据介绍,改进主要覆盖音视频 Agent、编程、GUI 操作和长程任务等场景。千问还表示,音频及音视频输入的 API 价格大幅下降。模型已在千问 AI 平台开放体验

PrismML发布Bonsai 2 27B,将Qwen压缩至5.9GB

PrismML发布了Bonsai 2 27B,这是阿里巴巴Qwen3.8 27B的压缩版本。该模型大小为5.9GB,理论上可在智能手机上运行。PrismML表示,它在基准测试中保留了Qwen原模型98.2%的成绩。此次发布的重点是模型压缩技术及其端侧运行潜力,而不是这家目前尚未获得大额融资、知名度有限的人工智能初创公司。

WeVisDoc:从覆盖范围到能力,提升稳健的端到端文档解析

WeVisDoc 是一个面向稳健端到端文档解析的两阶段数据驱动框架。第一阶段通过异构数据和保持结构的退化合成,扩大语义、结构与外观覆盖范围。第二阶段在固定的视觉—结构聚类中测量解析器的剩余错误,并据此指导针对性数据构建和目标标记令牌预算的重新分配。WeVisDoc-4B 在 OmniDocBench v1.6 上取得 95.38 分,在 PureDocBench 的三个测试轨道上平均取得 75.5

Figure发布Helix 2.5,在30个陌生家庭实现56%零样本成功率

Figure于9月17日发布人形机器人神经网络Helix 2.5。该模型基于公司的人类行为数据集Index预训练,并在旧金山湾区30个此前未采集数据的家庭中测试。在整理客厅、折叠毛巾和铺床三类任务中,Helix 2.5的零样本成功率达到56%,而从零开始训练的同条件策略为9%。测试使用了训练数据未涵盖的家庭环境和物品,且只有完整完成任务才计为成功。Figure表示,Helix 2.5仅使用Heli

Anthropic 推出生命科学认证计划,三款模型适用统一授权条款

Anthropic 推出了面向生命科学领域的认证计划。根据计划,Mythos 5.1、Opus 5 和 Sonnet 5 三款模型均适用标准化的使用与授权条款。该举措通过合同明确了药企、生物技术公司和科研机构将这些模型用于研发、文献梳理或实验辅助时的使用范围与责任。对于监管要求较高的生命科学行业,统一条款可帮助相关机构评估模型是否适合进入研究和实验流程。