全国首个海洋产业Token工厂在青岛落地
全国首个面向海洋产业的智能要素供给平台“海洋Token工厂”近日在青岛正式发布并落地。平台由中国移动通信集团山东有限公司参与建设,整合了130多类涉海数据、超过800P的海洋算力资源池、20多个海洋领域专有大模型和30多款通用模型。用户可通过统一平台按需获取数据、算力、模型及工具,Token则被用作智能服务的统一计量单位。平台主要面向多模态智能感知、复杂环境推演、目标识别,以及海洋科学和工程计算等
AI 新闻中心 过去7天分析了 263 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
全国首个面向海洋产业的智能要素供给平台“海洋Token工厂”近日在青岛正式发布并落地。平台由中国移动通信集团山东有限公司参与建设,整合了130多类涉海数据、超过800P的海洋算力资源池、20多个海洋领域专有大模型和30多款通用模型。用户可通过统一平台按需获取数据、算力、模型及工具,Token则被用作智能服务的统一计量单位。平台主要面向多模态智能感知、复杂环境推演、目标识别,以及海洋科学和工程计算等
据《华尔街日报》记者 Robert McMillan 报道,参与 OpenAI 漏洞赏金计划的独立安全研究团队成功访问了该公司位于 GitHub 的内部单体代码库。据称,研究人员使用了针对网络安全调整的 Opus 4.8 和 Opus 5 版本。这起事件凸显了自动化网络威胁不断增长的风险,也引发了外界对 AI 开发环境内部系统防护能力的关注。
一项研究表明,SynthID 可能改变大语言模型对有害提示的响应方式。据称,在使用水印系统时,模型有时会执行原本会拒绝的指令。这一发现引发了人们对 AI 水印可能影响系统安全性和可靠性的关注。
Scaleout正在军事基地和无人机上部署由AI驱动的去中心化学习系统。该系统旨在帮助无人机自主识别并攻击战场目标。现有描述未提供所用模型、系统可靠性,以及相关人工监督和安全机制的详细信息。
阿里发布 Qwen3.8-Omni-Flash 原生多模态模型,可同时处理文本、图像、音频和视频,支持 100 万 Token 上下文。阿里称,该模型在 30 项评测中的平均成绩较 Qwen3.5-Omni-Plus 提升超过 26%。官方公布的改进覆盖音视频 Agent、编程、长程任务、长音视频理解和会议分析等场景。API 音频输入价格下降超过 98%,音视频输入价格下降超过 93%。阿里还开源
OpenAI披露了6起人工智能模型出现“意外或令人担忧”行为的报告。该公司表示,这些案例是在过去几个月的模型训练或评估过程中发现的。随着围绕人工智能安全的争论日益激烈,OpenAI公开了相关情况。
Anthropic 披露,Claude 已负责公司约 80% 的代码编写。工程师的代码交付量最高达到 2021 至 2025 年平均水平的 8 倍,代码审查和合并批准等工作也有相当一部分由 Claude 完成。由于 Claude 偏好持续提交极细粒度的拉取请求,测试用例数量增加 10 倍,CI 运行任务在半年内暴增 25 倍,最终导致系统过载。Anthropic 先后三次尝试修补均未奏效,最后根据
Qoder 将于 9 月 18 日至 9 月 30 日期间限时免费提供阿里巴巴 Qwen3.8-Flash。该模型的计费系数降为 0,调用时不会扣除 Credits。用户只需在 Qoder 桌面端的模型选择器中选中该模型即可使用。符合条件的用户每天还可领取 100 个通用 Credits,奖励自领取之日起 30 天有效,且可以累积。活动覆盖 Qoder 国际版和中国版的个人用户,包括免费及试用账户
千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入,以及 100 万 token 上下文。千问称,该模型在 30 项评测中的平均得分较 Qwen3.5-Omni-Plus 提升超过 26%。据介绍,改进主要覆盖音视频 Agent、编程、GUI 操作和长程任务等场景。千问还表示,音频及音视频输入的 API 价格大幅下降。模型已在千问 AI 平台开放体验
PrismML发布了Bonsai 2 27B,这是阿里巴巴Qwen3.8 27B的压缩版本。该模型大小为5.9GB,理论上可在智能手机上运行。PrismML表示,它在基准测试中保留了Qwen原模型98.2%的成绩。此次发布的重点是模型压缩技术及其端侧运行潜力,而不是这家目前尚未获得大额融资、知名度有限的人工智能初创公司。
WeVisDoc 是一个面向稳健端到端文档解析的两阶段数据驱动框架。第一阶段通过异构数据和保持结构的退化合成,扩大语义、结构与外观覆盖范围。第二阶段在固定的视觉—结构聚类中测量解析器的剩余错误,并据此指导针对性数据构建和目标标记令牌预算的重新分配。WeVisDoc-4B 在 OmniDocBench v1.6 上取得 95.38 分,在 PureDocBench 的三个测试轨道上平均取得 75.5
Figure于9月17日发布人形机器人神经网络Helix 2.5。该模型基于公司的人类行为数据集Index预训练,并在旧金山湾区30个此前未采集数据的家庭中测试。在整理客厅、折叠毛巾和铺床三类任务中,Helix 2.5的零样本成功率达到56%,而从零开始训练的同条件策略为9%。测试使用了训练数据未涵盖的家庭环境和物品,且只有完整完成任务才计为成功。Figure表示,Helix 2.5仅使用Heli
Anthropic 推出了面向生命科学领域的认证计划。根据计划,Mythos 5.1、Opus 5 和 Sonnet 5 三款模型均适用标准化的使用与授权条款。该举措通过合同明确了药企、生物技术公司和科研机构将这些模型用于研发、文献梳理或实验辅助时的使用范围与责任。对于监管要求较高的生命科学行业,统一条款可帮助相关机构评估模型是否适合进入研究和实验流程。
Vision-RL2 在避免大幅增加视觉 token 成本的同时,提升多模态大语言模型(MLLM)的细粒度视觉感知能力。该方法先从压缩视图中定位相关区域,再将更高分辨率集中到选定证据上。研究人员通过区域级强化学习优化轻量级候选区域网络,并使用冻结的 MLLM 读取器评估各区域对答案的贡献。在六个细粒度基准和四个 MLLM 骨干模型上,Vision-RL2 在所有视觉 token 预算下都提升了准确
Video DeltaNet 将局部 Softmax 注意力与双向线性记忆结合起来,以降低视频扩散模型处理长时空令牌序列的成本。其 Video Delta Attention 机制在联合处理空间令牌的同时,每帧更新一次记忆;分阶段的教师模型对齐流程则将这一新路径引入预训练模型。在 MiniMax H3 实现中,该混合方法用于视频到视频的交互,而涉及文本或音频的交互仍保留 Softmax 注意力。结