AI 新闻中心

AI 新闻中心 过去一年分析了 7699 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Decoding-Level Taboo:诊断大语言模型鲁棒性的压力测试

该研究提出 Decoding-Level Taboo,一种无需提示词、可在生成过程中直接干预语言模型 logits 空间的诊断测试。该方法在词边界动态屏蔽主要候选 token,迫使模型采用不常见的表达方式并偏离其惯常生成路径。对多个开放权重模型系列的评估显示,模型在偏离常规路径时的鲁棒性同时受到参数规模和后训练指令对齐程度的影响;总体而言,规模更大且对齐更好的模型表现更稳健。该方法还可用于生成多样

威联通为 Qsirch 推出 AI 模式,优化 NAS 内容搜索

威联通升级了 NAS 搜索应用 Qsirch,推出结合视觉语言模型(VLM)与大语言模型(LLM)的 Qsirch AI Mode。用户可以通过自然语言描述,跨文件、图片、音频和视频进行搜索。威联通表示,所有 AI 推理均在 NAS 本地执行,无需将文件内容上传至公有云 API。该模式支持基于关键词、内容和上下文的匹配,并可在音视频搜索中关联时间轴与文字转录内容。

消息称三星将Claude引入半导体研发,将设计验证周期从一个月缩短至两天

据韩媒报道,三星电子已将Anthropic的Claude引入半导体开发流程。在一项客户定制SoC验证任务中,原本预计需要一个多月的工作仅用两天完成,内部评估显示效率提升约15倍。Claude可协助生成验证代码、搭建测试环境和检查数据路径,并在部分RTL资料交付前发现早期错误。三星还计划将Gemini和ChatGPT扩展至研发、生产等业务。不过,内部测试也发现明显风险:AI曾将错误日志改写为普通信息

LTX-2.5 发布:原生集成 ComfyUI,6.8 秒生成 10 秒 720P 视频

LTX 发布了 LTX-2.5 视频生成模型,支持音频生成并原生集成 ComfyUI。据公司介绍,在两张英伟达 GB200 的配置下,该模型可在 6.8 秒内生成 10 秒长的 720P 视频。用户可通过 Hugging Face、ComfyUI 和 LTX API 获取模型或使用托管生成服务。年度经常性收入低于 1000 万美元的组织可免费使用,规模更大的企业则需协商商业授权。LTX-2.5 F

OpenAI 测试 ChatGPT Plus 付费重置额度功能,费用为 8 美元

OpenAI 似乎正在部分 ChatGPT Plus 用户中测试一项付费重置功能:用户支付 8 美元后,可立即恢复已经用完的每周使用额度。OpenAI 尚未正式宣布该功能,但表示正在探索让达到使用上限的用户购买额外额度。用户也可以选择不付费,等待额度自动恢复。该测试与 AI 编程工具 Codex 的使用限制有关。与此同时,Anthropic 也在通过促销额度等方式推广 Claude Code。

DeepSeek注册Harness团队官方账号,通用Agent产品或将发布

DeepSeek近日注册了“Harness团队”官方微信公众号,被认为是通用AI Agent产品可能即将发布的信号。Harness是让大模型执行实际任务的工程化基础,涉及工具调用、任务规划和执行调度等能力。DeepSeek今年5月组建了专门团队,并招聘研究员、工程师和产品经理。根据相关内部表态,公司将优先发展通用Agent,而不是垂直领域Agent。不过,目前尚未有官方信息确认产品发布时间。

UniMoMo:通过专家合并加速大型推荐模型

UniMoMo是一种面向稀疏混合专家推荐模型的训练后压缩框架。它不依赖参数距离,而是利用无标签校准集测量专家对相同推荐状态的功能相似性,并据此合并专家。同时,分层自适应保护机制会限制对高路由频率专家的合并,以减少性能下降。该方法无需额外的在线压缩模块,即可将训练完成的模型转换为更小的专家配置。在Amazon Beauty、KuaiRec和TenRec数据集上,四专家模型达到原始NDCG@10的99

AI 智能体或将在性能和成本上超越印度外包

安德森・霍罗威茨合伙人 Fabrizio Serafini 称,计算机操作型 AI 智能体已从演示阶段进入可部署阶段,在部分企业流程中的成本可能低于印度离岸外包劳动力。这类智能体能够读取屏幕、点击界面、输入文字,并在缺少明确 API 的软件中处理错误。文章引用 OSWorld-Verified 数据称,领先模型的任务完成率已从 2025 年初的 42% 提升至 2026 年 6 月的 85%,但这

马斯克对SpaceX员工表示:我们必须赢得AI竞争

据SpaceX全员会议录像,CEO埃隆·马斯克表示,AI营收最快可能在9月超过公司其他业务的营收总和,并在第四季度大幅领先。他称SpaceX计划利用公司掌握的全部信息训练大语言模型Grok,但没有说明数据范围、训练方式或隐私保护措施。马斯克还表示,SpaceX必须在AI硬件和软件领域取得领先,并提到将数据中心部署到太空,以及采用英伟达未来Vera Rubin架构的算力基础设施。相关营收预测和企业计

前OpenAI研究员创办River AI,种子轮及A轮融资达11亿美元

由前OpenAI研究员、xAI联合创始人伊戈尔·巴布什金创立的AI初创公司River AI宣布,在成立约两个月后完成总额11亿美元的种子轮及A轮融资。此轮融资由General Catalyst和AMP PBC共同领投,英伟达、AMD Ventures、Y Combinator及淡马锡等参与投资。公司提供开放模型API,开发者可借助强化学习和LoRA进行定制;同时推出面向企业的neocloud服务,

长安汽车与华为签署战略合作框架协议,聚焦人工智能与汽车技术

中国长安汽车集团与华为在深圳签署战略合作框架协议。双方将探索人工智能产品与应用场景、通用及汽车垂直大模型、数字化底座、算力以及软硬件等领域的合作,并在数字能源、国际化和数智化人才培养方面加强协作。目前协议主要明确合作方向,尚未公布具体产品、模型或落地时间表。

2026中国算力大会将于9月11日至13日在河北廊坊举行

2026中国算力大会将于9月11日至13日在河北省廊坊市举行,主题涵盖算力基础设施、核心技术、行业应用和产业生态建设。大会将首次举办算力首创首发发布会,集中展示国产算力芯片、智能体、绿色算力等软硬件产品。围绕人工智能、具身智能、算电协同、太空算力和Token新经济等议题,大会还将举办10余场专题论坛。同期举行的“算力中国·AI与算力产业展览会”将免费向公众开放。大会由中国相关部门与地方政府共同主办

DistilVDR:通过双学生蒸馏实现的紧凑型端到端视觉文档检索器

DistilVDR 是一个拥有 5.24 亿参数的视觉文档检索系统,由一个 80 亿参数的视觉语言模型蒸馏而来。其非对称编码器将更多视觉处理能力集中在文档端,同时保持较小的查询编码器,并且无需相关性标注或负样本采样。HiRes 版本在 ViDoRe v1 至 v3 上取得 61.74 的平均 NDCG@5,达到教师模型性能的 86.9%。两个版本生成的索引都明显更小,为一百万份文档建立索引的速度约