蚂蚁开源 SingProbe:以不足 0.5% 额外算力实时拦截大模型生成风险
蚂蚁集团 AI 安全实验室开源了大模型内生式安全护栏技术 SingProbe。该技术不依赖外挂式安全审核,而是复用模型推理过程中的隐藏状态,在不足 0.5% 额外计算开销下进行 token 级实时风险评估。SingProbe 支持意图分类、安全检测和幻觉识别,并可在内容输出前以毫秒级速度阻断风险结果,面向医疗等高风险场景。蚂蚁集团称,该技术已适配 29 个主流大模型,同时发布了开源代码和预训练模型
AI 新闻中心 过去一年分析了 9091 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
蚂蚁集团 AI 安全实验室开源了大模型内生式安全护栏技术 SingProbe。该技术不依赖外挂式安全审核,而是复用模型推理过程中的隐藏状态,在不足 0.5% 额外计算开销下进行 token 级实时风险评估。SingProbe 支持意图分类、安全检测和幻觉识别,并可在内容输出前以毫秒级速度阻断风险结果,面向医疗等高风险场景。蚂蚁集团称,该技术已适配 29 个主流大模型,同时发布了开源代码和预训练模型
英伟达首席执行官黄仁勋在洛杉矶举行的 All-In Summit 上反对放慢人工智能发展速度。活动期间,他与美国总统特朗普现场通话。特朗普表示,美国不会因政治反对或与中国的竞争而放缓人工智能发展,并将继续扩大相关基础设施建设,黄仁勋对此表示认同。此前,Anthropic CEO达里奥·阿莫迪、埃隆·马斯克和山姆·奥特曼都曾支持更谨慎地提升人工智能能力。与此同时,美国社会对数据中心扩张的反对情绪正在
据404 Media调查,OpenAI雇用数百名合同工审核真实ChatGPT用户对话。审核人员据称会对模型回复按1至7分评分,以帮助减少过度奉承和过度拟人化等问题。OpenAI采用匿名化和隐私过滤器,但承认对话仍可能包含敏感个人信息,过滤器也可能误判。“为所有人改进模型”设置默认开启,用户可以关闭;临时聊天不会用于训练。OpenAI至少自2023年起就说明,获授权人员和服务提供商可能为改进服务而查
苹果已向兼容设备推送iOS 27、watchOS 27、iPadOS 27和visionOS 27。延迟已久的Siri AI升级成为四大系统的核心AI功能,目前仅以英语测试版提供。苹果表示,法语、日语、韩语、葡萄牙语和西班牙语支持将于10月推出。visionOS 27为Apple Vision Pro带来完整的Siri AI升级。此外,各系统还更新了界面设计和小组件,新增独立音量控制,并改善运动功
ANZ集团首席执行官努诺·马托斯警告称,与人工智能相关的风险正在上升且难以预测。随着该银行采用快速发展的人工智能技术,他没有排除大规模裁员的可能性。
中国通信企业协会已启动AI-eSIM团体标准编制工作,中国移动、中国联通和中国电信,以及腾讯云、阿里云、火山引擎、京东等企业参与。标准拟规范智能物联终端、空中写卡、身份认证、智能体平台和AI-eSIM运营管理平台等环节的接口定义、交互流程和操作准则。由于目前产业链缺乏统一技术规范,不同厂商之间的产品对接成本较高、互联互通受限,此次标准化旨在改善这些问题。雄安新区还同步成立了AI智能硬件重点实验室,
据未经证实的消息,Anthropic 正在面向部分 Claude Code 用户灰度测试尚未正式发布的 Claude Opus 5.2。部分开发者称,他们从后端模型标识中发现了指向该版本的线索。与此同时,外界还流传 Anthropic 内部的“Model 2”已承担大量代码编写工作,甚至可能替代部分研究职能。Anthropic 尚未正式确认上述说法,因此目前应将其视为传闻,而非已证实的产品发布或组
SemiAnalysis 的 Bryan Shan 表示,在使用 1.6 万亿参数 DeepSeek 模型进行推理测试时,Vera Rubin NVL72 的每兆瓦代币吞吐量最高达到 Blackwell 的 7 倍。这一结果高于英伟达首席执行官黄仁勋此前针对 1 万亿至 3 万亿参数大语言模型提出的 3 倍性能优势估计。相关数据来自分析报告,尚未被证明是经过独立验证的行业基准。
总统唐纳德·特朗普反对对人工智能设置监管限制,这使他与两党中越来越多议员的立场相左。与此同时,在期中选举临近之际,选民对人工智能安全性的担忧加剧了他们对该技术的疑虑。
宏利投资管理多资产解决方案负责人马克·富兰克林表示,近期人工智能股票回调反映的是市场围绕监管防线和开发速度的争论,而不是增长前景遭到结构性破坏。他认为,不断变化的监管框架和开源量子工具将加大对高利润率科技供应商的竞争压力。
“HardFlow”算法有望帮助生成式人工智能模型生成高质量输出,同时遵守严格要求。该方法面向那些仅仅做到“基本正确”仍然不够的应用场景。
据 Business Insider 报道,Instagram 已开始限制部分 AI 修图功能。用户使用 AI 修图达到一定程度后,应用会要求其订阅 Meta One Core,才能继续使用更多 AI 效果;否则只能等到第二天再试。Meta One 于今年 5 月公布,月费为 7.99 美元,提供 Instagram、Facebook 和 WhatsApp 的多项 AI 权益及个性化功能。继 20
一份技术报告提出了 Pelican-Sim 1.0,这是一种根据视觉上下文和机器人动作预测未来观测结果的世界模型,用于支持后续学习和决策。其 28 维统一动作表示可适配多种机器人形态。系统结合渲染动作视频、稀疏混合专家层,以及经过蒸馏的四步生成流程,以提升可控性、视频质量和生成速度。模型使用约 100 万条真实和模拟轨迹进行训练,在多个机器人基准测试中超过了所评估的基线模型。在 RoboTwin
据零售商信息,微星可能为 Claw 8 EX AI+ 游戏掌机推出 CG3M 版本。该机将采用标准英特尔锐炫 G3 平台,搭载锐炫 B370 显示核心,配备 10 个 Xe3 核心,最高频率为 2.2GHz,最高可提供 90 INT8 TOPS。其他配置包括 32GB LPDDR5X 内存、512GB PCIe 4.0 固态硬盘,以及 8 英寸 1920×1200、120Hz、支持 VRR 的显示
社交媒体上的开发者称,Anthropic 疑似已在 Claude Code 中测试 Claude Opus 5.2。根据他们对路由信息的观察,部分请求可能被转发至一个响应更快、能更长时间自主处理复杂编程任务的新模型。文章还介绍了通过“重置哥 Tibo”相关知识进行的非正式测试,用于区分传闻中的模型与网页版。报道进一步声称,Anthropic 内部使用代号“Model 2”的模型编写了公司大部分代码