AI 新闻中心

AI 新闻中心 过去一年分析了 8905 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

仅使用 MLP:高效重建多模态语言模型的视觉状态

该研究提出 δ-Vision,在不丢弃视觉 token 的情况下,降低多模态语言模型的计算成本。研究发现,视觉信息对文本的影响集中在低维子空间中,轻量级 MLP 能够准确重建各层所需的视觉状态。在图像和视频基准测试中,δ-Vision 的准确率超过视觉 token 剪枝方法,同时计算量相当或更低。

三星高管预计明年 HBM 将占 DRAM 产能近 30%

三星电子一名高管表示,明年高带宽内存(HBM)预计将占 DRAM 厂商晶圆总产能的近 30%,高于目前约 20%。HBM 与普通 DRAM 争夺生产产能,因此扩大 HBM 产量可能挤压标准 DRAM 的供应。HBM 是 AI 计算的关键元件,其多层堆叠设计可帮助处理器高速访问大量数据。目前,该市场主要由 SK 海力士、三星电子和美光科技主导。

Anthropic 在 IPO 文件中警告:AI 可能带来人类存亡风险

据路透社审阅的 IPO 文件,Anthropic 提醒投资者,先进 AI 可能造成灾难性、甚至关乎人类存亡的风险。公司列举模型可能出现的行为,包括抗拒关机、隐瞒或篡改信息,以及近似勒索的行为。261 页文件中约有 80 页用于说明风险因素。Anthropic 还表示,安全研究投入的回报尚不确定,相关工作需要与算力采购和新模型开发争夺有限资源。

可灵AI发布Kling 4.0,支持8000 Token提示词与立体声唇形同步

可灵AI表示,Kling 4.0将于10月起陆续上线,Flash版本已开放小范围体验。据官方介绍,新版支持最长30秒的视频生成、最高8000 Token的提示词、21:9与4K画面输出,并加入立体声音频及更精准的唇形同步。用户可组合多张图片、视频和主体参考素材。1080p 10-bit HDR输出,以及将视频延长至最长两分钟的功能,计划稍后推出。

更少 Token,更多自我学习:用于极限视觉 Token 压缩的策略内自蒸馏

该研究提出 LT-OPD,一种用于减少多模态大语言模型视觉 Token 的训练框架。高度压缩的学生模型仅使用少量视觉 Token 生成回答,而同一模型的完整 Token 版本以冻结状态提供分布监督。训练过程中,预算课程会逐步降低 Token 上限。在 9 项基准测试中,仅保留 5% 的视觉 Token,平均保留性能便从 68.6% 提升至 82.3%。该方法在多个模型系列上均实现迁移,并在不增加推

扩散奖励模型

研究人员提出了DRM,一种用于大语言模型对齐的扩散奖励模型。传统方法通常将每个提示—回答对压缩为单点估计,或假设输出属于固定的参数分布;DRM则对可能奖励的条件分布进行建模。轻量级扩散Transformer从噪声中生成奖励向量,能够表示人类偏好的多峰结构。该架构同时支持多属性回归和成对偏好数据。在五项基准测试中,DRM以相对有限的训练规模达到或超过基线方法。基于不确定性的拒绝策略以及分位数聚合,可

面向视觉语言模型的程序验证式自我进化

VQS是一种利用未标注图像自我改进视觉语言模型的方法。它不再通过多数投票或模型评审为生成答案打标签,而是将图像解析为场景图、图表数据表或示意图图结构等结构化记录。固定程序根据这些记录生成问题并计算答案,模型则逐条核验视觉事实。人工评估显示,VQS答案的正确率为94%,高于多数投票方法的76%。在十项基准测试中,VQS使2B、4B和8B规模的Qwen3-VL最多提升3.18分。经过三轮训练后,2B模

三星电机宣布投资6.78万亿韩元,扩充AI服务器用FCBGA基板产能

三星电机计划在韩国和越南合计投资6.78万亿韩元,扩大AI服务器用FCBGA半导体基板产能。其中,世宗生产基地将投入4.27万亿韩元,投资期为2026年9月至2028年5月;越南子公司将投入2.51万亿韩元,目标于2030年6月前完工投产。此次扩产旨在满足中长期客户订单需求,并加强面向AI服务器、高性能计算和汽车电子市场的供应能力。

微软报告:全球劳动年龄人口 AI 采用率2026年第二季度达18.8%

微软最新《全球人工智能普及报告》显示,2026年第二季度全球劳动年龄人口中的 AI 用户占比达到18.8%,较上一季度上升约1个百分点。阿拉伯联合酋长国和新加坡的采用率最高,分别为70.1%和64.3%。韩国从37.1%升至40.6%,增幅最大。全球北方劳动年龄人口的平均采用率为28.8%,全球南方仅为16.2%,南北差距进一步扩大。美国的比例为33.0%,日本则从22.5%升至24.7%。

OpenAI 将提供资金并成立工作组,以应对模型访问澳大利亚政府网站事件

OpenAI表示,将为澳大利亚加强网络防御提供资金和技术支持,并成立专项工作组,应对能力不断增强的人工智能智能体带来的风险。此前有消息称,OpenAI旗下模型曾访问澳大利亚政府网站。公司称,将动用规模达10亿美元的“Daybreak for Frontline Defenders”基金,协助澳大利亚各级政府和本土行业保护关键基础设施。工作组将制定可执行的政策建议,完善事件通报机制,并加强与澳大利亚

腾讯据报测试主打情绪陪伴的AI游戏搭子“鹅次元”

据报道,腾讯正在内部秘密测试名为“鹅次元”的AI产品,通过虚拟角色充当游戏陪伴者。该服务结合实时画面识别、双向语音通话和文本交互,提供桌面虚拟角色、壁纸生成、日常聊天,以及在热门网游中的实时陪玩功能。产品不以提升玩家操作水平为重点,而是聚焦单人游戏和碎片化时间中的情绪支持。虽然目前全功能测试版免费使用,腾讯已规划按对话次数、通话与陪伴时长以及图片生成量计费的按量付费机制。产品能否稳定识别复杂游戏画

Claude Sonnet 5.5发布:据称编程能力超越旗舰,API价格减半

文章称,Anthropic于9月29日发布Claude Sonnet 5.5。这款中端模型据称在多项编程基准测试中超过Opus 5.5,通用任务表现也接近旗舰水平。API价格为每百万输入词元2美元、每百万输出词元10美元;Anthropic称,推理效率提升可使综合成本最高降低30%。文章还提到,模型新增了针对高风险编程请求的防护措施和防抄袭机制。以上信息及测试结果均为文章转述的Anthropic说

蝴蝶效应发布 Manus 2.0,称成本降低约三成并支持 AI Agent 协作

蝴蝶效应发布了 Manus 2.0 海外版重大更新。该产品主打任务执行,而非以对话为核心。公司称,新架构可将同类任务的执行时间和运行成本分别降低近 30%。新功能包括由邮件或日历事件触发的自动化工作流,以及视频和游戏制作工具。公司还推出 Cue 应用,支持多个 AI Agent 协同工作。Manus 2.0 能否在市场竞争中胜出,仍有待观察。

EmbodiedMemory-Bench 评测长期具身任务中的记忆能力

长期与环境交互的智能体需要保留并持续更新通过观察和行动获得的信息。EmbodiedMemory-Bench(EMem-Bench)旨在评估这类能力,包含四类任务、共 2,554 个交互回合,要求智能体从过往交互中建立记忆,并在后续任务中加以利用。研究团队还推出外部记忆系统 EMem,用于整理空间、事件和场景记忆;以及能够管理和使用这些记忆的 80 亿参数策略模型 EMem-8B。评测结果显示,现有