AI 新闻中心

AI 新闻中心 过去24小时分析了 196 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

EM^2Mem:面向大语言模型的事件中心多模态记忆

EM^2Mem 是一种多模态记忆框架,在构建记忆时将长视频中的异构证据绑定到事件锚点。每个按事件索引的记忆单元整合多模态记录、时间上下文、图关联关系、语义事实和来源信息,使语言模型能够直接读取围绕具体事件组织的紧凑证据,而无需在推理阶段从彼此孤立的片段中重建跨模态和时间对应关系。在三个长视频问答基准测试中,EM^2Mem 相比最强的记忆基线,平均准确率分别提升了2.0、2.4和3.7个百分点。事件

小米秋季旗舰新品发布会定档9月7日:新车、18 Fold与玄戒O3 AI芯片将亮相

小米将于9月7日举行秋季旗舰新品发布会,预计发布澎程N70 Pro、N70 Max、N90 Max三款新车,以及小米18 Fold折叠屏手机和小米平板9 Pro Max。手机和平板预计首发搭载玄戒O3,小米将其定位为AI旗舰SoC。官方称,该芯片拥有最高200TOPS张量算力,支持LPDDR6,并配备针对端侧MiMo模型重新设计的NPU。相关性能数据均来自小米官方,尚未见独立验证。新车还将搭载小米

欧盟加强生成式AI监管,要求ChatGPT和Reddit遵守更严格的数字服务规则

欧盟委员会已将OpenAI旗下ChatGPT、Reddit和Roblox列为《数字服务法》(DSA)规定的超大型在线平台。根据公告,这三项服务在欧盟的月活跃用户均超过4500万,因此必须承担额外的监管义务,包括删除非法内容,以及加强对未成年人隐私和安全的保护。若未能遵守规定,企业可能面临最高相当于全球年度营业收入6%的罚款。各公司必须在12月底前完成相关合规措施。这项决定表明,欧盟严格的数字监管正

GUI-CC:评估 GUI 世界模型作为智能体环境的上下文一致性

GUI 世界模型通常被评估为单步预测下一屏幕的模型,但其预期用途是作为 GUI 智能体的多步交互环境。GUI-CC 评估生成状态在反复用于后续交互时能否保持上下文一致性。该基准包含两条赛道:基于真实移动端 GUI 轨迹构建的 500 个离线任务,以及覆盖 30 个应用、经模拟器验证的 200 个在线智能体循环任务。评估指标包括转移保真度、转移合理性、上下文一致性和任务进度。实验表明,单步生成的屏幕

安全措施奏效了。LLM 系统真的更安全吗?

一项研究考察了已部署 LLM 服务中的安全措施是否真正提升了整个系统的安全性。拒答率、攻击成功率和政策违规率等常见指标,只能说明控制措施在受测试请求上的表现,并不能反映攻击者在调整方法或寻找其他入口后,仍能获得多少有害任务帮助。研究使用统一的部署层面标准比较不同类型的安全措施。一次成功的攻击就足以证明有害帮助仍然存在;但较高的局部评测分数,并不能证明剩余的有害帮助很少。要得出这一结论,还需要了解安

显卡价格一个月内上涨15%,RTX 5090越来越接近5090美元

TechSpot全球GPU定价追踪报告显示,截至8月底的一个月内,显卡平均价格上涨15%。剔除价格极端的RTX 5090后,调查覆盖的10个市场显卡售价仍较建议零售价平均高出28%。英伟达GeForce显卡上涨19%,AMD Radeon上涨11%。RTX 5090在美国售价约为5000美元,较1999美元的建议零售价高出145%,全球平均溢价达到136%。GDDR7显存大量调配至AI硬件领域,被

小米 18 Fold 跑分曝光:疑搭载 4.36GHz 玄戒 O3 芯片,起售价约 1.2 万元

型号为 2608BPX34C 的小米手机现身 Geekbench AI,被认为是即将发布的小米 18 Fold 折叠手机。跑分页面显示,玄戒 O3 芯片采用十核全大核 CPU 设计,其中两个超大核心最高频率为 4.36GHz。此前消息还称,该芯片将搭载 16 核 G2-Ultra NX GPU,并支持第三代光线追踪。未经证实的爆料称,小米 18 Fold 全系售价将超过 1 万元,入门版本约为 1

Anthropic发布Fable 5.1,AI模型价格战升温

据报道,Anthropic已发布新一代旗舰模型Fable 5.1,并向拥有相应访问权限的用户提供Mythos 5.1。该公司称,Fable 5.1在多项基准测试中超过上一代Fable 5及竞争产品,并重点提升了处理长时间、复杂智能体任务的能力,适用于编程、研究和知识工作。Anthropic表示,按Token计费的典型工作负载平均成本较上一代降低约25%,高强度智能体任务的成本降幅最高可达45%。不

奥尔特曼不喜欢智能眼镜:与戴摄像头的人交谈让他感到不舒服

OpenAI 首席执行官萨姆·奥尔特曼在播客采访中表示,他不喜欢智能眼镜,因为与佩戴摄像头和灯光设备的人交谈会让他感到不舒服。这意味着,OpenAI 目前似乎没有立即直接进入智能眼镜市场、与 Meta 展开竞争的计划,马克·扎克伯格暂时无需担心。不过,奥尔特曼暗示 OpenAI 正与 Jony Ive 的 LoveFrom 工作室合作开发多款 AI 设备,产品可能分别适合放在桌面、装入口袋或佩戴在

Meta发布首个实时音频感知AI模型,支持20余人分轨转写

Meta推出Muse Voice Transcribe,这是其首个实时音频处理模型。开发者可通过Meta Model API调用,价格为每1000分钟音频3美元。该模型将流式自动语音识别、说话人分离和端点检测整合在同一流程中,可在用户说话时同步输出文字。它能在包含20多名说话人的录音中区分不同发言者,支持超过1小时的音频及句内、句间的自然语言切换。模型训练覆盖70多种语言,发布时已有25种语言完成