AI 新闻中心

AI 新闻中心 过去30天分析了 1025 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

数据中心扩张在硅谷最大城市圣何塞也遭遇民众反对

圣何塞计划引入更多数据中心,打造人工智能基础设施中心,但居民和环保组织正组织反对。批评者担心数据中心消耗大量电力和水资源,可能带来污染,并影响居民健康和生活质量。当地估算,每座新数据中心每年可贡献 300 万至 600 万美元税收,用于警务、消防、图书馆、道路和公园等公共服务。居民要求在批准更多项目之前进行更严格的公众审查,透明披露能源和用水情况,并评估环境与健康影响。柴油备用发电机的监管也成为争

内存墙的另一半:通过训练式路由预测从 SSD 运行 35B MoE

Edge0 是一款流式推理引擎,旨在让混合专家模型在消费级硬件上运行。经过训练的预路由器会提前一个 token 预测下一层将选择的专家,使所需权重能够从 SSD 预先读取,并与计算过程重叠。未合并的恢复 LoRA 用于弥补 int4 量化和替换原有路由造成的质量损失。在一台配备 24GB 内存的机器上,Edge0 可让 35B MoE 模型以每秒 20 个 token 的速度运行,峰值活动内存仅为

新报告称 AI 电子垃圾规模被严重低估,到 2050 年或可绕地球六圈

巴塞尔行动网络(BAN)发布新报告警告,AI 热潮产生的电子垃圾远超以往估计。到 2050 年,这些垃圾可能装满 2300 万个货运集装箱;若以 12.2 米集装箱首尾相连,长度足以绕地球六圈。过去研究多关注服务器和 GPU,BAN 则纳入供电与配电、冷却、备用电源和网络设备,约占总数据中心机电基础设施的 87%。BAN 创始人吉姆·帕克特表示,每个 AI 模型都依赖高度专业化的尖端硬件,呼吁政府

三星推出 zHBM 内存规划:旨在将 AI 响应速度提升 10 倍

在 AI 基础设施峰会上,三星电子展示了其下一代 AI 内存 zHBM 的路线图。该技术将 HBM 直接垂直堆叠在 AI 加速器上,旨在将对话式 AI 的处理速度从每秒 100 个 token 提升至 1000 个 token。三星表示,该设计性能可达 HBM5 的 8 倍,能效提升 3 倍。此外,来自 OpenAI 和英特尔的行业专家对 CXL 技术替代 HBM 用于模型运行的前景表示质疑,认为

IDC:今年第二季度全球智能眼镜出货量增长35.3%

IDC数据显示,2026年第二季度全球智能眼镜出货量达到354.7万台,同比增长35.3%。音频及拍摄类眼镜是主要增长动力,出货249.4万台,同比增长54%;AR/ER眼镜出货50.5万台,同比增长75.7%;VR/MR头显出货54.8万台,同比下降23.3%。2026年上半年全球累计出货711.4万台。Meta凭借音频智能眼镜保持市场领先,行业竞争重点正从单纯的硬件出货量转向生态系统和AI体验

“双百”里程碑:鸿蒙智行问界汽车累计辅助驾驶里程达成100亿公里、活跃用户增至100万名

赛力斯与华为在鸿蒙智行体系下共同打造的高端智慧电动车品牌问界(AITO)宣布达成“双百”里程碑:累计辅助驾驶里程达100亿公里,辅助驾驶活跃用户达100万名。品牌自2021年12月以问界M5起步,现有M5、M6、M7、M8、M9等车型。2023年12月发布的M9搭载华为全栈技术方案与高阶智能驾驶,连续20个月稳居50万级车型销冠。2025年4月上市的M8首批搭载HUAWEI ADS 4,配备192

智谱 GLM 公布国内首个递归自我改进生产实践

智谱 GLM 团队披露了递归自我改进(RSI)在生产环境中的应用案例。由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试和优化。在超过 10 万张国产芯片组成的集群上,该系统不到两周便从零搭建生产级推理服务。智谱称,端到端吞吐量提升至初始基线的 3 倍,硬件利用效率和单 Token 成本达到主流 NVIDIA GPU 系统的相近水平。该

夏普与富士康合作推出 AI 服务器,搭载英伟达 Blackwell 与 Rubin GPU

夏普宣布与富士康合作进军 AI 服务器市场,计划于 2027 年开始销售,面向企业、政府和研究机构。产品包括两款:一款是企业级模块化服务器,最多支持 8 块 NVIDIA RTX PRO 6000 Blackwell GPU 及双路英特尔至强 6 处理器;另一款是专为大模型训练与推理设计的液冷服务器,搭载 NVIDIA HGX Rubin NVL8、ConnectX-9 及 BlueField-4

冰岛初创公司 Treble 完成 1800 万美元 A 轮扩展融资

冰岛初创公司 Treble 完成了由 Paladin Capital Group 领投的 1800 万美元 A 轮扩展融资,KOMPAS VC、Frumtak Ventures、EIC 和 Omega ehf 等现有投资者参与跟投。加上 2024 年获得的 1200 万美元投资,Treble 累计融资额已超过 4000 万美元。公司正在开发面向语音 AI 的仿真与数据生成平台,用于生成合成数据、在

马斯克住进孟菲斯房车,亲自监督 xAI 新数据中心建设

据《财富》杂志报道,埃隆·马斯克目前住在孟菲斯的一辆 Airstream 房车内,以亲自监督 xAI 新数据中心的建设。该设施建成后预计将提供大量算力。据称,xAI 还已与谷歌和 Anthropic 达成协议,将以数十亿美元的规模向两家公司提供多余算力。报道还回顾了马斯克过去在公司关键阶段睡在办公室或工厂的习惯。

消除长上下文混合专家训练中的每个内存峰值

研究人员提出针对长上下文混合专家(MoE)模型训练的内存优化技术。以往只要任一组件峰值内存超过设备内存,训练就会失败。研究识别出四个瓶颈:专家分发、词汇投影、梯度检查点边界和优化器状态。PipelinedLLEP、Ring-DTP、选择性检查点卸载(SCO)和 OffloadStreamAdamW 以固定 GPU 工作集限制这四者。这些方法仅改变计算顺序和粒度,因此损失和梯度保持精确。测试显示,M