AI 新闻中心

AI 新闻中心 过去24小时分析了 199 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

高通展示可在手机上运行的300亿参数AI模型,预填充吞吐量超每秒330个Token

高通在2026年骁龙峰会上宣布,与阶跃、无量火及江波龙合作,基于第六代骁龙8超级至尊版移动平台,对StepEdge-Omni 30B-MoE模型进行端侧适配和推理优化。该混合专家模型仅根据任务需要激活部分专家模块,以降低计算量和内存带宽需求。合作方表示,通过优化推理引擎、异构调度和存储方案,模型运行内存需求较传统方案降低超过50%。模型无需调用云端,即可在手机上完成邮件理解、行程规划、日历同步、航

迈向全流程 FP8 大语言模型强化学习

一项新研究分析了在大语言模型的完整强化学习流程中使用 FP8 所导致的不稳定问题。研究人员发现,累积的 FP8 量化噪声会扭曲重要性比率,并错误地将负优势 Token 的梯度归零,从而引发训练中途熵异常激增和输出乱码,使异常结果不断累积。为解决这一问题,研究提出“Calibrated Clipping”,通过动态调整 FP8 的裁剪范围,使其与高精度 BF16 分布保持一致。在 GRPO、DAPO

高通发布第六代骁龙8至尊超频版:主频超5GHz,GPU性能提升44%

高通在2026骁龙峰会上发布第六代骁龙8至尊超频版和第六代骁龙8至尊版移动平台。两款平台均采用2纳米制程,面向搭载端侧人工智能和智能体人工智能功能的下一代旗舰手机。据高通介绍,至尊超频版最高主频超过5GHz,CPU性能提升13%、能效提升37%、响应速度提升15%;Adreno GPU性能提升44%,能效提升40%。平台还支持AI辅助图形渲染、场景理解和高级影像处理。小米、vivo、红魔、REDM

高通计划将 HBC 架构整合进骁龙芯片,加速手机端 AI 并降低功耗

高通在 2026 骁龙峰会上宣布,未来将把 HBC 技术应用于骁龙芯片。HBC 是 High Bandwidth Compute 的缩写,最初面向数据中心产品。该架构将计算组件放置在堆叠式 LPDDR DRAM 下方,并通过 3D 集成和硅通孔缩短数据传输距离。通过将部分计算移至内存附近,HBC 旨在减少 AI 推理过程中的数据搬运、延迟和内存功耗。对智能手机而言,这可能有助于在本地运行更大、上下

人工智能可能削弱网红影响消费者购买决策的能力

人工智能生成的内容正在侵蚀网络信任,网红可能成为意料之外的受影响群体。消费者越来越依赖社交媒体上的网红推荐,从冬季外套到必备家电都可能参考他们的购买建议。然而,随着人工智能普及,真实的个人意见与人工生成或带有商业目的的内容更难区分,网红的影响力可能因此下降。

感知型智能的鸿沟

文章认为,人工智能虽然能够整合并扩展人类提供的想法,却无法自行发现人类直觉和意义建构能力所捕捉到的根本问题。文章引用企业领导者的经历指出,重要决策有时并非基于明确的逻辑或理由,而是受到一种难以解释的直觉驱动。

衡量 AI 项目投资回报率的 20 种方法

人工智能的应用正在快速推进,但部署速度更快并不意味着能立即获得投资回报。企业不应仅根据采用率、速度和试验数量来评估 AI 的价值,而应明确业务目标并建立可量化的指标。可关注的指标包括生产率提升、成本降低、收入增长、质量改善、风险降低以及对客户的影响。若缺乏具体目标和衡量方案,AI 投资可能只是增加了活动和讨论,却无法带来可验证的实际业务成果。