原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/1/006/008.htm
立即前往原文

高通展示可在手机上运行的300亿参数AI模型,预填充吞吐量超每秒330个Token

高通在2026年骁龙峰会上宣布,与阶跃、无量火及江波龙合作,基于第六代骁龙8超级至尊版移动平台,对StepEdge-Omni 30B-MoE模型进行端侧适配和推理优化。该混合专家模型仅根据任务需要激活部分专家模块,以降低计算量和内存带宽需求。合作方表示,通过优化推理引擎、异构调度和存储方案,模型运行内存需求较传统方案降低超过50%。模型无需调用云端,即可在手机上完成邮件理解、行程规划、日历同步、航班和酒店推荐以及邮件撰写等任务。测试显示,其预填充吞吐量超过每秒330个Token,解码吞吐量超过每秒28个Token。大规模应用仍取决于终端成本、功耗、模型可靠性和用户接受度。
行业资讯 应用 硬件 行业新闻 科技巨头 AI模型 2026-09-23 05:00:08 653 阅读 阅读约 1 分钟 来源:IT之家
本文来源:IT之家,仅供学习参考,版权归原作者所有。