夏威夷时间9月22日9点,高通在2026骁龙峰会上宣布携手阶跃、无量火及江波龙,基于第六代骁龙8超级至尊版移动平台,端侧适配与推理优化阶跃StepEdge-Omni 30B-MoE模型,并现场演示相关智能体助手。
该模型拥有300亿参数,依托混合专家架构,仅根据任务需要激活部分专家模块,以降低计算量和内存带宽需求。合作方通过推理引擎、异构调度及存储方案优化,让模型运行内存需求较行业常规方案降低超过50%,并支持在智能手机上稳定运行。
高通表示,该方案无需调用云端服务,可在本地完成邮件理解、行程规划、日历同步、航班及酒店推荐、行程分享和邮件草拟等任务。测试数据显示,模型预填充吞吐性能超过每秒330个Token,解码吞吐性能超过每秒28个Token。
