北京时间2026年9月23日3时,高通在夏威夷举办的2026骁龙峰会上宣布,携手阶跃、无量火及江波龙,基于第六代骁龙8超级至尊版平台,完成StepEdge-Omni 30B-MoE模型的端侧适配与推理优化。该模型采用混合专家架构,仅激活所需专家模块,内存需求较常规方案降低超50%,支持本地运行邮件理解、行程规划等全场景智能体任务。预填充吞吐达330 token/s,解码吞吐达28 token/s。无需云端依赖,兼顾低时延与隐私保护。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。
北京时间2026年9月23日3时,高通在夏威夷举办的2026骁龙峰会上宣布,携手阶跃、无量火及江波龙,基于第六代骁龙8超级至尊版平台,完成StepEdge-Omni 30B-MoE模型的端侧适配与推理优化。该模型采用混合专家架构,仅激活所需专家模块,内存需求较常规方案降低超50%,支持本地运行邮件理解、行程规划等全场景智能体任务。预填充吞吐达330 token/s,解码吞吐达28 token/s。无需云端依赖,兼顾低时延与隐私保护。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。