昇腾助力中科大团队实现MoE 稀疏大模型并行推理提速超30%
来源:青橘网 发表于2025-08-20 17:49:06 编辑:沫晓朵
摘要: 随着人工智能技术的飞速发展,大模型参数量激增。MoE 稀疏大模型因能在提升容量的同时保持训练计算量,成为了当下的研究热点,但推理时的性能瓶颈仍

  随着人工智能技术的飞速发展,大模型参数量激增。MoE 稀疏大模型因能在提升容量的同时保持训练计算量,成为了当下的研究热点,但推理时的性能瓶颈仍制约着其进一步发展。在此背景下,中国科学技术大学人工智能与数据科学学院执行院长张燕咏率领团队,在中国科学技术大学 鲲鹏昇腾科教创新卓越中心的算力支持下,成功研发出了基于专家选择分布预测的专家负载均衡和all2all通信均衡框架。

  该框架的研究致力于解决两大难题——专家负载不均及较大的计算通信开销,并通过“三步走”成功实现了推理性能的优化。为了让模型在并行推理时能更合理地分配资源,团队首先从专家选择的规律入手,通过分析相似 token 在 MoE 层选择专家的特征并归类,成功预测出token的专家选择路径偏好。

  接着便是解决推理过程中的专家负载不均衡问题。团队依据token对专家选择偏好的预测结果,精准判断出专家动态访问的频率和重要性,通过复制高频专家、替换非重要专家的方式实现了负载平衡。其中昇腾推理引擎MindIE提供的性能分析工具可实现性能数据的可视化,在实时监测专家负载、统计访问频率等方面提供数据参考,发挥了重要作用。

  降低分布式计算的通信时延是第三步。团队根据计算节点上的数据对专家选择的预测结果,将专家提前部署到对应的节点上,并联合需要紧密协作的专家放在同一计算单元,让数据与所需专家在物理位置上更接近,同时结合昇腾384超节点采用的高速总线互联技术,最终大幅降低了跨节点和跨计算单元的通信消耗。

  在系列技术突破下,此次项目成果显著。基于该创新框架,在多尺寸、多结构的 MoE 模型中,推理时间、all2all 时间、MoE 层时间及负载不均分数较现有主流方案提升超 30%;多卡复杂场景里,前三项指标提升 30%,推理时间提升 20%。

  本次项目的成果,为开发者借助昇腾技术优化 MoE 稀疏大模型推理性能提供了可贵借鉴,将加速其在各领域的落地应用。未来,中国科学技术大学 鲲鹏昇腾科教创新卓越中心将持续深化产学研协同创新,依托昇腾软硬件平台,在前沿AI模型优化领域持续突破,为自主创新人工智能战略与数字经济发展贡献力量。

投稿邮箱:qingjuedu@163.com
相关推荐
这不对劲儿!教育各家AI功能越来越像了
这不对劲儿!教育各家AI功能越来越像了

来源| 作者|TCOH 编者按: 本文为约稿。作者TCOH为教育行业资深从业者。 过去一

快资讯31分钟前

剥离教育等业务后,奇梦岛2026财年Q1靠潮玩实现1.27亿元
剥离教育等业务后,奇梦岛2026财年Q1靠潮玩实现1.27亿元

12月4日消息,近日,奇梦岛(NASDAQ:HERE,量子之歌前身)披露了2026财年第一季度

快资讯8小时前

国内首款AI助盲眼镜发布,可实现避障、找物读物、语
国内首款AI助盲眼镜发布,可实现避障、找物读物、语

12月4日消息,杭州瞳行科技公司于本周正式发布国内首款AI助盲眼镜。 据介绍,

快资讯8小时前

乐队鼓手创办的职业规划平台融资500万美元,已服务
乐队鼓手创办的职业规划平台融资500万美元,已服务

12月4日消息,一体化职业规划平台Find Your Grind宣布完成500万美元A轮融资,本轮

快资讯8小时前

清华大学具身智能与机器人研究院成立,挂靠科研院
清华大学具身智能与机器人研究院成立,挂靠科研院

12月3日消息,11月30日,清华大学具身智能与机器人研究院成立。 清华大学校长

快资讯2025-12-03 22:31:11

可灵AI发布“可灵O1”:整合文本、图像、音频等模态
可灵AI发布“可灵O1”:整合文本、图像、音频等模态

12月3日消息, 快手旗下可灵AI正式发布可灵O1,该产品定位为大一统的多模态创

快资讯2025-12-03 22:31:01

得力上海品牌旗舰店启幕:以“超级体验”重塑文具行
得力上海品牌旗舰店启幕:以“超级体验”重塑文具行

2025年11月29日,得力上海品牌旗舰店(deli world)在上海静安大悦城盛大开业。这家

快资讯2025-12-03 17:56:06

2025"燃•朗文少年"青少年英语口语演讲活动圆满收官
2025"燃•朗文少年"青少年英语口语演讲活动圆满收官

六强少年闪耀北京舞台,中国印尼跨国联动呈现AI时代的未来表达力 由全球教育

快资讯2025-12-03 15:25:32

千问接入“阿里最强学习大模型”:拍题更准、讲题更
千问接入“阿里最强学习大模型”:拍题更准、讲题更

12月3日消息,阿里千问面向学习场景发布拍题答疑、作业批改两项重要更新。通

快资讯2025-12-03 14:31:10

首款“豆包AI手机”售罄,二手平台最高加价1500元
首款“豆包AI手机”售罄,二手平台最高加价1500元

12月3日消息,首款搭载豆包手机助手的手机产品努比亚M153目前已在中兴商城售

快资讯2025-12-03 14:31:01