开发者社区> 问答> 正文

为了应对当前分布式训练的挑战,阿里云机器学习PAI团队自主研发了什么训练框架?

为了应对当前分布式训练的挑战,阿里云机器学习PAI团队自主研发了什么训练框架?

展开
收起
罗鹏大佬 2022-04-20 10:44:56 3262 0
来自:阿里技术
1 条回答
写回答
取消 提交回答
  • 阿里云机器学习PAI团队自主研发了分布式训练框架EPL,将不同并行化策略进行统一抽象、封装,在一套分布式训练框架中支持多种并行策略。同时,EPL提供简洁易用的接口,用户只需添加几行annotation(注释)即可完成并行策略的配置,不需要改动模型代码。EPL也可以在用户无感的情况下,通过进行显存、计算、通信等全方位优化,打造高效的分布式训练框架。

    2022-04-20 13:26:45
    赞同 展开评论 打赏
来源圈子
更多
收录在圈子:
+ 订阅
问答排行榜
最热
最新

相关电子书

更多
大规模机器学习在蚂蚁+阿里的应用 立即下载
阿里巴巴机器学习平台AI 立即下载
微博机器学习平台架构和实践 立即下载