摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第十四篇,看看horovod 如何动态发现节点 和 处理状态信息。 阅读全文
posted @ 2021-07-14 19:18
罗西的思考
阅读(850)
评论(1)
推荐(0)
摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第十三篇,看看 horovod 弹性实现中 的 Driver 角色。 阅读全文
posted @ 2021-07-12 19:43
罗西的思考
阅读(894)
评论(0)
推荐(0)
摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第十二篇,看看horovod 如何实施弹性训练。 阅读全文
posted @ 2021-07-09 21:02
罗西的思考
阅读(1531)
评论(2)
推荐(0)
摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本系列将通过源码分析来带领大家了解 Horovod。本文是系列第十一篇,看看horovod 如何运行在 spark 之上(GLOO实现)。 阅读全文
posted @ 2021-07-07 19:22
罗西的思考
阅读(802)
评论(0)
推荐(0)
摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本文是系列第十篇,看看horovod 如何运行在 spark 之上。 阅读全文
posted @ 2021-07-05 06:25
罗西的思考
阅读(1006)
评论(0)
推荐(0)
摘要:
Horovod 是Uber于2017年发布的一个易于使用的高性能的分布式训练框架,在业界得到了广泛应用。本文是系列第九篇,介绍 horovod on spark 如何启动。 阅读全文
posted @ 2021-07-03 09:01
罗西的思考
阅读(713)
评论(0)
推荐(0)
浙公网安备 33010602011771号