摘要: 在 PyTorch DataParallel 训练过程中,其会在多个GPU之上复制模型副本,然后才开始训练。笔者在分析过程中,发现如果不把一些GPU相关基础知识整理出来,很难理解DataParallel的这个复制模型的过程,遂有此文。 阅读全文
posted @ 2021-11-07 09:14 罗西的思考 阅读(7172) 评论(2) 推荐(1)