欢迎光临
我们一直在努力

LLM并行训练7-混合并行总结

如果靠脑补来调整这些参数, 会存在一个非常巨大的搜索空间, 很难找到最优于计算效率的方法, 所以需要先通过理论分析确定各个参数的大致范围. 最后再通过有限次尝试找到较优的方案. 本章参考nvidia的调参实践GTC演讲, 结合GPT3训练例子对如何调整并行策略进行总结

赞(0)
未经允许不得转载:小狮博客 » LLM并行训练7-混合并行总结
分享到: 更多 (0)