← Papers

Efficient large-scale language model training on GPU clusters using megatron-LM

ACM:3458817.3476209 · 1 repo reference this paper in their README