Tensor Parallelism

AI and Machine Learning · Distributed Training · 2019 · tensor-parallelism.yaml

Splits individual weight matrices across devices so one layer is computed jointly. Communication lands inside every layer, so it wants the fastest interconnect available.

Colour is the family; a dashed line is the second member of it.

Drag to pan · scroll to zoom · click a node to open it
G data-parallelism Data Parallelism pipeline-parallelism Pipeline Parallelism tensor-parallelism Tensor Parallelism pipeline-parallelism->tensor-parallelism splits between layers rather than inside one tensor-parallelism->data-parallelism one replica of the model must still fit on one device

This node

Referenced by

References