Splitting individual layers of a model across multiple GPUs so each GPU computes part of every layer, enabling models too large for a single GPU's memory.
Splitting individual model layers across multiple GPUs so each computes part of every layer.
Splitting individual layers of a model across multiple GPUs so each GPU computes part of every layer, enabling models too large for a single GPU's memory.