【PyTorch】分散学習(DDP/FSDP)の仕組みと実装 2026年6月27日 Transformer GPT-4 や LLaMA-3 といった大規模言語モデルを、なぜ「数千基のGPU... DDPFSDP分散学習大規模モデル深層学習
【大規模モデル】Tensor/Pipeline並列化の理論と実装 2026年6月7日 Transformer 大規模言語モデル(LLM)は数十億から数千億のパラメータを持ち、単一のGPUメモ... LLMPipeline並列Tensor並列モデル並列化分散学習深層学習