ESC

Type to search articles...

No articles found.

↑ ↓ Navigate ↵ Open
Esc Close
Blog Tags GitHub
All tags

parallelism-cp

4 posts tagged with "parallelism-cp"

July 3, 2026

Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP

块级粒度的灵活上下文并行范式,通过任意点对点通信 + bin-packing 调度,在 256 张 NVIDIA GPU 上实现近线性扩展,attention MFU 提升 1.13x–2.21x

parallelism-cp distributed-training long-context efficient-attention load-balancing communication llm-training
June 3, 2026

分布式并行训练必读经典论文

覆盖并行策略、序列并行、MoE并行、内存优化、通信优化、容错与系统框架

distributed-training communication parallelism-sp parallelism-cp parallelism-dp parallelism-pp parallelism-tp
May 27, 2026

ByteScale: Efficient Scaling of LLM Training with a 2048K Context Length on

ByteScale:在超过 12,000 GPU 上高效扩展 2048K 上下文 LLM 训练

communication long-context parallelism-sp parallelism-cp parallelism-dp parallelism-tp
June 20, 2025

Scaling Llama 3 Training with Efficient Parallelism Strategies

Llama 3 405B 模型在 16K H100 GPU 上的四维并行训练系统设计,涵盖灵活流水线并行、上下文并行、大规模调试方法及硬件建议

distributed-training llm-inference parallelism-sp parallelism-cp parallelism-dp parallelism-pp parallelism-tp

Navigation

  • Work

Resources

  • Lexington Themes.

Socials

  • @Mike_Andreuzza
© 2025 MicroStudio. All rights reserved.

MicroStudio is not affiliated with Stripe, Breeew, Astro, or Tailwind Labs, nor is it endorsed or sponsored by them.