June 27, 2026 EfficientLLM: Efficiency in Large Language Models 首个全面评估 LLM 效率技术的大规模基准测试,涵盖架构预训练、微调和量化推理 benchmark efficiency llm quantization peft moe attention-mechanism
February 10, 2025 Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile 通过注意力图块化和一致性蒸馏实现视频扩散Transformer 7.4-7.8倍加速推理 video-generation diffusion-models efficiency attention-mechanism distillation