章程瑞东,阿里 Qwen 团队算法工程师,主要工作领域为线性注意力与稀疏注意力的算子-算法联合优化,在 Qwen 3.5 及后续模型的预训练与后训练过程中提供相关 infra 支持。曾就职于微软亚洲研究院,参与稀疏注意力优化算法 MInference(Neurips'24) / MMInference(ICML'25) / MTraining(MLSys'26),上下文窗口拓展算法 LongRoPE(ICML'24)、分布式 LLM 服务系统ParrotServe(OSDI'24) 等,并参与 Phi-3 系列模型研发。近期主导开发了 GDN Chunked-Prefill 优化方案 FlashQLA,在 Qwen 系列混合注意力模型的训练和推理场景下均有显著的加速效果。





