智能引擎-大模型训练基础架构研发工程师/高级专家-AI Infra
岗位描述:1. 超大规模训练架构:负责百亿至万亿参数模型的分布式训练架构设计与演进。针对数千卡 GPU 互联场景,通过自顶向下的性能分析,利用 5D 并行以及通信优化策略,消除大规模分布式训练瓶颈,提升训练效率和线性加速比。 2. 极致性能优化与算子开发:深入软硬协同层,通过手写 CUDA / Triton ;任职要求:1. 工程与算法基础:计算机相关专业背景,有极佳的工程实现能力,精通 C/C++ 与 Python;具备扎实的数据结构与算法功底,熟练掌握 GDB / Nsight 等调试与性能分析工具。 2. 大规模分布式经验:有大规模分布式系统开发和优化经验。对现代 GP
