26届校招-AI院-强化学习训练框架工程师 北京 正式 互联网 / 电子 / 网游 - 研发 职位描述 1. 负责强化学习训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率;2. 分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性;3. 跟进业界技术进展,不断同步与集成最新训练优化策略。 职位要求 1. 26年应届生,硕士及以上学历,计算机相关专业,HPC&MLSys 相关研究领域;2. 对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 模型架构,有分布式训练经验;3. 对常见RL训练算法有基本了解;【加分项】1. 熟悉vllm或sglang等常用开源推理框架。更多信息:团队工作介绍【GLM-4.6: Advanced Agentic, Reasoning and Coding Capabilies】We are releasing the latest version of