北京InternshipEntry-levelPosted Today
AI院-RL Infra 强化学习框架-实习生北京实习互联网 / 电子 / 网游 - 研发职位描述1. 负责强化学习训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率
2. 分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性
3. 跟进业界技术进展,不断同步与集成最新训练优化策略职位要求1. 硕士及以上学历,计算机相关专业,HPC&MLSys 相关研究领域
2. 对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 模型架构,有分布式训练经验
3. 对常见 RL 训练算法有基本了解
加分项:熟悉 vllm 或 sglang 等常用开源推理框架投递
