HirePortal

大模型训练框架工程师(训练框架 & RL 方向)

  • MiniMax
  • Shanghai, Beijing, China
  • CNY 600,000 – CNY 1,200,000

大模型训练框架工程师(训练框架 & RL 方向)

北京、上海社招全职研发 - 算法

职位描述

  1. 训练一个顶尖的大模型,需要的不只是算法——它需要一套从集群调度到通信优化、从并行策略到 RL 训练流水线的完整系统工程。模型能力的上限,往往卡在基础设施的某个角落,我们做的事,就是把那个角落找出来,把它打通。
  2. 我们有两个方向:训练框架,解决万卡集群上的效率与稳定性;RL 框架 Forge,是 MiniMax 自研的强化学习训练系统,在业界已有广泛的技术影响力。两个方向的共同工作方式是:和算法团队从架构设计阶段就一起做,而不是等方案定了再来实现。 我们希望你在某个领域有真正的深度——分布式系统、GPU 性能优化、RL 工程、推理加速,都行——同时对算法前沿保持真实的好奇心。你不需要什么都懂,但你应该知道自己不懂的东西在哪,并且想去弄懂它;

职位要求

基本要求

  1. 编程能力扎实,有清晰的系统设计思路,有强烈的工程品味和责任心;
  2. 对 AI 训练系统或 RL 工程某一方向有深入理解,能独立发现问题、提出方案并推动落地;
  3. 主动追踪算法与系统前沿,能将论文洞见转化为工程判断; 加分项:
  4. 对主流开源框架(PyTorch、Megatron-LM、SGLang 等)有深入了解,并有实质性贡献
  5. 有万卡规模训练系统或大规模 RLHF/RLVR 工程的实战经验

投递

Skills

  • PyTorch
  • Megatron-LM
  • GPU
  • SGLang

Related jobs

MiniMaxApply for this job