具身Infra工程师-Seed Robotics
字节跳动
岗位职责
1、负责搭建千卡级GPU集群,支持Word Action Model、VLA等多模态大模型的分布式训练;优化长序列Transformer、扩散策略(Diffusion Policy)在异构集群上的计算与通信效率;
2、负责设计支持GPU并行仿真与策略推理的RL训练框架(如Isaac Gym、MuJoCo MJX、Enigma等);实现大规模仿真到真实(Sim2Real)的训练回旋体系,支持域随机化与真实数据混合重放;优化PPO、SAC、TD-MPC等算法在仿真环境中的采样效率,提升每秒交互步数(SPS);
3、负责研发机器人端侧(Orin、x86实时系统)的高效推理引擎,支持流式VLA模型极低延迟推理;设计模型量化、稀疏化、算子融合策略,平衡推理速度与成功率;构建云端-边端协同推理架构,支持复杂任务拆解与大模型委派执行。
任职要求
1、本科及以上学历,计算机、自动化、机器人等相关领域,3年以上AI Infra或高性能计算经验;
2、精通Python与C++编程语言,具备CUDA编程与性能调优经验;
3、熟悉Megatron、DeepSpeed等分布式训练框架,有千亿参数模型或多模态模型训练调优实战经验;
4、理解PPO等主流强化学习算法,至少使用过RLLib、SampleFactory或Isaac Gym等任一强化学习框架;
5、熟练使用TensorRT、TVM、OpenXLA之一,有端侧模型部署落地经历;
6、了解Isaac Sim、MuJoCo、Gazebo等常用物理仿真环境,能搭建并行仿真训练闭环。
加分项
1、有机器人真机部署经验(机械臂、足式机器人或移动底盘);
2、参与过开源具身智能项目;
3、熟悉NVIDIA GPU编程;
4、熟悉大模型推理和Diffusion/FlowMachting相关的推理框架。