具身世界模型与通用VLA大脑架构探索
京东
岗位职责
1. 深入研究具身通用大脑模型,主导具身世界模型或具身VLA(Vision-Language-Action)的前沿技术研发。
2. 开展核心算法设计,包括多模态数据的自动化采集与处理,以及具身模型的全流程预/后训练。
3. 优化并突破具身智能场景下的长时序建模、任务泛化、动作生成与环境交互等核心业务难题。
4. 推动具身智能前沿算法在真实机器人硬件平台上的部署与闭环验证实验。
任职要求
1. 计算机、人工智能、自动化、机器人、电子信息或数学等相关领域的本硕博在校生。
2. 具备扎实的机器学习、深度学习和计算机视觉基础,熟练掌握PyTorch等主流框架及工程落地。
3. 在具身智能、世界模型、VLA、多模态大模型、强化学习或3D空间智能等某一方向具备深入研究积累。
4. 熟悉视觉、语言、动作等多模态信息的建模方法,对感知决策全链路有深刻理解。
5. 能够独立跟踪前沿论文并完成算法复现,有计算机顶会论文或重量级开源项目成果者优先。