大模型高效推理与端云协同架构研发
京东
岗位职责
1. 聚焦新一代大模型显存优化与KV Cache存储优化,突破超长序列推理瓶颈。
2. 研发基于编译优化的高效执行引擎,提升软硬件一体的计算效能。
3. 开展面向高效推理的大模型结构优化与多模态大模型Cache机制研究。
4. 研发新一代生成式推荐推理优化体系,以及基于强化学习(RL)的智能大模型推理服务框架。
5. 探索高效端侧推理优化技术与端云协同部署机制,推动各项推理优化前沿技术在业务场景中的落地。
任职要求
1. 计算机科学、电子工程、人工智能或相关领域的本硕博在校生。
2. 在大模型推理、自然语言处理、计算机视觉、多模态理解或推荐系统等任一领域的算法或系统底层优化有深入研究。
3. 具备成熟的研究思维与极强的代码落地能力,善于独立思考与复盘总结。
4. 对新技术(如xLLM、模型压缩蒸馏等)保持强烈好奇心与技术热情。5. 在计算机顶会(如OSDI、SOSP、NeurIPS、ICLR等)有相关学术论文发表,或在优秀开源项目中贡献核心代码者优先。