AI云原生智能体运维专家-火山引擎
字节跳动
岗位职责
1、售后支持与问题解决:作为二线专家通过工单、在线会议等方式响应一线技术支持/用户的产品售后问题,覆盖容器服务、ArkClaw、TRAE-CN、AgentKit等产品,提供高效优质的服务体验;负责产品部署、配置、使用过程中的常见及疑难问题定位与解决,包括但不限于Kubernetes集群异常、容器网络/存储问题、模型推理环境配置、IDE插件兼容性问题、Agent工作流异常等;
2、升级与协同:识别复杂问题,及时协调研发、算法等技术专家协同处理,对一线解决率、问题处理时效、用户满意度等服务指标负责;
3、用户关系管理:识别用户紧急重要事件和投诉风险,高优跟进处理,规避客户不满;主动收集用户反馈,整理提炼后反馈至产品/研发团队,推动产品持续优化;
4、知识沉淀与体系建设:参与SOP、排障手册、知识库的建设与维护,编写常见问题解决方案和技术教程,提升团队整体支持能力与一线自解决率;
5、前沿技术跟踪:持续关注容器技术、AI大模型、AI Agent领域的技术动态,将新技术知识应用于支持工作,提升服务专业度。
任职要求
1、本科及以上学历,计算机科学、软件工程、人工智能或相关专业,3年以上售后技术支持、DevOps或相关技术工作经验;
2、熟悉Linux操作系统基础,具备Shell脚本编写能力;至少掌握一门编程语言(Python/Go/JavaScript之一);
3、了解容器与云原生基础知识,熟悉Kubernetes基本概念(Pod、Service、Ingress、PVC等)及常见问题定位方法;
4、了解大语言模型(LLM)基本原理及应用场景,有AI工具使用经验,对AI技术有探索兴趣;
5、了解主流IDE(尤其是VSCode)的工作原理和插件生态,能够定位开发环境配置类问题;
6、具备良好的客户服务意识,沟通能力强,能独立推进问题闭环。
加分项
1、有Kubernetes/容器产品、AI IDE/Agent框架等售后运维实战经验;
2、参与过大模型训练/推理基础设施建设,有Kubernetes、GPU调度、分布式存储相关经验;
3、了解网络基础知识(TCP/IP、DNS、负载均衡等),有client-server架构排障能力;
4、有社区运营、技术文档写作或知识库建设经验。