运维开发工程师
Indexed description
该职位来源于猎聘 岗位职责 负责公司数据平台底层基础设施的架构设计、部署与运维,保障大规模系统的可靠性、可扩展性与性能; 管理多云环境(AWS/GCP/阿里云)下的Kubernetes集群,包括RBAC权限管控、安全策略、网络配置及版本升级; 使用Helm、Kustomize等工具完成微服务/大数据组件的容器化部署与生命周期管理; 通过Terraform、Pulumi等IaC工具实现基础设施即代码,推动资源管理的标准化与自动化; 开发自动化运维工具与监控平台,提升故障发现、定位与自愈效率; 深度参与K8s高级特性应用(Operator/OPA/Webhook等),优化集群调度与资源利用率; 与内部工程团队及业务方紧密协作,理解业务场景并提供基础设施层面的技术方案与落地指导; 编写技术文档,推动运维流程规范化,支持敏捷迭代与持续交付。 任职要求 8年以上IT从业经验,其中至少5年专注于大规模基础设施系统及云环境运维; 精通AWS、GCP、阿里云中至少一种公有云,熟悉其核心服务(计算、网络、存储、安全等); 深入掌握Kubernetes集群运维,具备生产环境下的RBAC、网络策略、资源配额、安全加固等实战经验; 熟练使用Helm、Kustomize进行应用打包与部署,理解其工作原理; 扎实的IaC落地经验,熟练使用Terraform(或Pulumi/Crossplane)管理云资源; 精通Shell/Python脚本开发,具备较强的自动化运维工具开发能力; 熟练掌握Golang编程,能够独立开发RESTful API服务; 熟悉Kubernetes网络生态,如Cilium、ALB/NLB、Envoy、Nginx Ingress、Cert-Manager等组件; 熟悉至少一种监控/可观测性方案(Prometheus/Grafana/ELK/Datadog等),具备指标、日志、链路追踪整合经验; 英语读写流畅,能够阅读英文技术文档,具备基本的口语沟通能力(需与Global团队协作); 优秀的沟通协调能力,能够直接面向业务团队,理解需求并提供技术解决方案。 加分项 有Temporal工作流开发或运维经验; 具备UI开发能力(如React/Vue等); 有大数据平台(Hadoop/Spark/Flink)或AI训练基础设施运维经验; 熟悉OPA(Open Policy Agent)策略即代码; 跨区域/混合云架构设计经验。
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search