Job Description:
DevOps Engineer
一、岗位职责
1、负责公司云端基础设施、容器化平台及生产环境的建设、部署、维护与持续优化,保障各业务系统稳定、安全、高效运行。
2、负责 Kubernetes 集群的规划、部署、扩容、升级及日常运维,支持大规模集群、多节点及多环境部署。
3、建设并维护 CI/CD 流程,推动代码构建、测试、发布、回滚等环节自动化,提升研发交付效率,降低人工操作及发布风险。
4、支持微服务架构下的服务部署、配置管理、服务发现、流量治理、弹性伸缩及故障处理。
建设并完善监控、日志、告警及故障响应体系,及时定位和处理线上异常,持续提升系统可用性和故障恢复能力。
5、配合研发团队完成应用容器化、部署架构设计及生产环境问题排查,推动开发、测试及运维流程标准化。
6、参与 TEE、签名服务及其他高安全等级基础设施的部署和运维,协助完善密钥管理、权限控制、网络隔离等安全机制。
7、持续优化基础设施资源使用效率、系统性能及云服务成本,沉淀运维工具、技术文档和标准操作流程。
Job Requirements:
一、基础要求
1、本科以上计算机相关专业,有2年以上dex, perps, 链上交易所运维经验。
2、具备扎实的 Linux 基础,熟悉常用系统命令、Shell 脚本、网络协议及线上问题排查方法。
3、熟练掌握 Go 语言,或具备 Python、Shell 等自动化脚本开发能力,能够通过代码和工具提升运维自动化水平。
4、具备丰富的 Kubernetes 集群实践经验,熟悉集群部署、扩缩容、升级、故障排查、资源调度及权限管理。
5、熟悉 Docker 及容器化技术,具备微服务、多节点、多环境部署和运维经验。
熟悉至少一种主流云服务平台,如 AWS、Google Cloud、Azure、阿里云或腾讯云,并具备云上生产环境运维经验。
6、熟悉 CI/CD 体系及相关工具,如 GitHub Actions、GitLab CI、Jenkins、Argo CD 等。
7、熟悉日志、监控及告警体系,如 Prometheus、Grafana、ELK、Loki、Sentry 等,能够独立完成线上故障定位和处理。
熟悉网络、安全组、负载均衡、反向代理、DNS、证书及服务间网络通信等基础设施配置。
8、具备良好的跨团队沟通和文档撰写能力,能够与研发、安全等团队协同推进基础设施建设。
二、优先条件
1、有大规模 Kubernetes 集群或高并发生产环境运维经验。
2、有 TEE、可信执行环境、远程证明或安全签名服务部署经验。
3、熟悉 Terraform、Ansible、Helm 等基础设施即代码及自动化配置工具。
4、有区块链、钱包、交易系统、金融科技或高安全等级业务的 DevOps 经验。
5、熟悉密钥管理、Secrets Management、KMS、HSM、多签或权限隔离机制。
6、有微服务治理、服务网格、灰度发布、自动回滚、容灾及多可用区部署经验。
Benefits:
每年7天带薪年假,随私龄递增,每月有带薪病假。