직무 설명
주요 책임
- 거래 체인, 시장 데이터 서비스 및 관련 인프라를 포함한 핵심 거래 시스템의 24/7 안정성 보장. 서비스 연속성과 자산 보안을 보장하기 위해 사고 대응, 문제 해결 및 사후 분석에 참여.
- AWS 및 EKS/Kubernetes 프로덕션 인프라 설계, 구축 및 최적화. 클라우드 아키텍처, 네트워킹, 고가용성, 용량 계획 및 재해 복구를 포함. Kubernetes 클러스터 관리(업그레이드, 노드 라이프사이클, 스케줄링, 리소스 관리, Ingress/LB, DNS, 스토리지, 자동 확장 등).
- 관찰 가능성 및 안정성 프레임워크(Metrics, Logs, Tracing, Alerting, SLI/SLO, Incident Response, Postmortem) 개발 및 강화하여 문제 감지, 진단 및 복구 개선. 개발 팀과 협력하여 시스템 병목 현상 및 아키텍처 리스크 해결.
- Infrastructure as Code(IaC), CI/CD 및 자동화(Terraform/Terragrunt, GitHub Actions, Ansible) 촉진하여 인프라 및 애플리케이션 제공 표준화 및 자동화. 변경 관리, 릴리스, 검증 및 롤백 프로세스 개선.
- MySQL, Redis, Kafka와 같은 핵심 데이터 및 미들웨어 서비스에 대한 프로덕션 운영 관리. 고가용성, 모니터링, 용량 계획, 백업/복구, 성능 튜닝 및 문제 해결 포함.
- AWS 및 Kubernetes 보안 거버넌스 추진. IAM/RBAC, 네트워크 격리, 컨테이너/이미지 보안, 비밀 관리(Secrets/KMS), 취약점 관리 및 보안 감사 포함. 관련 팀과 보안 사고 대응 조정.
직무 요구 사항
- 컴퓨터 과학 또는 관련 분야 학사 학위; DevOps/SRE/클라우드 인프라 경력 5년 이상. 대규모 프로덕션 환경, 인프라 설계 및 복잡한 사고 해결 경험. 강한 리스크 인식 및 팀 간 협업 능력.
- Linux, 네트워킹 및 컨테이너 기술에 대한 탄탄한 기초. Kubernetes/EKS 클러스터 설정, 업그레이드, 튜닝 및 문제 해결(Pod/Node/네트워크 수준) 전문성. Java/Go 애플리케이션 환경 및 디버깅에 익숙함.
- 핵심 AWS 서비스(IAM, VPC, EC2, EKS, ALB/NLB, Route 53, S3, CloudWatch)에 대한 프로덕션 경험. 다중 AZ, 고가용성, 네트워크 격리, 최소 권한, 자동 확장, 용량 계획 및 비용 최적화 이해. 인프라 설계, 리스크 평가 및 문제 해결 능력.
- 강력한 IaC/CI/CD/자동화 기술(Terraform/Terragrunt, GitHub Actions, Ansible). 인프라 및 배포 신뢰성 향상을 위한 스크립팅(Bash/Python) 능숙.
- 관찰 가능성 및 안정성 거버넌스 전문성(Prometheus, Grafana, ELK/Loki, OpenTelemetry). Metrics/Logs/Tracing, SLI/SLO, 경고, 용량 계획 및 재해 복구 지식.
- MySQL/Redis/Kafka에 대한 프로덕션 운영 경험. 보안/DevSecOps 배경(IAM, RBAC, 네트워크/컨테이너 보안, Secrets/KMS, 취약점 관리, 감사). 보안 리스크 식별 및 완화 능력.
- Web3/Crypto 업계 경험 우대, 블록체인 메커니즘 및 디지털 자산 거래 리스크 이해.
우대 사항
- 고가용성 실시간 시스템(예: 암호화폐 거래소, 금융, 결제) 경험.
- 대규모/고트래픽 Kubernetes/EKS 환경, AWS 다중 계정 거버넌스, 크로스 리전 DR 또는 재해 복구 훈련.
- 고급 클라우드 네이티브/보안/비용 최적화 실무(Karpenter, Argo CD/Flux, OpenTelemetry, eBPF, FinOps).
혜택
- 매우 경쟁력 있는 급여.
- 싱가포르 작업 비자 스폰서십.
- 다양하고 포용적인 팀 문화를 가진 평평한 계층 구조.
- 관대한 휴가 정책(연차/병가), 주말 휴무 및 우수한 작업 환경.