Описание вакансии
Ключевые обязанности
- Проектирование, развертывание, поддержка и постоянная оптимизация облачной инфраструктуры, контейнерных платформ и производственных сред для обеспечения стабильности, безопасности и эффективности системы.
- Планирование, развертывание, масштабирование, обновление и поддержка кластеров Kubernetes, включая поддержку крупномасштабных, многоузловых и многосредовых развертываний.
- Создание и поддержка CI/CD-конвейеров для автоматизации процессов сборки, тестирования, развертывания и отката кода, повышения эффективности разработки и снижения ручных операций и рисков выпуска.
- Поддержка развертывания сервисов, управления конфигурациями, сервис-дискавери, управления трафиком, автоматического масштабирования и устранения неполадок в архитектуре микросервисов.
- Разработка и улучшение систем мониторинга, логирования, оповещения и реагирования на инциденты для быстрого выявления и устранения проблем в производственной среде, повышения доступности и восстановительной способности системы.
- Сотрудничество с командами разработки для контейнеризации приложений, проектирования архитектуры развертывания и устранения производственных проблем, способствуя стандартизации процессов разработки, тестирования и эксплуатации.
- Участие в развертывании и поддержке инфраструктуры с высокой степенью безопасности, такой как TEE и сервисы подписания, улучшение механизмов управления ключами, контроля доступа и сетевой изоляции.
- Постоянная оптимизация использования ресурсов инфраструктуры, производительности системы и затрат на облачные сервисы, а также документирование инструментов, технических стандартов и операционных процедур.
Требования к кандидату
- Диплом бакалавра в области компьютерных наук или смежных дисциплин и не менее 2 лет опыта работы в DevOps в сфере dex, perps или операций с on-chain биржами.
- Глубокие знания Linux, включая системные команды, shell-скриптинг, сетевые протоколы и устранение неполадок.
- Владение языком Go или скриптовыми языками (Python/Shell) для разработки автоматизации.
- Практический опыт развертывания, масштабирования, обновления, устранения неполадок, планирования ресурсов и RBAC в кластерах Kubernetes.
- Экспертные знания в Docker/контейнеризации и развертывании микросервисов в нескольких узлах/средах.
- Опыт работы с основными облачными платформами (AWS, GCP, Azure, Alibaba Cloud или Tencent Cloud) в производственных средах.
- Знание инструментов CI/CD (GitHub Actions, GitLab CI, Jenkins, Argo CD).
- Опыт работы с инструментами мониторинга/логирования (Prometheus, Grafana, ELK, Loki, Sentry) для устранения инцидентов.
- Понимание сетевых компонентов: группы безопасности, балансировщики нагрузки, обратные прокси, DNS, сертификаты и сервисная коммуникация.
- Отличные навыки межкомандного взаимодействия и документирования.
Предпочтительные квалификации
- Опыт работы с крупномасштабными кластерами Kubernetes или высоконагруженными производственными системами.
- Знание TEE, удаленной аутентификации или сервисов безопасного подписания.
- Опыт работы с инструментами IaC (Terraform, Ansible, Helm).
- Опыт работы в сфере блокчейна, кошельков, торговых систем, финтеха или операций с высокой степенью безопасности.
- Понимание управления ключами (KMS, HSM, мультиподпись, изоляция доступа).
- Опыт работы с service mesh, canary-релизами, автоматическим откатом и развертыванием в нескольких AZ.