- Experience
- 5+ yrs
- Salary
- —
- Openings
- 1
- Posted
- 17 hours ago
- Work mode
- In office
- Education
- 本科
- Resume
- Required to apply
Where you'll work
Sign in to tell us what does and doesn't work for you here — it sharpens every match we show you.
Job description
职位介绍
Davion Labs 诚邀经验丰富的高级运维工程师加入 ApeX Protocol 核心团队。ApeX Protocol 是领先的去中心化交易所平台,专注于为用户打造流畅、高效且安全的加密货币交易环境。核心产品 ApeX Omni (v2) 支持多链流动性、灵活设计及顶级安全保障,团队持续优化金融级交易终端,应对大规模跨链交互和高频实时行情。
主要职责
- 保障生产环境的稳健性、安全性和高可用性,深入处理发布部署、系统变更、性能优化及复杂故障,参与重大故障应急响应并推动长期问题治理。
- 建设并持续优化 AWS 云基础设施和 Kubernetes(K8s)平台,参与基础设施规划与技术架构设计,提出并落地稳定性、安全性和可运维性的解决方案。
- 推动运维自动化、标准化及工程化,完善基础设施即代码(IaC)、CI/CD 流程及自动化运维框架,建立可靠的发布、验证及回滚机制,降低人为操作风险。
- 构建和优化监控、日志、告警、应急响应及故障复盘体系,提高问题检测、定位和恢复效率,推动研发协作解决应用与架构层面长期问题。
- 负责数据库及关键基础组件的高可用设计、容量规划、备份恢复及故障处理,确保关键服务稳定运行。
- 推行基础设施安全治理,完善权限管理、安全基线、网络与容器安全、数据及密钥安全、漏洞管理、安全审计及事件响应流程。
- 持续优化云资源架构和使用效率,兼顾稳定性和安全性进行容量规划与成本控制,关注云原生、自动化及安全技术的发展,结合业务需求推动技术改进。
任职资格
- 计算机或相关专业本科及以上学历,拥有五年以上 DevOps、SRE 或运维领域实际生产环境经验,具备架构设计与现场执行能力,能够设计、实施基础设施方案及处理复杂故障。
- 具备扎实的 Linux 操作系统、网络及容器技术基础,拥有生产环境 Kubernetes(K8s)集群部署、升级、调优及故障排查的实操经验;了解 Java、Go 应用运行环境及排障方法。
- 熟悉 AWS 核心服务(IAM、VPC、EC2、EKS)和 Terraform/Terragrunt 等基础设施即代码(IaC)工具,有实际生产环境操作经验。
- 具备自动化及工程化能力,熟练使用 GitHub Actions、Ansible 等 CI/CD 与自动化工具,擅长 Bash、Python 等脚本编写。
- 拥有生产级监控、告警和稳定性治理经验,熟悉 Prometheus、Grafana、ELK/Loki 等监控工具,熟悉容量规划和容灾机制并参与应急响应。
- 熟悉 MySQL、Redis、Kafka/RocketMQ 等数据库及核心服务,理解高可用架构、性能优化、备份恢复及故障排查,并具备基本 SQL 能力。
- 具备较强的安全意识和安全运维经验,熟悉云平台权限与网络安全、主机及容器安全、数据及密钥安全、漏洞管理、安全审计及事件响应流程。
- 责任心强,具备风险识别意识,能够跨团队协作主动发现并推动技术与流程改进。
Level
Senior
Minimum education
Bachelor's Degree
Tools & software
Kubernetes
required
MySQL
required
Linux
required
Redis
required
Prometheus
required
How they work
Teamwork & Collaboration
Initiative
Accountability