岗位职责:
1. 机房基础设施与硬件运维:负责机房服务器、存储设备、网络设备的安装、配置及日常巡检;管理设备上下架、综合布线,协调施工方完成机房整改或扩容项目。
2.云平台与IaaS运维管理:负责云服务器及IaaS的日常运维、扩容、故障处理、优化提升及升级实施;维护云平台备份计划与灾备策略,开展备份恢复演练与数据恢复验证,规划备份资源容量,设计备份平台架构及演进路线。
3.监控体系与性能管理:通过Zabbix、Nagios等工具实时监控服务器性能(CPU、内存、磁盘I/O)、网络流量及业务应用状态,确保系统稳定运行。
4. 自动化运维与架构优化:使用Ansible、SaltStack等工具实现配置管理自动化,减少人工操作风险;编写Shell/Python脚本优化日常任务(如日志分析、批量部署),提升运维效率;参与架构优化,如负载均衡调整、缓存策略设计,确保系统在高并发场景下稳定运行。
5.数据库全生命周期管理:负责数据库系统的安装、配置、备份恢复、性能监控与调优;设计并实现数据库高可用方案,提高可靠性与性能;制定并实施数据库安全策略(权限管理、漏洞修复及审计日志分析);制定应急预案、数据容灾及故障修复策略,解决运行中的各类技术问题,确保系统稳定运行。
任职要求:
1.基础要求:计算机科学、信息技术或相关领域的统招本科及以上学历;5年以上数据库运维经验,熟悉Linux系统及主流数据库架构;持有相关数据库技术认证(如Oracle OCM、MySQL Certified DBA等)者优先。
2.知识技能:
(1)精通主流数据库系统(如Oracle、MySQL、Redis、Mangodb等)的安装、配置和管理;有大规模TiDB和Elasticsearch集群管理经验者优先;有容器化技术(如Docker、Kubernetes)使用经验优先。
(2)熟悉Linux操作系统及Windows、VMware虚拟化服务器的安装配置维护,具备Shell/Python脚本编写能力,具备数据库性能调优、备份与恢复的经验。
(3)熟悉数据库安全机制及安全策略制定;熟悉分布式系统原理,了解高可用性、负载均衡、容错等概念。
3.核心能力:良好的问题分析与解决能力,能够独立处理数据库运行中的各类技术问题,快速定位故障根因并制定有效解决方案。
4.综合素质:具备良好的责任心与风险防范意识,良好的团队协作与沟通能力。