Linux全栈运维专员
Technology
职能部门
今天截至 2026/10/18
职位描述
工作职责
- 系统运维管理:负责Linux服务器的装机部署、环境初始化、安全基线加固及内核参数调优;执行日常服务器巡检工作,快速排查处理线上各类故障,包括OOM内存溢出、磁盘空间爆满、进程异常、端口冲突、服务宕机等问题,保障服务器集群稳定运行。
- MySQL数据库运维:负责MySQL主从、MGR高可用集群的部署、维护与故障切换;熟练编写业务SQL,优化慢查询语句、分析SQL执行计划,解决数据库死锁、主从延迟等常见问题;搭建完善的数据备份体系,熟练使用mysqldump、XtraBackup完成全量/增量备份及数据恢复工作,保障数据安全。
- 中间件集群运维:独立完成Nginx、Redis(哨兵/集群模式)、RabbitMQ、Elasticsearch、MinIO等主流中间件的部署、调优及高可用集群搭建;负责Nginx反向代理、负载均衡、HTTPS配置及限流策略配置,保障缓存、消息队列、对象存储、日志检索服务的平稳运行,及时处理中间件线上异常问题。
- 自动化批量运维:负责50-200台服务器集群的日常管理与维护;基于Ansible实现服务器批量配置下发、环境标准化交付、批量运维操作,统一线上环境规范,大幅提升运维工作效率,降低人工操作失误率。
- CI/CD与容器运维:搭建并维护Jenkins、GitLab CI自动化流水线,落地项目持续集成、持续部署流程;熟练编写Dockerfile、使用Docker Compose完成容器编排,掌握K8s基础运维操作,支撑业务容器化落地与迭代发布。
- 监控告警体系搭建:基于Prometheus+Grafana+Alertmanager、Zabbix搭建全方位监控告警体系,覆盖服务器系统、数据库、各类中间件核心运行指标;自定义告警规则,实现线上异常实时预警、快速感知,提前规避业务风险。
- 日志审计分析:搭建并维护ELK/EFK日志集中分析平台,通过Filebeat、Logstash完成系统日志、业务应用日志、Nginx访问日志、数据库慢查询日志的统一采集、清洗、存储与可视化分析,为故障排查、业务优化提供数据支撑。
- 备份容灾与应急保障:制定合理的全量+增量数据备份策略,搭建异地备份机制,定期开展数据恢复演练,完善容灾体系;提供7×12小时线上故障应急响应,故障处理后输出RCA根因分析报告,迭代优化运维SOP文档,规避同类问题重复发生。
对这个职位感兴趣吗?