工作地点:
北京市,四川省-成都市
工作职责:
1.负责云平台的自动化运维、升级工具与平台的设计、开发与迭代,提升运维效率与平台稳定性;
2.参与云平台监控告警体系、故障自愈系统的建设,实现资源巡检、故障排查与处理的自动化;
3.参与云平台的日常运维、版本升级、性能调优与故障排查,保障平台7×24小时稳定运行;
4.编写运维脚本与自动化工具,优化云平台部署、扩容、备份等标准化运维流程;
5.沉淀运维规范与技术文档,推动运维标准化、自动化、智能化能力建设。
任职资格:
1.本科及以上学历,计算机、软件工程、网络工程等相关专业应届毕业生;
2.具备扎实的Linux系统基础,熟悉常用命令与Shell脚本编写,掌握TCP/IP网络原理;
3.熟练掌握Python/Golang中至少一门编程语言,有自动化工具或运维平台开发经验者优先;
4.了解云计算基础架构,熟悉OpenStack部署架构与核心组件原理,有OpenStack搭建、运维实践经验者优先;
5.了解Prometheus、Zabbix、ELK等常用监控、日志工具者优先;
6.具备良好的问题排查能力与学习能力,工作严谨细致,有较强的责任心与团队协作意识。