李若云 · 云平台管理工程师
个人总结
2年云平台运维与自动化工程经验,专注用代码消弭重复操作,让多云基础设施更可依赖。在头部电商主导AWS核心交易链路运维,通过Terraform与Python固化高频变更,将人工耗时降低65%,保障核心链路全年可用性99.95%且大促零故障;重构Prometheus告警体系,使噪音下降70%,关键告警MTTA压缩至3分钟内。主导多云成本治理项目,整合AWS Cost Explorer、Grafana与QuickSight构建统一成本看板,识别并优化闲置资源,推动年化云支出节省15%。具备从裸金属到容器的全栈自动化交付能力:在金融科技实习期间将计算节点上架耗时从2小时压缩至25分钟,并独立设计Django+Vue.js自助门户,将私有云资源交付周期从2–3天锐减至15分钟;毕业设计中基于Kubernetes与Go实现智能伸缩平台,扩容决策延迟压缩至30秒内,支撑3000+并发零停机部署。
工作经历
负责电商核心交易链路(AWS)的日常运维与故障响应,使用Python脚本与Terraform模块固化环境变更,降低高频人工操作耗时65%,全任期未发生重大运维事故。重构Prometheus监控告警体系,基于SLO设计分层策略并聚合冗余通知,告警噪音下降70%,关键告警MTTA从10分钟缩短至3分钟以内。搭建GitLab CI/CD自动化发布流水线,集成金丝雀发布与自动回滚,应用发布频次提升3倍,失败率由8%降至0.3%。主导大促保障,通过弹性扩缩容预演、全链路压测、HPA策略调优与预热流程,确保核心链路全年可用性99.95%,大促零故障。
参与搭建基于OpenStack与KVM的私有云,独立完成10+台裸金属节点的Linux初始化与网络规划,首次实现虚拟资源池化交付,支撑3个业务团队的开发测试环境。主导编写Ansible剧本与Shell脚本,对OS基线、KVM部署及OpenStack服务编排进行标准化,将新计算节点上架至可用耗时从2小时压缩到25分钟。构建面向内部团队的自动化资源交付能力,通过命令行工具与参数化脚本,使虚拟机、块存储等资源申请从平均1天缩短至30分钟,初步实现开发者自助化。设计并落地一套基于Shell的核心服务健康巡检与告警自动化流程,覆盖20+项关键指标,消除人工每日巡检,故障平均发现时间降低约70%。
项目经历
主导多云成本治理,整合AWS Cost Explorer、Grafana与QuickSight构建统一成本分析看板,使各业务线费用可见率从不足40%提升至95%。使用Lambda与Python开发自动化数据摄取流水线,按日同步多账号多区域账单与资源用量至集中数据湖,数据处理延迟控制在1小时内。构建闲置资源识别规则与规格优化模型,通过看板标记出30%的未挂载块存储与长期低负载计算实例,输出优化清单供业务决策。配合各业务线完成200+实例的规格下调与计费模式变更,推动月度云支出环比下降,实现年化15%的成本节省。
针对私有云资源依赖人工审批、平均交付周期达2–3天的问题,独立设计基于Django的后端服务,封装OpenStack API实现虚机、网络、存储的标准化订单与自动开通,将端到端交付时长压缩至15分钟以内。使用Vue.js开发自助申请门户,引入动态表单校验与租户配额实时检查,将因参数不合规造成的工单退回率从约40%降至5%以下。设计MySQL多租户数据模型,存储配额、审批记录与操作审计日志,确保每次资源变更全链路可追溯,支撑运营团队输出月度用量报表。通过Docker容器化部署前后端应用,编写Docker Compose编排文件,使本地开发与测试环境搭建时间从半天缩短至分钟级。
主导毕业设计选题与架构,基于Kubernetes与Go实现智能伸缩平台,自定义Prometheus流量指标驱动HPA,将扩容决策延迟从分钟级压缩至30秒内。设计蓝绿发布控制器与流量切换逻辑,在负载测试中实现零停机部署,验证环境成功支撑3000+并发请求。通过Docker多阶段构建与Helm打包交付全栈应用,将本地到集群的部署复现时间控制在5分钟以内。项目获院级优秀毕业设计,并在校内展示中完成10分钟实时流量突增自动扩缩与稳定回切演示。
教育经历
专业技能
荣誉奖项
获得AWS解决方案架构师助理级认证,具备云架构设计能力。
Kubernetes智能伸缩平台毕业设计获评校级优秀毕业设计。
示例数据,仅供参考
换个风格试试
挑一个喜欢的风格,一键创建你的简历

















































