个人介绍
我是程序员客栈的运维工程师,一名云原生运维技术从业者; 拥有多年企业运维实战经验,负责过混合云K8s集群、GPU大模型推理平台、信创数据库迁移等基础设施项目; 熟练使用Kubernetes、Linux、Prometheus、Ansible、vLLM; 专注容器运维、故障应急、监控建设与自动化交付,可远程提供项目与人天技术支持,如果我能帮上您的忙,请点击“立即预约”或“发布需求”!
工作经历
2026-04-06 -至今海虎科技高级云原生运维工程师
公司主要做互联网医院项目,涉及AI问诊。 我的主要工作: 1、 负责腾讯云 TKE、阿里云 ACK 及混合云 Kubernetes 平台生产运维,维护多套集群 和 15 余个线上业务服务。 2、 参与互联网医院、AI 推理平台等核心业务的云原生架构建设,负责集群资源治 理、服务发布、故障处理和稳定性优化。 3、 负责 MySQL、达梦 DM8、TDSQL、Redis、Nginx 等数据库和中间件运维,主导 数据库迁移、信创适配、备份恢复及全链路监控建设。 4、 建设 Jenkins、GitLab CI、Harbor/CCR 和 Helm 自动化交付体系,支持滚动发布、 灰度发布、健康检查和失败自动回滚,发布效率提升 70%。 5、 搭建 Prometheus、Grafana、Alertmanager、ELK 和 SLS 监控日志平台,覆盖主机、 集群、容器、数据库、业务接口和 GPU 全栈指标。 6、 负责 GPU AI 推理环境和 vLLM 服务运维,完成 GPU 节点初始化、资源调度、模 型服务发布及 GPU 监控告警建设。 7、 参与医疗数据监管、等保三级认证和容器安全整改,落实
教育经历
2012-09-03 - 2016-06-30上海杉达学院财务管理本科
5年云原生Linux运维实战,精通K8s混合云集群部署调优、故障排查;熟练vLLM‑GPU推理平台运维,可搭建Prometheus监控体系。具备MySQL到达梦DM8信创迁移经验,擅长Ansible自动化、运维SOP编写。可远程承接集群搭建、故障应急、环境改造,支持项目/人天模式




