Iris_Lin
1小时前在线
全职 · 300/日  ·  6525/月
工作时间: 工作日00:00-24:00、周末00:00-24:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

我是程序员客栈的运维工程师,一名云原生运维技术从业者; 拥有多年企业运维实战经验,负责过混合云K8s集群、GPU大模型推理平台、信创数据库迁移等基础设施项目; 熟练使用Kubernetes、Linux、Prometheus、Ansible、vLLM; 专注容器运维、故障应急、监控建设与自动化交付,可远程提供项目与人天技术支持,如果我能帮上您的忙,请点击“立即预约”或“发布需求”!

工作经历

  • 2026-04-06 -至今海虎科技高级云原生运维工程师

    公司主要做互联网医院项目,涉及AI问诊。 我的主要工作: 1、 负责腾讯云 TKE、阿里云 ACK 及混合云 Kubernetes 平台生产运维,维护多套集群 和 15 余个线上业务服务。 2、 参与互联网医院、AI 推理平台等核心业务的云原生架构建设,负责集群资源治 理、服务发布、故障处理和稳定性优化。 3、 负责 MySQL、达梦 DM8、TDSQL、Redis、Nginx 等数据库和中间件运维,主导 数据库迁移、信创适配、备份恢复及全链路监控建设。 4、 建设 Jenkins、GitLab CI、Harbor/CCR 和 Helm 自动化交付体系,支持滚动发布、 灰度发布、健康检查和失败自动回滚,发布效率提升 70%。 5、 搭建 Prometheus、Grafana、Alertmanager、ELK 和 SLS 监控日志平台,覆盖主机、 集群、容器、数据库、业务接口和 GPU 全栈指标。 6、 负责 GPU AI 推理环境和 vLLM 服务运维,完成 GPU 节点初始化、资源调度、模 型服务发布及 GPU 监控告警建设。 7、 参与医疗数据监管、等保三级认证和容器安全整改,落实

教育经历

  • 2012-09-03 - 2016-06-30上海杉达学院财务管理本科

    5年云原生Linux运维实战,精通K8s混合云集群部署调优、故障排查;熟练vLLM‑GPU推理平台运维,可搭建Prometheus监控体系。具备MySQL到达梦DM8信创迁移经验,擅长Ansible自动化、运维SOP编写。可远程承接集群搭建、故障应急、环境改造,支持项目/人天模式

资质认证

语言

中文母语水平
英语借工具书面交流
0
1
2
3
4
5
0
1
2
3
4
5

技能

K8S熟练
0
1
2
3
4
5
作品
混合云 K8s+GPU 推理运维平台建设

平台包含K8s容器集群管理、GPU推理服务运维、统一监控告警、自动化运维、信创数据库适配五大模块。实现业务容器化编排调度,对GPU算力资源做管控监控;统一采集服务器、容器、数据库各项指标,配置告警通知;通过自动化脚本完成环境批量部署,同时支持业务数据库国产化迁移适配,保障医疗及AI业务稳定交付。

0
2026-08-25 15:36
更新于: 2小时前 浏览: 1