-
帶領 5 人平台工程小組,負責 12 條產品線的 Kubernetes(Amazon EKS)多集群架構設計、升級與維運
-
以 Terraform 模組化管理 AWS 資源(VPC、EKS、RDS、IAM、S3),將新環境交付時間由 3 個工作日縮短至 45 分鐘
-
建置 GitLab CI 與 Argo CD 的 GitOps 流水線,實現每日 10 次以上零停機部署,回滾時間少於 3 分鐘
-
導入 Prometheus、Grafana、Loki 與 OpenTelemetry,建立 SLO 告警與錯誤預算機制,MTTR 由 90 分鐘降至 25 分鐘
-
推動雲端成本治理(FinOps),透過 Karpenter 自動擴縮與 Savings Plans 規劃,年度雲端支出下降 32%
-
主持每月內部技術工作坊及事故事後檢討,推動知識文件化與值班輪替制度
關鍵字:Kubernetes、Terraform、GitOps、Observability、FinOps
-
將單體式 Java 應用拆分為 20 個微服務並容器化部署至 Kubernetes,發佈週期由季度縮短至雙週
-
以 Jenkins 與 Ansible 建立自動化建置、測試與部署流程,人工操作步驟減少 85%
-
設計香港與新加坡多區域災難復原架構,RTO 由 8 小時降至 30 分鐘,RPO 控制在 5 分鐘內
-
導入 HashiCorp Vault 集中管理密鑰與憑證,消除設定檔中的明文密碼與共用帳號
-
與開發團隊協作推行測試自動化與品質閘門,單元測試覆蓋率由 42% 提升至 81%
關鍵字:Jenkins、Ansible、Docker、Vault、Disaster Recovery
-
負責 200 多台 Linux 伺服器的日常維運、效能調校、修補管理與容量規劃
-
建置 Zabbix 與 Nagios 監控告警系統,將被動故障處理轉為主動預警
-
撰寫 Shell 與 Python 自動化腳本,將例行備份與巡檢工作壓縮至每日 15 分鐘內完成
-
協助三家客戶完成 AWS EC2 與 RDS 遷移,平均節省 40% 自建機房維運成本
關鍵字:Linux、Shell、Python、Zabbix