个人简历
个人信息
姓名:王嘉威
电话:18026258005
目前已离职
教育经历
广东技术师范大学 2020.09 - 2022.06
通信工程专业 本科 (统招全日制)
广东理工职业学院 2017.09 - 2020.06
计算机应用专业 专科 (统招全日制)
专业技能
持有CKA、CKS 认证,熟悉 Kubernetes 集群部署、维护、升级、排障及安全加固。
持有 RHCE、RHCSA 认证,具备 Linux 系统安装部署、基础服务配置、权限管理、日志排查与日常运维能力。
熟练使用 Docker 完成应用容器化与镜像构建,熟悉 Git 版本管理,了解 CI/CD 流水线与自动化部署流程。
熟练编写 Shell 脚本,支持服务巡检、批量操作、日志处理与日常运维自动化。
持有大学英语四级证书,熟练查阅英文技术文档,擅长撰写项目文档。
掌握HTML5、CSS3、JavaScript、React和Next.js等前端技术,具有一定的前端开发能力,可以参与Web界面的构建和维护
善于将复杂技术概念转化为通俗易懂的表达。在过往经历中,多次为生产、质量等非技术部门提供技术支持。
工作经历
重庆怡卓人力资源有限公司 (2023.08 - 2026.03)
技术支持
系统巡检与故障处置:负责340余台计算机化系统(含Windows、Linux系统)的日常运行状态巡检、故障诊断与应急处理;建立故障处理标准化流程,显著缩短设备故障恢复时间,保障生产系统稳定运行。
系统升级与风险管控:主导150余台设备操作系统版本升级与硬件迭代项目,独立编写了详细的升级方案,包含数据备份策略、操作步骤和回滚预案。升级全程严格按方案执行,所有设备平稳过渡。
资产管理与权限管控:建立并维护计算机化系统全生命周期台账,依据最小权限原则定期审计用户账号与访问权限,确保符合法规要求与内部安全基线。
跨部门技术支持: 为生产、质量、研发等部门提供日常IT技术支持,协助各部门完成计算机化系统交付验收与日常使用培训,让非技术人员也能快速上手。
质量报告输出: 按周输出质量分析报告,通过对质量问题的分类整理,定期向上级提交改进建议,为管理层及时了解一线交付状况、优化业务流程提供了清晰的数据参考。
康方药业有限公司(2022.07 - 2023.04)
技术支持
验证方案交付与技术执行:负责计算机化系统验证方案的起草与执行,独立完成了16份数据一致性验证方案,覆盖深层过滤系统、超滤系统等设备,确保验证活动在既定时间与合规框架内高质量完成。
合规知识沉淀:主动将验证执行中最易导致理解偏差的抽象合规要求,提炼为基于判断要点的解读文档,帮助团队成员快速掌握判定标准。该举措使团队操作趋于统一规范,同类理解性错误发生率显著下降。
多项目统筹与优先级管理:在多项目并行、人力资源紧张的高压下,评估任务技术难度与团队人均处理能力,建立优先级排期表,确保核心项目获得资源优先倾斜,从机制上规避了资源争抢导致的进度冲突。
进度监控与风险预警:每日跟踪各项目执行进展,主动识别延期风险点,第一时间将风险同步至上级,并给出具体的资源调配建议。通过持续的前置干预,最终实现所有项目零延期、按时按质交付。
项目经历
离线环境下基于 Argo CD 的 GitOps 监控栈交付方案
技术栈: 腾讯云 Ubuntu Server / K3s / Argo CD / Helm / Prometheus Operator / Grafana / Prometheus Operator / PostgreSQL Exporter / Blackbox Exporter / Kustomize / 阿里云 ACR / Traefik
项目背景与交付总览
在腾讯云 K3s 单节点集群中,搭建了一套适用于内网受限环境的监控系统 GitOps 交付流程。基于 Argo CD 的 App of Apps 模式,将 Prometheus、Grafana、Alertmanager、PostgreSQL Exporter、Blackbox Exporter 等组件统一纳入 Git 仓库管理;通过六层目录(bootstrap / apps / charts / values / manifests / argocd)清晰划分引导、编排、模板、配置各层职责;仅需一次手工执行 root-app 引导,所有组件的部署、配置变更与回滚均由 Argo CD 自动同步完成,解决了传统手动部署带来的配置偏移问题,实现"Git 即唯一事实来源",最终交付了一套稳定、可审计、可复制的监控方案。
离线镜像与 Helm Chart 本地化
针对生产环境无法访问公网的限制,将 kube-prometheus-stack、PostgreSQL Exporter、Blackbox Exporter 的 Helm Chart 下载并解压存入 Git 仓库,使 Argo CD 在部署时完全不依赖外部 Helm 仓库;同时将所有组件镜像同步至阿里云 ACR 私有仓库,并在各组件的 values.yaml 中逐一将镜像地址重定向至 阿里云ACR,通过本地 helm template 渲染验证和镜像地址核查脚本确保无遗漏;敏感资源(镜像拉取凭证 acr-secret、TLS 证书、Grafana 管理员密码、PostgreSQL 连接字符串)统一在引导阶段手工创建为 Kubernetes Secret,不进入 Git 仓库,避免凭证泄露。
保障组件有序部署与解决同步冲突
为五个子应用配置了 Argo CD 的 Sync-Wave 注解,让它们在三个波次中依次部署:Wave 0 先建监控底座并注册 CRD,Wave 1 再上采集器和面板,最后Wave 2 下发探测目标(Probe CR)。为了规避两个应用同时管理同一个 Probe 资源引起的 Argo CD 永久 OutOfSync 问题,将主动探测的目标 Probe 从 Blackbox Exporter 应用中独立出来,单独用一个子应用管理。此外,还通过开启 ServerSideApply 解决了 Prometheus CRD 文件过大导致同步报错的问题。
Grafana 面板的声明式与离线交付
为摆脱手动导入的繁琐,借助 Kustomize 的 configMapGenerator,将 PostgreSQL 和 Blackbox 面板的 JSON 配置,生成为带特定标签的 ConfigMap,再配合 Grafana Sidecar 实现了面板的自动发现与热加载。通过设置 disableNameSuffixHash 固定 ConfigMap 名称,避免了因内容变化导致名称改变、进而被 Argo CD 误判为新建资源的问题;同时开启 Server-Side Apply,解决了大型面板 JSON 引起的 last-applied-configuration annotation 超限报错,确保面板管理完全 GitOps 化并支持离线交付。
监控栈噪音治理与跨命名空间采集
针对 K3s 环境定制了 kube-prometheus-stack 的采集项,关闭了 etcd、controller-manager 等不可用组件的指标抓取,消除了大量无效告警;开放了跨命名空间 ServiceMonitor 选择器,使 exporters 命名空间下的数据库和拨测指标能被统一采集;同时配置 Alertmanager 路由规则,只推送 critical 级别的告警,其余静默,显著降低了告警干扰。
Prometheus:
Grafana:
账号:interviewer
密码:interviewer
Argo CD:
账号:interviewer
密码:interviewer
注意:账号/密码前后不能有空格